Casimiro Ferreira
Jarbas
AI & ML interests
None yet
Recent Activity
updated a collection 2 days ago
OVOS Plugin Arena updated a collection 2 days ago
OVOS Plugin Arena updated a collection 2 days ago
OVOS Plugin ArenaOrganizations
model2vec distilled models
sentence transformers distilled via Model2Vec
music_queries
🎵 MusicQueries Dataset is a synthetic natural language dataset focused on music-related utterances designed for media playback scenarios
Intent Classification Datasets
Português de Portugal (Audio)
audio datasets with European Portuguese samples
Synthetic TTS Datasets pt-PT
ovos-model2vec-intents
model2vec classifiers trained on OpenVoiceOS gitlocalize data
-
OpenVoiceOS/ovos-model2vec-intents-LaBSE
0.1B • Updated • 434 -
Jarbas/ovos-model2vec-intents-xlm-roberta-ovos-intent-classifier
64M • Updated • 5 -
OpenVoiceOS/ovos-model2vec-intents-roberta-large-ca-v2-massive
12.9M • Updated • 17 -
OpenVoiceOS/ovos-model2vec-intents-serafim-335m-portuguese-pt-sentence-encoder
7.6M • Updated • 15
Wake Word Datasets
various datasets useful for training wake word models
MediaEntities
datasets containing artists/genres/songs/albums...
Text-to-Speech pt-PT
Synthetic TTS Datasets pt-PT
model2vec distilled models
sentence transformers distilled via Model2Vec
ovos-model2vec-intents
model2vec classifiers trained on OpenVoiceOS gitlocalize data
-
OpenVoiceOS/ovos-model2vec-intents-LaBSE
0.1B • Updated • 434 -
Jarbas/ovos-model2vec-intents-xlm-roberta-ovos-intent-classifier
64M • Updated • 5 -
OpenVoiceOS/ovos-model2vec-intents-roberta-large-ca-v2-massive
12.9M • Updated • 17 -
OpenVoiceOS/ovos-model2vec-intents-serafim-335m-portuguese-pt-sentence-encoder
7.6M • Updated • 15
music_queries
🎵 MusicQueries Dataset is a synthetic natural language dataset focused on music-related utterances designed for media playback scenarios
Wake Word Datasets
various datasets useful for training wake word models
Intent Classification Datasets
MediaEntities
datasets containing artists/genres/songs/albums...
Português de Portugal (Audio)
audio datasets with European Portuguese samples