Model
Trends
.ai
Model
Trends
.ai
les meilleurs modèles d'IA open source
AD
/wf /run:audio-miso
À propos de ce modèle
MISOTTS · Workflows
Miso Text-to-Speech S 8B is a text-to-speech model based on the Sesame CSM architecture. It generates Mimi audio codes from text and optional audio context, using a large Llama 3.2-style backbone and a smaller autoregressive audio decoder. The model is designed for high-quality conversational speech generation and voice continuation from prompt audio.
ID de modèle ModelTrends.ai
#28002
Signaler le contenu
Modèles similaires
Aucun modèle similaire trouvé
Modèles d'IA pour générer image, vidéo et texte
audio miso est un workflow pour la famille MisoTTS, référencé sur ModelTrends.ai, un catalogue en lecture seule de modèles d'IA open source pour l'image, la vidéo et le texte. Comparez-le aux autres modèles MisoTTS, consultez son score de chaleur pour suivre sa tendance et ouvrez-le sur PirateDiffusion ou BitVector pour l'essayer.
Parcourir par famille de modèles
Voir tous les modèles