Rime présente Coda, un modèle de synthèse vocale pour agents conversationnels en temps réel qui reproduit le rythme, les pauses et l'intonation propres à une conversation naturelle, conçu pour les environnements à forte concurrence.
Coda est le nouveau modèle de synthèse vocale de Rime, disponible en bêta publique depuis le 19 mai 2026. La société l'a développé pour répondre aux besoins des entreprises qui gèrent de grands volumes d'interactions téléphoniques avec leurs clients, un segment dans lequel Rime opère déjà avec plusieurs entreprises à grande échelle.
Contrairement à son modèle précédent, Arcana v3, Coda utilise une architecture à double décodeur entraîné conjointement : l'un orienté vers la compréhension sémantique du texte et l'autre vers la reconstruction acoustique. Cette conception permet de capturer des éléments propres à la conversation réelle — comme le rythme, les pauses ou le contour de l'intonation — qui se perdent habituellement dans les modèles conçus pour des monologues ou du contenu audio préenregistré. Le système traite l'audio par segments de 80 millisecondes, chacun encodé en 15 codes acoustiques, et délivre le signal en streaming.
Rime a également développé sa propre infrastructure d'inférence, appelée TIGERSTRIPE, qui exécute le modèle aussi bien dans le cloud qu'en installation locale. L'entreprise affirme que cette implémentation propriétaire surpasse les solutions standard du secteur. Les progrès les plus importants par rapport à Arcana sont enregistrés dans les contextes multilingues.
Dans des évaluations comparatives de qualité vocale face à ElevenLabs — aussi bien son modèle Flash que v3 —, Coda obtient de meilleures scores dans toutes les langues testées, avec la plus grande différence en espagnol. Par rapport à Arcana, les avancées les plus notables concernent l'allemand, l'espagnol et le français.
Le modèle est disponible via le tableau de bord et l'API de Rime.
Entreprise spécialisée dans les modèles de synthèse vocale pour agents vocaux en entreprise. Reproduit les respirations, les pauses et le rythme de la parole réelle, avec un contrôle de la ...
12/06/2026
Le gouvernement des États-Unis a ordonné à Anthropic de bloquer l'accès à Claude Fable 5 et Mythos 5 aux ressortissants étrangers, ce qui a ...
09/06/2026
...
02/06/2026
Microsoft élargit sa famille de modèles d'intelligence artificielle avec sept développements internes couvrant la génération d'images, la ...
25/05/2026
Le pape Léon XIV publie la première encyclique consacrée à l'intelligence artificielle, fixant la dignité humaine comme critère de tout ...