Coda, le nouveau modèle de synthèse vocale de Rime pour les conversations d’entreprise à grande échelle

19/05/2026

Rime présente Coda, un modèle de synthèse vocale pour agents conversationnels en temps réel qui reproduit le rythme, les pauses et l'intonation propres à une conversation naturelle, conçu pour les environnements à forte concurrence.

Coda, le nouveau modèle de synthèse vocale de Rime pour les conversations d’entreprise à grande échelle

Coda est le nouveau modèle de synthèse vocale de Rime, disponible en bêta publique depuis le 19 mai 2026. La société l'a développé pour répondre aux besoins des entreprises qui gèrent de grands volumes d'interactions téléphoniques avec leurs clients, un segment dans lequel Rime opère déjà avec plusieurs entreprises à grande échelle.

Contrairement à son modèle précédent, Arcana v3, Coda utilise une architecture à double décodeur entraîné conjointement : l'un orienté vers la compréhension sémantique du texte et l'autre vers la reconstruction acoustique. Cette conception permet de capturer des éléments propres à la conversation réelle — comme le rythme, les pauses ou le contour de l'intonation — qui se perdent habituellement dans les modèles conçus pour des monologues ou du contenu audio préenregistré. Le système traite l'audio par segments de 80 millisecondes, chacun encodé en 15 codes acoustiques, et délivre le signal en streaming.

Rime a également développé sa propre infrastructure d'inférence, appelée TIGERSTRIPE, qui exécute le modèle aussi bien dans le cloud qu'en installation locale. L'entreprise affirme que cette implémentation propriétaire surpasse les solutions standard du secteur. Les progrès les plus importants par rapport à Arcana sont enregistrés dans les contextes multilingues.

Dans des évaluations comparatives de qualité vocale face à ElevenLabs — aussi bien son modèle Flash que v3 —, Coda obtient de meilleures scores dans toutes les langues testées, avec la plus grande différence en espagnol. Par rapport à Arcana, les avancées les plus notables concernent l'allemand, l'espagnol et le français.

Le modèle est disponible via le tableau de bord et l'API de Rime.

Points clés

  • Coda est le nouveau modèle de synthèse vocale de Rime pour les agents conversationnels d'entreprise en temps réel
  • Reproduit le rythme, les pauses et l'intonation naturels grâce à un double décodeur sémantique et acoustique
  • Surpasse les modèles orientés vers les monologues ou l'audio préenregistré
  • Inclut une infrastructure d'inférence propriétaire, disponible en cloud et en installation locale
  • Dans les comparatifs face à ElevenLabs, obtient de meilleurs scores dans toutes les langues, avec la plus grande différence en espagnol
  • Par rapport à Arcana, son modèle précédent, les progrès les plus importants concernent l'allemand, l'espagnol et le français

IA connexe

Rime

Modèles de synthèse vocale

Entreprise spécialisée dans les modèles de synthèse vocale pour agents vocaux en entreprise. Reproduit les respirations, les pauses et le rythme de la parole réelle, avec un contrôle de la ...

Dernières nouvelles

★★★★★
Évaluez-nous sur Google
Ce site utilise des cookies techniques, de personnalisation et d’analyse, propres et tiers, pour faciliter la navigation anonyme et analyser les statistiques d’utilisation du site. Nous considérons que si vous continuez à naviguer, vous acceptez leur utilisation.