Empresa de creación de modelos de texto a voz para agentes de voz empresariales. Reproduce respiraciones, pausas y ritmo del habla real, con control de pronunciación sin necesidad de reentrenar el modelo.
Rime desarrolla modelos de texto a voz para conversaciones empresariales en las que la precisión y la naturalidad de la voz son determinantes. La empresa fue fundada en 2022 en San Francisco por lingüistas e ingenieros con experiencia en proyectos como Amazon Alexa, y construye sus sistemas a partir de un conjunto de datos propios de voz espontánea en formato full-duplex que incluye interrupciones, respiraciones y disfluencias vocales, capturados en estudio y en distintas localizaciones de los Estados Unidos.
La propuesta de Rime se articula en tres ejes. El primero es la naturalidad de la voz: sus modelos reproducen el tono, el ritmo y las imperfecciones propias del habla real —respiraciones, pausas y énfasis— para que las conversaciones no resulten automatizadas. El segundo es el control de pronunciación: la plataforma incluye SpeechQA, una herramienta que detecta palabras con pronunciación dudosa antes de su publicación y permite corregirlas en minutos, sin necesidad de reentrenar el modelo. El tercero es el soporte multilingüe, con modelos que mantienen la naturalidad del habla en varios idiomas.
Rime ofrece tres modelos principales. Coda es el modelo general, orientado a entornos de producción empresarial con equilibrio entre velocidad y naturalidad. Arcana está diseñado para aplicaciones que requieren alta expresividad, con más de 300 voces y opciones bilingües y multilingües. Mist es un modelo de alta velocidad con una latencia inferior a 200 ms en la nube e inferior a 100 ms en instalación local, orientado a aplicaciones de gran volumen.
Los modelos pueden desplegarse en la nube, en un entorno VPC privado o completamente en las instalaciones del cliente. La plataforma cuenta con certificaciones HIPAA y SOC 2 Tipo II, y opera en sectores como la sanidad, la restauración, las finanzas y las telecomunicaciones.
Rime presenta Coda, un modelo de texto a voz para agentes conversacionales en tiempo real que reproduce el ritmo, las pausas y la entonación propios de una conversación real, diseñado para entornos de alta concurrencia.
Esta web utiliza cookies técnicas, de personalización y análisis, propias y de terceros, para facilitarle la navegación de forma anónima y analizar estadísticas del uso de la web. Consideramos que si continúa navegando, acepta su uso.