Anthropic ha lanzado una actualización de su modo de voz para el chatbot Claude, mejorando sus capacidades incorporando los modelos Sonnet y Opus para consultas más complejas. Anteriormente, el modo de voz operaba únicamente a través de Haiku, el modelo más pequeño de la compañía, lo que generaba ineficiencias con solicitudes complicadas.
La actualización permite a los usuarios pagos cambiar entre Haiku, Sonnet y Opus durante las conversaciones. El modo de voz utilizará de forma predeterminada el último modelo utilizado para el chat de texto, lo que garantiza interacciones más fluidas. «El modo de voz utiliza la versión más rápida del modelo que hayas seleccionado, por lo que la conversación se desarrolla sin problemas», afirmó Anthropic.
Además, el modo de voz actualizado ahora accede al contexto de aplicaciones conectadas como Gmail y Slack, dependiendo del permiso del usuario. Un portavoz de Anthropic explicó que el modo de voz de Claude opera en una arquitectura por turnos, lo que significa que escucha, hace una pausa y luego responde, lo que difiere del sistema GPT-Live totalmente dúplex de OpenAI que procesa la voz simultáneamente.
Este modelo por turnos puede hacer que las conversaciones con Claude parezcan menos naturales en comparación con ChatGPT. Otra limitación es que actualmente Claude no puede detectar automáticamente los cambios de idioma; los usuarios deben indicar explícitamente el cambio o seleccionar manualmente el idioma en el menú de configuración. Sin embargo, se han introducido idiomas adicionales, incluido el indonesio.
«Esta versión se centra en la inteligencia y el acceso a herramientas», dijo Anthropic. «Seguimos invirtiendo en voz y tendremos más para compartir más adelante este año».
El nuevo modo de voz se está implementando en versión beta para todos los usuarios en computadoras de escritorio, aplicaciones móviles y el cliente web. Los usuarios con cuentas gratuitas estarán limitados a una sola conexión y todas las indicaciones se ejecutarán a través de Haiku, pero aún podrán utilizar el modo de voz en todos los idiomas admitidos.





