Anthropic ha lanzado su nueva actualización para el modo de voz de Claude. La función, que se lanzó el año pasado, hasta ahora ha estado trabajando con el modelo Haiku, que se centra en una respuesta rápida pero se ha limitado a tareas complejas. Con la nueva actualización, los usuarios pagos también podrán acceder a los modelos Sonnet y Opus durante llamadas de voz.
Cuando el modo de voz está activado, Claude utilizará automáticamente el último patrón preferido del usuario en una conversación basada en texto. El sistema cambiará a la versión más rápida del modelo seleccionado para que la conversación avance sin problemas. Además, los usuarios podrán cambiar entre Haiku, Sonnet y Opus a través del selector de modelo sin necesidad de finalizar la conversación. Al cambiar entre los modos de conversación de texto y voz, se conservará el contexto actual de la conversación.
Como parte de la actualización, Claude puede acceder a las aplicaciones conectadas mientras está en modo de voz. Al conectar servicios como Gmail, Google Calendar, Google Docs, Slack, Canva y Notion a Claude, los usuarios podrán resumir sus correos electrónicos, consultar sus calendarios o cambiar los horarios de las reuniones. También se le puede pedir a Claude que prepare una presentación para el cliente, redacte un correo electrónico o convierta una idea desarrollada durante la conversación en un documento.
Anthropic afirma que modelos más potentes marcarán la diferencia, especialmente en conversaciones largas y complejas. Los casos de uso compartidos por la empresa incluyen trabajar en una presentación para un cliente, realizar una lluvia de ideas sobre investigaciones de mercado de productos, obtener comentarios sobre el estilo de comunicación y ensayar antes de reuniones importantes.
Aunque la actualización mejora la calidad de respuesta de Claude y las capacidades de uso del vehículo, no cambia por completo la infraestructura de llamadas de voz. En este sentido, podemos decir que Claude sigue trabajando con un sistema secuencial donde, tras escuchar al usuario, se detiene y crea su respuesta. En resumen, el sistema no tiene una arquitectura de audio full duplex que produzca una respuesta mientras se escucha el discurso simultáneamente. Esto lo deja atrás de GPT-Live, que OpenAI presentó recientemente y está construido sobre una arquitectura full-duplex. Porque GPT-Live puede responder simultáneamente mientras escucha el discurso del usuario.
Además del inglés, el modo de voz de Claude también admite idiomas como francés, alemán, hindi, indonesio, italiano, japonés, coreano, portugués y español. Sin embargo, los usuarios deben elegir el idioma que hablarán en la configuración o pedirle a Claude que cambie el idioma durante la llamada.
El nuevo modo de voz está disponible para todos los usuarios en versión beta en aplicaciones web, de escritorio, iOS y Android. Sin embargo, los usuarios gratuitos sólo podrán utilizar el modelo Haiku en llamadas de voz y podrán conectar un máximo de una aplicación a Claude. Los suscriptores pagos podrán beneficiarse de los modelos y aplicaciones más conectadas que permiten sus planes.
Fuente de la imagen: El borde
