El 23 de julio de 2026, Anthropic anunció la actualización más importante del modo de voz de Claude desde que se lanzó. Hasta ese día, toda conversación hablada con Claude, sin importar el plan ni la tarea, se procesaba con Claude Haiku, el modelo más pequeño y rápido de la familia. A partir de esa fecha, los usuarios de pago pueden elegir Claude Opus o Claude Sonnet para hablar con el asistente, y el modo de voz se conecta con Gmail, Google Calendar, Slack, Canva y Notion.
El cambio no es solo una mejora técnica interesante para quien sigue de cerca a Anthropic. Es relevante para marketing de forma muy concreta: tres de los cinco conectores habilitados son herramientas que un equipo de contenido, diseño o growth usa todos los días. Este artículo explica qué cambió exactamente, por qué Anthropic lo hizo, qué significa en la práctica para un flujo de trabajo de marketing, y qué comparar frente a la alternativa de OpenAI antes de decidir si vale la pena incorporarlo a la operación diaria.
¿Qué cambió exactamente el 23 de julio de 2026?
Hasta esa fecha, el modo de voz de Claude corría siempre sobre Claude Haiku, priorizando la velocidad de respuesta sobre la profundidad de razonamiento. Esa decisión de diseño tenía sentido en el lanzamiento original del modo de voz: una conversación hablada se rompe si hay demasiada latencia entre pregunta y respuesta, y Haiku es el modelo más rápido de la familia Claude. A partir del 23 de julio, los usuarios de pago pueden elegir Claude Opus o Claude Sonnet para sus conversaciones habladas, y el modo de voz usa por defecto el mismo modelo que el usuario ya tenga seleccionado en el chat de texto, con posibilidad de cambiarlo durante la conversación a través del selector.
En paralelo, la actualización extendió los conectores de aplicaciones al modo de voz. Con los permisos correspondientes activados, Claude puede acceder durante una conversación hablada a Gmail, Google Calendar, Slack, Canva y Notion. Antes de este cambio, esos conectores existían para el chat de texto, pero no estaban disponibles cuando la interacción era hablada.
Los conectores habilitados en voz
- Gmail
- Google Calendar
- Slack
- Canva
- Notion
¿Por qué Anthropic cambió de Haiku a modelos más grandes en voz?
Según la cobertura del lanzamiento, el problema que Anthropic identificó fue que los usuarios ya estaban usando el modo de voz para tareas que excedían lo que Haiku fue diseñado a resolver: analizar documentos, planificar proyectos, trabajar sobre problemas de negocio reales. Haiku respondía, pero con las limitaciones esperables de un modelo optimizado para velocidad, no para razonamiento profundo o multi-paso.
La lógica de fondo es que el modo de voz dejó de ser, en la práctica, un canal para preguntas casuales y pasó a ser un canal de trabajo. Cuando eso ocurre, la inteligencia del modelo pesa más que los milisegundos de latencia adicionales que puede introducir un modelo más grande. Esa misma conclusión ya se había validado meses antes: Claude Code incorporó su propio modo de voz en marzo de 2026 para programar hablando, y esa experiencia confirmó internamente que, para tareas complejas, el usuario prefiere esperar un poco más a cambio de una respuesta que realmente resuelva el problema.
Esta sección se sostiene por sí sola: si alguien pregunta por qué Claude dejó de usar solo Haiku en su modo de voz, la respuesta corta es que los usuarios ya estaban forzando el modo de voz a hacer trabajo complejo, y Anthropic decidió llevar la capacidad del modelo al nivel de esa demanda real, en lugar de mantener la prioridad original de velocidad a toda costa.

¿Qué cambia en términos prácticos para un equipo de marketing?
Tres de los cinco conectores habilitados, Canva, Gmail y Slack, son herramientas de uso diario en marketing, lo que convierte esta actualización en algo más que una curiosidad técnica.
Flujos de trabajo manos libres que habilita
- Pedir un diseño en Canva por voz mientras se resuelve otra tarea, sin abrir la herramienta manualmente.
- Resumir en voz alta un hilo largo de Slack del equipo de contenido antes de entrar a una reunión.
- Revisar el calendario y reorganizar entregas de campaña hablando con Claude, en lugar de navegar la agenda manualmente.
- Redactar un borrador de email de campaña sobre la marcha, describiendo verbalmente el objetivo y dejando que Claude prepare el texto directamente en Gmail para revisión posterior.
El valor real de estos flujos aparece en los momentos en que el teclado no es una opción cómoda: mientras se conduce entre reuniones, se camina hacia una oficina, o simplemente se quiere avanzar trabajo operativo sin sentarse frente a una pantalla. No reemplaza el trabajo de fondo de crear una campaña, pero sí reduce la fricción de las tareas de coordinación que normalmente consumen tiempo entre una tarea creativa y otra.
Los límites que conviene tener claros
Es importante no sobrevender el alcance de esto. Usar varias herramientas simultáneamente en modo de voz puede añadir un breve retraso adicional a la respuesta, y las reglas de acceso son idénticas a las del modo de texto: Claude solo llega a lo que el usuario haya autorizado explícitamente, conector por conector. No hay ninguna capacidad nueva mágica; lo que cambia es el canal de entrada, de texto a voz, sobre capacidades que en gran parte ya existían.
¿Qué diferencia hay entre el plan gratuito y los planes de pago?
La actualización no llega igual para todos los niveles de suscripción, y esto tiene una implicación directa para cualquier equipo que esté evaluando si vale la pena pagar un plan superior solo por esta función.
Los usuarios del plan gratuito mantienen el modo de voz sobre Claude Haiku y pueden conectar una sola aplicación externa a la vez a sus conversaciones habladas. Los usuarios de planes de pago, Pro, Max, Team o Enterprise, desbloquean el uso de Claude Opus o Claude Sonnet en voz, pueden conectar múltiples aplicaciones de forma simultánea, y pueden cambiar de modelo durante la misma conversación usando el selector. El número de idiomas soportados, en cambio, es igual para todos los niveles: diez idiomas, sin distinción entre plan gratuito y de pago.
Para un equipo de marketing que evalúa este cambio como argumento para actualizar de plan, la pregunta relevante no es solo si hay acceso a un modelo más grande, sino si el flujo de trabajo depende de usar más de una app conectada al mismo tiempo. Si la respuesta es sí, por ejemplo revisar Slack y al mismo tiempo generar algo en Canva dentro de la misma sesión de voz, el plan gratuito no alcanza para ese caso de uso, independientemente del modelo disponible.
¿Cómo se compara Claude en voz con GPT-Live de OpenAI?
La comparación con la competencia es inevitable porque OpenAI lanzó su propio modo de voz, GPT-Live, apenas dos semanas antes, el 8 de julio de 2026. La diferencia entre ambos productos no es solo de catálogo de funciones, es una diferencia de arquitectura que conviene entender antes de elegir cuál usar en un flujo de trabajo real.
Full-duplex vs. turn-based
GPT-Live utiliza una arquitectura full-duplex: el sistema escucha y habla al mismo tiempo, procesando voz de entrada y generando voz de salida de forma simultánea. Esto permite interrupciones y solapamientos naturales, similares a como fluye una conversación humana real, donde una persona puede interrumpir a otra a mitad de frase sin que la conversación se corte.
Claude mantiene, en cambio, un esquema turn-based: escucha, procesa, responde, sin superposición entre esas fases. En la práctica, hablar con Claude se parece más a una llamada telefónica formal que a una conversación en persona; no se puede interrumpir a mitad de respuesta sin cortar la sesión.
Qué arquitectura conviene según la tarea de marketing
Si la prioridad es que la interacción se sienta natural y fluida, por ejemplo hacer brainstorming rápido de ideas de campaña en voz alta con idas y vueltas constantes, la arquitectura de GPT-Live está mejor pensada para ese caso de uso. Si la prioridad es que el asistente entienda correctamente un problema con múltiples variables, coordinar el estado de una campaña cruzando Slack, Calendar y Canva, o redactar un email delicado que requiere contexto acumulado, la apuesta de Claude por modelos más grandes en voz puede rendir mejor, incluso si la interacción en sí se siente menos fluida.
Ninguna de las dos arquitecturas es objetivamente superior en abstracto; son dos apuestas de producto distintas resolviendo prioridades distintas, y la elección correcta depende del tipo de tarea de marketing que se quiera resolver por voz, no de cuál herramienta es mejor en general.

¿En qué idiomas funciona el modo de voz de Claude?
El modo de voz de Claude funciona en diez idiomas: inglés, francés, alemán, hindi, indonesio, italiano, japonés, coreano, portugués y español. Un detalle operativo que conviene tener presente es que el cambio de idioma dentro de una misma conversación no es automático. Si se necesita cambiar de idioma a mitad de sesión, hay que indicarlo verbalmente o seleccionarlo en el menú de configuración antes de iniciar la conversación. Esto es relevante para equipos de marketing multilingües o agencias que atienden mercados en distintos idiomas desde una misma cuenta.
¿Qué debería revisar un equipo de marketing antes de adoptar esto en su flujo diario?
Antes de incorporar el modo de voz de Claude como parte de un proceso de trabajo real, conviene revisar tres cosas concretas.
1. Los conectores realmente autorizados
Qué conectores tiene el equipo activados de verdad, Gmail, Slack, Canva, Calendar, Notion, y si esos permisos están alineados con lo que cada persona debería o no poder tocar por voz, especialmente en cuentas compartidas de agencia.
2. El plan de cada miembro del equipo
Qué plan tiene cada persona, porque la diferencia entre Haiku y Opus o Sonnet en voz, y entre una sola app conectada o varias simultáneas, puede hacer que la misma función se sienta completamente distinta según quién la use.
3. Las tareas donde voz realmente aporta
Para qué tareas específicas tiene sentido usar voz en lugar de texto. No todo flujo de marketing se beneficia de pasar a un canal hablado, y forzar la adopción en tareas donde el teclado ya es más rápido no genera ninguna ganancia real de productividad.
Preguntas frecuentes
¿Cuándo se lanzó la actualización de voz de Claude?
Anthropic la anunció el 23 de julio de 2026, como la actualización más importante del modo de voz de Claude desde su lanzamiento original.
¿Qué modelos se pueden usar ahora en modo de voz?
Claude Haiku para el plan gratuito, y Claude Opus o Claude Sonnet, a elección, para los planes de pago: Pro, Max, Team y Enterprise.
¿Qué aplicaciones se pueden conectar al modo de voz?
Gmail, Google Calendar, Slack, Canva y Notion, siempre que el usuario haya otorgado los permisos correspondientes a cada conector.
¿Cuántas apps se pueden usar al mismo tiempo en una conversación de voz?
Los usuarios del plan gratuito pueden conectar una sola aplicación a la vez. Los usuarios de planes de pago pueden conectar varias aplicaciones de forma simultánea dentro de la misma conversación.
¿Claude en voz es full-duplex, como GPT-Live de OpenAI?
No. Claude usa un esquema turn-based, por turnos: escucha, procesa y luego responde. GPT-Live, lanzado por OpenAI el 8 de julio de 2026, usa arquitectura full-duplex, procesando voz de entrada y salida de forma simultánea y permitiendo interrupciones naturales.
¿Cuántos idiomas soporta el modo de voz de Claude?
Diez idiomas: inglés, francés, alemán, hindi, indonesio, italiano, japonés, coreano, portugués y español, con la misma disponibilidad para todos los planes.
¿El cambio de idioma dentro de una conversación es automático?
No. Hay que indicarlo verbalmente durante la sesión o seleccionarlo en el menú de configuración antes de empezar a hablar con Claude.
¿Realmente sirve esto para trabajo de marketing, o es solo una demo llamativa?
El caso de uso más claro y concreto es operar Canva, Gmail y Slack sin usar el teclado: generar una pieza de diseño, resumir un hilo de conversación o coordinar una entrega de campaña mientras se hace otra cosa. No reemplaza el trabajo creativo de fondo, pero sí reduce la fricción de las tareas de coordinación que rodean a ese trabajo.
Última actualización: julio de 2026. La cobertura de este lanzamiento se basa en el anuncio de Anthropic del 23 de julio de 2026 y en reportes publicados los días siguientes, incluyendo The Verge. Anthropic actualiza sus productos con frecuencia; conviene verificar el estado actual de planes, modelos y conectores directamente en claude.com antes de tomar decisiones de adopción para un equipo.







