TL;DR
- Desde el 23 de septiembre, en ChatGPT puedes encargarle por voz un trabajo de varios pasos dentro de Work, su espacio para tareas largas, y si cuelgas antes de que termine, sigue por escrito.
- Ese mismo día Google abrió la réplica de voz: con un audio tuyo de hasta 30 segundos y una frase de consentimiento grabada por ti, crea una voz sintética con tu timbre, marcada como hecha con IA.
- Y un detalle de los PDF: Claude lee el texto y también las imágenes de cada página, y eso pesa; ChatGPT, fuera de las cuentas Enterprise, saca solo el texto, y un escaneo puede llegarle casi vacío.
- Más abajo hay dos textos para copiar: la frase para dictarle una tarea a ChatGPT sin que te conteste a mitad de la idea, y el que lees para grabar tu voz en una sola toma.
Hay ratos del día en que se piensa bien y no se puede escribir: caminando entre dos citas, esperando antes de una reunión. Lo que se te ocurría ahí se perdía.
Lo que cambió el 23 es que ese rato ya puede producir un borrador.
ChatGPT: encárgale el trabajo hablando, y sigue cuando cuelgas
Qué cambió. El 23 de septiembre OpenAI publicó en sus notas de versión que la voz de ChatGPT ahora usa las aplicaciones conectadas a tu cuenta, y que funciona dentro de Work, el espacio de ChatGPT para tareas de varios pasos: armar un documento, una presentación o una hoja de cálculo, usar tus apps conectadas o trabajar en el navegador. La ayuda oficial lo dice así: si una tarea sigue corriendo cuando terminas la llamada, "puede continuar por escrito".
Un límite que publica la misma ayuda: las acciones que necesitan tu aprobación se aprueban o se rechazan con los controles de la pantalla, porque "no se admite la aprobación hablada".
Quién lo tiene. Work está en los planes de pago que lo incluyen, en la web y en el teléfono. Si no ves Work en el menú, tu plan no lo incluye o, en una cuenta de empresa, el administrador no lo activó.
Dónde se hace clic. La ruta la da OpenAI en su ayuda: abre ChatGPT, elige Work y toca el control de voz para empezar. En el teléfono, Work se elige en el menú desplegable de arriba de la pantalla.
Si vas a manejar, déjalo abierto antes de arrancar. OpenAI pide no tocar el teléfono con el carro en movimiento, y no documenta Work en CarPlay. Las aprobaciones, déjalas para cuando el carro esté detenido.
⚠ Estos pasos salen de la ayuda de OpenAI, no de una prueba nuestra. Nadie de la casa ha dictado todavía una tarea dentro de Work. El orden de abajo lo pusimos nosotros.
Cómo dictarle una tarea
- Di el resultado antes que el tema. "Quiero un correo listo para enviar" funciona mejor que "hablemos del cliente de ayer".
- Di con qué trabaja. Si tiene que sacar algo de tu correo o tu calendario, nómbralo: esa app tiene que estar conectada.
- Di qué no puede hacer sin ti. Enviar, borrar, agendar.
- Cuelga y sigue con tu día. Si la tarea no terminó, la encuentras por escrito en la misma conversación.
La frase para dictar
Lo que va entre corchetes es tuyo. El resto se dice igual cada vez:
"No me contestes hasta que te diga 'listo'. Necesito [un correo, un resumen, una propuesta de una página] para [quién]. Usa [lo que tiene que revisar: el último correo de esta persona, mi calendario de mañana]. Lo que tiene que quedar claro es [la decisión o el dato que importa]. Nada de enviar ni agendar: lo quiero por escrito. Listo."
Cuando uno piensa en voz alta hace pausas, y la voz de ChatGPT puede tomar cualquier pausa como su turno y arrancar con la mitad del encargo. OpenAI sugiere justo esto: pedirle al empezar que espere hasta que le digas que conteste.
Google: una voz sintética con tu timbre, si lo autorizas grabándolo
Qué cambió. El 23 de septiembre Google presentó Gemini 3.8 Flash TTS y con él la réplica de voz. La documentación pide un audio de referencia de 10 a 30 segundos y que la misma persona adulta lea una frase de consentimiento fija, disponible en 30 variantes de idioma, entre ellas el español de Estados Unidos. El sistema compara las dos grabaciones antes de crear la voz. Todo audio lleva la marca de agua SynthID de Google y credenciales de origen C2PA, un registro que viaja con el archivo y dice cómo se hizo.
Dónde se hace clic. En Google AI Studio, en la página de generar voz: aistudio.google.com/generate-speech. Según la documentación de Google, ahí se graban o se suben en el navegador los dos audios. No pudimos ver el menú por dentro, así que no te damos nombres de botones que no vimos.
Dónde no está. La réplica en AI Studio no está disponible en Illinois, Texas, el Espacio Económico Europeo, Reino Unido, Suiza ni India. Desde Florida, sí.
Para qué sí, en un negocio de servicios
Para narrar lo que ya escribiste: la versión en audio de tu artículo, la voz de un video corto, la explicación de un servicio que hoy regrabas cada vez que cambia una línea. Cambias el texto y la voz sale de nuevo.
El texto para grabar tu voz en una sola toma
Entre veinte y veinticinco segundos leídos con calma, en el tono en que le hablas a un cliente, en un cuarto sin eco:
"Buenos días. Te explico en pocas palabras cómo trabajamos. Primero escuchamos qué necesitas y qué ya intentaste. Después te decimos con claridad qué podemos hacer, cuánto tarda y cuánto cuesta. Y si no somos la mejor opción para ti, también te lo decimos. Preferimos perder una venta a ganar un cliente que no vamos a poder atender bien."
Otras cuatro que vale la pena mirar
Entramos a la página de cada una el 28 de septiembre. Aquí no hay enlaces pagados.
- SaneBox - aparta de tu bandeja lo que no es importante, en cualquier correo que ya uses. Prueba gratis de siete días, sin tarjeta.
- Schole - arma lecciones cortas de IA según el puesto de cada persona de tu equipo. Tiene opción gratis para empezar.
- Naise - arma campañas de redes, influencers y prensa a partir de un solo encargo escrito. Prueba de tres días, con tarjeta.
- Gemini Notebook - lo que antes se llamaba NotebookLM: le subes tus propios documentos y le preguntas sobre ellos. Tiene plan gratis.
Tres cosas que no vienen en el anuncio
El mismo PDF no le llega igual a dos asistentes. Según la ayuda de Anthropic, en un chat Claude lee el texto y también las imágenes de cada PDF de hasta 100 páginas. Su documentación técnica explica cómo: convierte cada página en una imagen, y cada página gasta entre 1.500 y 3.000 unidades de texto más lo que cuesta esa imagen. ChatGPT hace lo contrario: según su ayuda, en todos los planes salvo Enterprise saca solo el texto del PDF y descarta las imágenes, y avisa que con un escaneo puede no sacar bien los datos.
Es el mismo criterio que usamos al montar nuestro sistema visual en Claude Design: ahí el PDF sirve justamente porque se ve como tu marca.
Si alguien te ayuda con la computadora, pídele MarkItDown una vez. Es una herramienta gratuita y de código abierto de Microsoft que convierte PDF, Word, Excel y PowerPoint en texto limpio. Se usa desde la línea de comandos, así que no es para ti: es para que esa persona te deje en texto los cinco documentos que más usas.
La voz no aprueba. Es una protección: en ChatGPT nada que requiera aprobación sale por una frase dicha en voz alta. Y la misma ayuda admite que la voz a veces le contesta a gente que conversa al lado, no a ti.
Qué hacen mal
Voz dentro de Work descuenta de dos lados a la vez: de tu límite de voz, que en Go y en Plus son tres horas por cada 24, y de tu uso de Work, igual que si escribieras. Súmalo a la cuenta de lo que la IA ya te cobra cada mes: aquí no llega un recibo nuevo, se gasta más rápido lo que ya pagas. Y solo ve lo que tengas conectado: si tu correo de trabajo no lo está, la tarea no lo puede leer.
La réplica de voz depende de la grabación que le des: si esa sale mal, la voz sale mal. Y la documentación no dice que una voz grabada en español hable bien en inglés, así que no lo prometemos. Y AI Studio está pensado para quien construye con Gemini: funciona en el navegador, pero no es una app sencilla.
Quién debería saltárselo
Si nunca le has pedido a ChatGPT algo más largo que una respuesta, empieza por la voz en el chat normal. Si tu negocio no publica audio ni video, deja la réplica de voz para más adelante.
Dónde encaja en tu negocio
En una clínica o un despacho, lo que queda pendiente al final del día casi nunca es difícil: es escribir lo que ya se decidió, como el correo de seguimiento o el resumen para el cliente. Si lo dictas entre dos citas, cuando llegas a la oficina ya está en borrador.
Antes de subir un PDF con datos de un cliente, acuérdate de que apagar ese botón no borra lo que ya escribiste.
Lo único que hay que hacer hoy
Sigue leyendo
- Meta le puso precio a la IA que ya estabas usando - las herramientas del martes pasado
- Apagar ese botón no borra lo que ya escribiste - qué datos de clientes no se le dan a una IA
- La función que te hace falta no está donde la buscas - cómo montar tu sistema visual en Claude Design
- SEO vs. GEO vs. AEO: cuál necesita tu negocio en 2026 - el mapa completo
- Voz en ChatGPT, ayuda oficial de OpenAI - la fuente, en inglés
Para cerrar
Lo de la voz está atado a tu plan y al lugar donde vives. El documento en texto no depende de nada: no pide plan de pago ni aplicación nueva, así que empieza por ahí.
Fuentes
- ChatGPT release notes, OpenAI, 23 de septiembre de 2026 - https://help.openai.com/en/articles/6825453-chatgpt-release-notes
- ChatGPT Voice, ayuda de OpenAI, consultada el 28 de septiembre de 2026 - https://help.openai.com/en/articles/20001274-chatgpt-voice
- ChatGPT Work and Codex, ayuda de OpenAI, consultada el 28 de septiembre de 2026 - https://help.openai.com/en/articles/20001275-chatgpt-work-and-codex
- Gemini 3.8 Flash TTS, Google, 23 de septiembre de 2026 - https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-3-8-text-to-speech/
- Voice replication, documentación de Gemini API, Google, consultada el 28 de septiembre de 2026 - https://ai.google.dev/gemini-api/docs/voice-replication
- Upload files to Claude, ayuda de Anthropic, consultada el 28 de septiembre de 2026 - https://support.claude.com/en/articles/8241126-upload-files-to-claude
- PDF support, documentación de Claude, Anthropic, consultada el 28 de septiembre de 2026 - https://platform.claude.com/docs/en/build-with-claude/pdf-support
- MarkItDown, Microsoft, consultada el 28 de septiembre de 2026 - https://github.com/microsoft/markitdown





