SAN FRANCISCO, 10 de julio de 2026. OpenAI informó una actualización del modelo que usa ChatGPT para dictado y aseguró que el error de transcripción bajó al menos 10 por ciento en los principales idiomas de sus evaluaciones. El cambio se distribuye detrás de la función existente, por lo que la interfaz no se modifica.

La empresa señaló mejoras en japonés, coreano, chino, urdu, vietnamita, inglés con acentos y español, francés, italiano y portugués en dictados extensos. También indicó un desempeño más estable en espacios ruidosos, en voz baja y en frases que mezclan letras y números. La tasa de error de palabra cuenta sustituciones, omisiones e inserciones frente a una transcripción de referencia.

Un diez por ciento menos de error no equivale a diez puntos porcentuales menos. Si un sistema parte de una tasa de 10 por ciento, una reducción relativa de 10 por ciento la llevaría a 9 por ciento. OpenAI no publicó valores absolutos por idioma, tamaño de muestra ni las grabaciones usadas. Esos datos son necesarios para comparar el resultado con otros sistemas.

En voz, el resultado útil depende tanto del micrófono y del entorno como del modelo.

El reconocimiento automático de voz convierte audio en texto antes de que el asistente responda. Un error temprano puede alterar un nombre, una cifra o una instrucción. Queda por medir cómo rinde el cambio en acentos locales, terminología profesional y audio de baja calidad.