
GPT-Live inaugura una nueva etapa para ChatGPT Voice: un modelo de voz capaz de escuchar y hablar al mismo tiempo, mantener una conversación más natural, delegar tareas complejas a modelos…
GPT-Live inaugura una nueva etapa para ChatGPT Voice: un modelo de voz capaz de escuchar y hablar al mismo tiempo, mantener una conversación más natural, delegar tareas complejas a modelos…
El nombramiento de Alex Holt como Field CTO confirma el giro estratégico de ElevenLabs: la compañía ya no quiere ser solo una referencia en generación de voz sintética, sino el…
Music v2 no es solo una mejora técnica de ElevenLabs: es una señal de que la música generada por IA entra en la fase industrial, con canciones completas, control por…
Google no solo mejora la naturalidad de la voz sintética: con Gemini 3.1 Flash TTS convierte el tono, el ritmo, los acentos y la intención en variables controlables desde el…
ByteDance ha cruzado una línea: generar clips con calidad “de pipeline” —con imagen y sonido a la vez— y forzar a los estudios a decidir si litigarán, licenciarán… o quedarán…
Gemini lanza Storybook, una función que convierte cualquier idea en un cuento ilustrado de diez páginas. Texto, imágenes y narración al instante. Lo que antes se escribía a mano ahora…
El nuevo sistema de síntesis de voz de ElevenLabs incorpora emociones, soporte multilingüe y la capacidad de generar diálogos Con el lanzamiento del modelo Eleven v3, la empresa estadounidense ElevenLabs…
Amazon está experimentando con resúmenes de productos en formato de audio, generados por inteligencia artificial, para agilizar la experiencia de compra online. A continuación, desglosamos cómo funciona esta prueba y…
Gemini da sus primeros pasos en el nicho de voz En un nuevo hito en el campo de la inteligencia artificial, Google ha presentado Gemini 2.0, una versión actualizada de…







