lunes, 3 de agosto de 2026

IA y modelos

Thinking Machines Lab presenta modelos de interacción de IA full duplex

Thinking Machines Lab, de Mira Murati, anunció modelos de interacción diseñados para conversaciones de IA simultáneas y full duplex, con una vista previa de investigación limitada prevista para los próximos meses.

Thinking Machines Lab unveils full duplex AI interaction models
Foto: Thinking Machines Lab press kit

Thinking Machines Lab, la startup de inteligencia artificial fundada por la exdirectora de tecnología de OpenAI, Mira Murati, anunció el lunes la introducción de lo que denomina “modelos de interacción”. Estos modelos están diseñados para procesar la entrada del usuario y generar respuestas simultáneamente. Este enfoque representa un cambio respecto a la estructura basada en turnos de la IA conversacional, donde un sistema debe esperar a que el usuario termine de hablar antes de comenzar a procesar una respuesta. En cambio, la startup está desarrollando un modelo que permite la interacción “full duplex”, un término técnico para un sistema que puede procesar información entrante y generar respuestas al mismo tiempo. En la práctica, esto significa que la IA puede escuchar y hablar simultáneamente, lo que permite una comunicación en tiempo real donde un usuario podría interrumpir a la máquina a mitad de una frase, de forma muy parecida a una conversación humana natural.

Según Thinking Machines Lab, su modelo, llamado TML-Interaction-Small, logra un tiempo de respuesta de aproximadamente 0.40 segundos. Esta velocidad tiene como objetivo imitar la cadencia natural de la conversación humana. Al procesar la entrada y generar la salida simultáneamente, el modelo busca evitar la latencia basada en turnos que caracteriza a los sistemas conversacionales actuales. Esta latencia es una característica estándar de los modelos existentes desarrollados por competidores en el campo, incluidos OpenAI y Google, que dependen de una arquitectura secuencial de “escuchar y luego responder”. En esos sistemas secuenciales, la interacción se siente más como un intercambio basado en texto, donde cada parte debe esperar a que la otra termine antes de hablar.

La tecnología aún se encuentra en fase de desarrollo y todavía no está disponible para el uso público general. Thinking Machines Lab ha declarado que una vista previa de investigación limitada llegará en los próximos meses, con un lanzamiento más amplio previsto para finales de este año. Este despliegue gradual permitirá a la empresa probar el rendimiento del modelo en el mundo real y determinar si sus capacidades de procesamiento simultáneo pueden ofrecer de manera consistente una experiencia conversacional natural, similar a una llamada telefónica, fuera de un entorno de investigación controlado. La empresa está posicionando la tecnología como una vista previa de investigación en lugar de un producto de consumo completamente desarrollado, lo que significa que su utilidad práctica solo se verificará una vez que los usuarios puedan interactuar con ella directamente.

Por qué importa

La industria de la inteligencia artificial está intentando hacer la transición de interacciones basadas en turnos, al estilo de cadenas de texto, a sistemas full duplex que procesan la entrada y la salida simultáneamente. De tener éxito, este cambio arquitectónico podría hacer que las interacciones de voz con la IA se sientan tan naturales y fluidas como una llamada telefónica humana estándar.