Apps y consumo
Speechify lanza una aplicación nativa para Windows para procesamiento de voz local
Speechify lanzó una aplicación nativa para Windows que incluye dictado y texto a voz en el dispositivo, dirigida al mercado empresarial entre los más de mil millones de usuarios de la plataforma.
La empresa de IA de voz Speechify lanzó una aplicación nativa para Windows que realiza el procesamiento de voz completamente en el dispositivo. El procesamiento local está diseñado para las Copilot+ PCs —que cuentan con Unidades de Procesamiento Neuronal (NPU, procesadores diseñados específicamente para acelerar tareas de aprendizaje automático) de AMD, Intel y Qualcomm— así como para otras computadoras personales con Windows 11 equipadas con Unidades de Procesamiento Gráfico (GPU, procesadores diseñados para manipular y alterar rápidamente la memoria para acelerar el procesamiento paralelo) de Intel y AMD.
La aplicación ejecuta tres modelos localmente en el hardware del usuario: texto a voz neuronal, detección de actividad de voz en tiempo real y transcripción impulsada por Whisper. Los usuarios pueden configurar la aplicación para cambiar a modelos basados en la nube o modificarlos durante su uso. Para la detección de actividad de voz, Speechify utiliza el modelo de código abierto Silero. Para la generación de audio, la empresa utiliza su modelo SIMBA, que genera audio en siete ajustes de velocidad diferentes para leer documentos, artículos, archivos PDF o páginas web en voz alta. Con estas funciones, Speechify está posicionada para competir con aplicaciones especializadas de dictado y transcripción como Wispr Flow, Willow y Superwhisper.
Speechify, que cuenta con más de 50 millones de usuarios, busca ampliar su alcance. “Más de mil millones de personas en este planeta usan Windows. Con este lanzamiento para Windows, nos aseguramos de que la lectura, y ahora la escritura, nunca sea una barrera, sin importar qué dispositivo utilicen o cómo prefieran trabajar. Estamos especialmente entusiasmados con la oportunidad en el sector empresarial, dado cuántos profesionales han pedido Speechify en sus computadoras”, dijo Cliff Weitzman, fundador y CEO de Speechify.
El mes pasado, en febrero de 2026, la empresa lanzó una función de transcripción de reuniones, aunque estaba limitada a reuniones basadas en navegador. Ahora que Speechify tiene aplicaciones en múltiples plataformas, es probable que la empresa lleve esta función de transcripción de reuniones a sus aplicaciones nativas para transcribir reuniones en cualquier aplicación o navegador. Esta expansión representa un cambio para Speechify, que anteriormente se concentraba en casos de uso de texto a voz, como la lectura de artículos y correos electrónicos, antes de avanzar hacia una aplicación de voz full-stack.
Por qué importa
Speechify está expandiendo su suite de productos de texto a voz hacia una aplicación de voz full-stack, que incluye dictado y transcripción de reuniones. Al aprovechar las capacidades del hardware local en Windows, la empresa se posiciona para competir directamente con herramientas especializadas de inteligencia artificial de voz.