
Meta acaba de presentar Muse Voice Transcribe, un nuevo modelo de inteligencia artificial diseñado para ofrecer transcripción de voz en tiempo real. La tecnología llega como una de las nuevas apuestas de Meta en el procesamiento de audio y ya está integrada en algunas de sus herramientas para Mac.
El nuevo sistema busca hacer que el dictado sea más rápido y natural, con soporte para múltiples idiomas, identificación de diferentes interlocutores y una capacidad especial para determinar cuándo una persona ha terminado de hablar. Además, los desarrolladores pueden acceder a Muse Voice Transcribe mediante la API de Meta Model.
Índice
Muse Voice Transcribe lleva el dictado en tiempo real a Mac
Una de las principales características de Muse Voice Transcribe es que puede convertir la voz en texto mientras una persona está hablando, sin depender de un procesamiento posterior para completar la transcripción.
El modelo también puede distinguir entre diferentes personas durante una grabación. Meta asegura que es capaz de separar a los interlocutores incluso en archivos de audio con más de 20 voces, algo que puede resultar especialmente útil para reuniones, entrevistas, conversaciones y otros escenarios en los que participan varias personas.
Una IA capaz de adaptarse a la conversación
Meta ha desarrollado Muse Voice Transcribe con una característica denominada “retraso adaptativo”. En lugar de utilizar siempre el mismo equilibrio entre velocidad y precisión, el modelo determina cuánto contexto necesita escuchar antes de convertir cada palabra en texto.
Esto permite que el sistema responda rápidamente cuando el audio es sencillo, mientras que puede tomarse más tiempo cuando encuentra palabras o fragmentos que requieren un mayor contexto para ser interpretados correctamente. El objetivo es conseguir una transcripción rápida sin sacrificar precisión.

Soporte para más de 70 idiomas
El modelo fue entrenado con datos de más de 70 idiomas, aunque Meta señala que 25 de ellos fueron validados al momento de su lanzamiento. También es capaz de trabajar con archivos de audio de más de una hora de duración.
Otra característica interesante es su capacidad para manejar cambios de idioma dentro de una misma conversación. Esto permite que una persona pueda alternar entre diferentes idiomas dentro de una frase o entre oraciones sin que el sistema tenga que detener el proceso de transcripción.
Meta también explica que factores como el idioma, las palabras clave y el contexto pueden utilizarse para mejorar todavía más la calidad del reconocimiento.
Meta AI para Mac también incorpora la nueva tecnología
Muse Voice Transcribe no se limita a estar disponible para desarrolladores. La tecnología ya está integrada en la función de dictado de Meta AI para Mac y también forma parte de Muse Code.
En el ordenador de Apple, los usuarios pueden mantener presionada la tecla Fn para comenzar a dictar directamente dentro de cualquier aplicación compatible. Esto convierte la nueva tecnología en una herramienta que puede utilizarse para escribir mensajes, documentos, notas o cualquier otro contenido mediante la voz.
¿Cuánto cuesta utilizar Muse Voice Transcribe?
Meta también ha anunciado un precio para quienes quieran utilizar Muse Voice Transcribe mediante su API. El modelo está disponible por 3 dólares por cada 1.000 minutos de audio procesado, una tarifa que equivale aproximadamente a 0,18 dólares por hora.
Este precio coloca a Muse Voice Transcribe como una alternativa que puede resultar atractiva para desarrolladores que quieran incorporar transcripción de voz en tiempo real a sus propias aplicaciones y servicios sin tener que desarrollar desde cero toda la tecnología necesaria para procesar audio.
Meta continúa avanzando en inteligencia artificial
El lanzamiento de Muse Voice Transcribe muestra que la estrategia de Meta en inteligencia artificial no se limita a los modelos de lenguaje o a los asistentes conversacionales. La compañía también está trabajando en sistemas especializados capaces de comprender y procesar diferentes tipos de información en tiempo real.
Para los usuarios de Mac, la integración del modelo directamente en herramientas como Meta AI y Muse Code podría hacer que el dictado sea una alternativa mucho más práctica para introducir texto. Para los desarrolladores, la disponibilidad mediante API abre la puerta a nuevas aplicaciones centradas en voz y transcripción.
¿Crees que este tipo de inteligencia artificial puede hacer que el dictado por voz se convierta en una alternativa real al teclado en Mac? Cuéntanos tu opinión en los comentarios.










