Todos los modelos
Meta

Muse Voice Transcribe

Modelo de reconocimiento de voz en streaming de Meta para subtítulos en vivo, audio largo, muchos parlantes, cambio de código y transcripción con reconocimiento de dominio.

Descripción general en inglés sencillo

Qué es realmente Muse Voice Transcribe

Muse Voice Transcribe está diseñado para voz que llega continuamente y no solo como una carga finalizada. Puede procesar pequeños fragmentos de audio, decidir cuándo ha terminado una expresión, etiquetar a muchos hablantes y utilizar sugerencias de lenguaje, palabras clave y contexto para mejorar los nombres o el vocabulario especializado.

Meta anuncia una amplia formación multilingüe al tiempo que identifica un conjunto más pequeño de idiomas específicamente verificados. Esa distinción es útil para las adquisiciones: pruebe los acentos exactos, los patrones de cambio de código, el ruido y la superposición de los hablantes en sus propias llamadas antes de tratar el conjunto de capacitación más amplio como cobertura de producción.

Buen ajuste para

  • Subtítulos en vivo e interfaces conversacionales
  • Reuniones de varios ponentes y grabaciones largas
  • Productos que necesitan palabras clave o sesgo de contexto

Comparación de categorías

Los hechos que importan para los modelos transcripción

Estas son especificaciones publicadas por el proveedor, no puntuaciones de referencia Cody. Siga las fuentes vinculadas para conocer los límites actuales y las excepciones específicas de los terminales.

Precio de transcripción
$0.18 / hora de audioPrecio actual del proveedor por hora o minuto de audio para la ruta de procesamiento indicada.
En vivo o por lotes
Transmisión en tiempo real y audio de formato largoSi el modelo maneja transmisiones en tiempo real, grabaciones cargadas o ambas.
Idiomas
Capacitado en más de 70 idiomas; 25 específicamente verificadosCobertura de idiomas publicada por el proveedor, separando la cobertura capacitada o anunciada de los idiomas específicamente verificados cuando sea necesario.
Etiquetas de altavoz
Sí; Más de 20 ponentes anunciados.Si el modelo identifica quién habló y el límite de oradores publicado.
Marcas de tiempo
Temporización y localización de transcripciones de streamingInformación de sincronización disponible a nivel de palabra, segmento o enunciado.
control de vocabulario
Sesgo de lenguaje, palabras clave y contexto; cambio de códigoMejora de palabras clave, ortografía personalizada, contexto, indicaciones u otras formas de mejorar los términos del dominio.
donde usarlo
Meta Model API, Meta AI para Mac, código MuseAPI directa, catálogo en la nube, aplicación o punto final regional documentado por el proveedor.

Precios y comparaciones

Calcula tu coste

Indica tu uso. La estimación se actualiza al escribir.

Usa la duración en horas: 30 minutos = 0,5 horas. Funciones extra y cargos mínimos pueden cambiar el total.

Muse Voice Transcribe

Meta

Total estimado (USD)

Sin tarifa revisada

Para el uso indicado · USD · Precio de API, no de suscripción

Cómo funciona esta estimación

Las estimaciones excluyen impuestos, herramientas, almacenamiento/escritura de caché, cuotas gratuitas y descuentos personalizados. En imágenes solo incluyen la salida, no el prompt ni las referencias. Los modos de calidad varían. Los ajustes no listados no se consideran gratuitos.

Acceso a API y proveedores

Dónde conseguir Muse Voice Transcribe

Disponibilidad

Regiones y etapa de acceso

Disponible a través de Meta Model API, Meta AI para Mac y Muse Code durante la vista previa pública de Model API.

Meta no enumera una lista de países o regiones de procesamiento específicos del modelo en la página de lanzamiento pública; Utilice los términos actuales de la cuenta de desarrollador.

Consultar disponibilidad en vivo

Datos y entrenamiento

La ruta importa.

La página de lanzamiento de Meta describe la privacidad de su demostración pública, no una retención completa de la API del modelo ni un compromiso de uso de capacitación. Revise los términos actuales de Model API y los controles empresariales antes de enviar audio confidencial.

Esta es una lectura concisa del material del proveedor citado, no un asesoramiento legal. Una puerta de enlace de terceros puede tener términos de almacenamiento, enrutamiento, capacitación y residencia diferentes a los de la API directa del fabricante del modelo.

Lea la política del proveedor.

Preguntas frecuentes

Preguntas frecuentes sobre Muse Voice Transcribe

¿Qué es Muse Voice Transcribe?

Modelo de reconocimiento de voz en streaming de Meta para subtítulos en vivo, audio largo, muchos parlantes, cambio de código y transcripción con reconocimiento de dominio. Muse Voice Transcribe está diseñado para voz que llega continuamente y no solo como una carga finalizada. Puede procesar pequeños fragmentos de audio, decidir cuándo ha terminado una expresión, etiquetar a muchos hablantes y utilizar sugerencias de lenguaje, palabras clave y contexto para mejorar los nombres o el vocabulario especializado.

¿Cuándo se lanzó Muse Voice Transcribe?

Muse Voice Transcribe se lanzó en 1 de septiembre de 2026 según los materiales del proveedor citados.

¿Dónde puedo acceder a Muse Voice Transcribe?

Disponible a través de Meta Model API, Meta AI para Mac y Muse Code durante la vista previa pública de Model API. Las rutas de acceso enumeradas en esta guía son Meta Model API y Meta.

¿Cuánto cuesta Muse Voice Transcribe?

$0.18 / hora de audio. Meta enumera esta tarifa de API de modelo en el catálogo revisado. Las asignaciones de productos en Meta AI para Mac o Muse Code pueden diferir.

¿Dónde está disponible Muse Voice Transcribe?

Disponible a través de Meta Model API, Meta AI para Mac y Muse Code durante la vista previa pública de Model API. Meta no enumera una lista de países o regiones de procesamiento específicos del modelo en la página de lanzamiento pública; Utilice los términos actuales de la cuenta de desarrollador.

¿Se utilizan mis datos API Muse Voice Transcribe para capacitación?

La página de lanzamiento de Meta describe la privacidad de su demostración pública, no una retención completa de la API del modelo ni un compromiso de uso de capacitación. Revise los términos actuales de Model API y los controles empresariales antes de enviar audio confidencial. La política pertenece a la ruta del proveedor y a los términos de la cuenta, así que verifíquela nuevamente antes de usarla en producción.