⚠ Traducción pendiente de actualización

La página canónica en inglés ya documenta el nuevo runtime MLX de 128K para audio largo, los benchmarks INT5/INT8 y el uso de memoria. Esta traducción aún describe principalmente el runtime CoreML anterior.

MOSS Transcribe Diarize 0.9B

Esta página de Soniqo documenta MOSS Transcribe Diarize 0.9B tal como está implementado en speech-swift / speech-core. Los enlaces a Hugging Face aparecen debajo de las notas de integración.

Primero página interna

Las tarjetas y menús apuntan primero aquí; los enlaces al modelo fuente y a los bundles siguen disponibles en esta página.

Resumen

ModeloMOSS Transcribe Diarize 0.9B
RolTranscripción por lotes con etiquetas de hablante y marcas de tiempo generadas por el modelo
BackendCoreML con frontend Whisper nativo basado en Accelerate
SalidaTranscripción plana y segmentos con hablante y marcas de tiempo
IdiomasModelo MOSS de transcripción multilingüe
LicenciaVerifica las condiciones del modelo fuente y de los bundles para el uso previsto
EstadoDisponible mediante speech transcribe --engine moss y el producto Swift MossTranscribe
FuenteOpenMOSS-Team/MOSS-Transcribe-Diarize
Producto SwiftMossTranscribe
CLI / runtimespeech transcribe --engine moss

Uso

El fragmento siguiente refleja la API o el comando actual expuesto por speech-swift.

# INT8 es la opción predeterminada recomendada.
.build/release/speech transcribe recording.wav --engine moss

# Referencia FP16.
.build/release/speech transcribe recording.wav --engine moss --model fp16

Enlaces del modelo

Notas de implementación