Soniqo · Inteligencia de voz privada

Inteligencia de voz privada.
En tu nube, on-premise o en el dispositivo.

Transcripción con separación de hablantes, QA automatizado de conversaciones, guía en tiempo real para agentes y comerciales, y modelos de voz adaptados a tu organización. Funciona en una nube aprobada, una VPC privada o en tus instalaciones: grabaciones y transcripciones se quedan en el entorno que elijas.

Despliega donde quieras

Nube, on-premise o en el dispositivo — los mismos modelos.

Empieza con la API gestionada. Pasa a tu propia infraestructura cuando lo exija el cumplimiento. O corre en el borde con los SDK open source. Los modelos viajan contigo.

API en la nube

Gestionada y medida por segundo de audio. Inicia sesión, obtén una clave y llama al endpoint — nada que alojar. Es lo que estás viendo.

Iniciar sesión
On-premise

Todo el stack dentro de tu red — audio y transcripciones nunca salen de tu infraestructura, para requisitos regulados, air-gapped y de residencia de datos. Transcripción con separación de hablantes y QA automatizado de conversaciones, guía en tiempo real para agentes y comerciales, y modelos de voz adaptados a tu idioma, geografía, vocabulario y flujos de trabajo.

SDK en el dispositivo

Lleva la voz al borde con nuestros SDK open source — speech-swift para Apple, speech-core para Linux / Windows / macOS / Android — con adaptaciones de modelo para tu hardware. Sin ida y vuelta a la red. Palabras de activación y comandos de voz funcionan totalmente sin conexión. Una compilación Android solo-CPU ejecuta todo el pipeline en 1,2 GB de RAM — parte de nuestro runtime de voz privado, disponible bajo petición. En Linux, nuestro runtime propietario ejecuta un bucle de comandos completo en menos de 400 MB de RAM, para despliegues comerciales.

Ver la demo
Adaptación de modelos

Adaptamos nuestros propios modelos a tu organización, sobre nuestro propio stack de modelos: transcripción Steno ajustada a tu idioma, vocabulario y flujos de trabajo, y Soniqo Full Duplex — pipelines de voz a voz full-duplex sobre nuestro propio runtime. Se entrega con despliegues on-premise y privados.

Qué incluye

Todo lo necesario para lanzar funciones de voz.

Diarización, cobertura de dialectos y compatibilidad directa con la API de audio de OpenAI.

Hablantes atribuidos

Cada intervención vuelve etiquetada con su hablante. Registra perfiles una vez y obtén identidades estables con nombre en reuniones, entrevistas y llamadas.

Idiomas y dialectos

25+ idiomas con dialectos regionales en el modelo principal, más un modelo de cola larga con 1,600+ idiomas (hindi, árabe, indonesio, vietnamita y más). Autodetección o indicación explícita.

Compatible con OpenAI

El código escrito para la API de audio de OpenAI funciona con Soniqo cambiando una línea: la URL base. Envía tu clave como Bearer o X-Api-Key. Sin reescrituras ni migración de SDK.