Soniqo · Inteligência de voz privada

Inteligência de voz privada.
Na sua nuvem, on-premise ou no dispositivo.

Transcrição com separação de falantes, QA automatizado de conversas, orientação em tempo real para atendentes e vendedores, e modelos de fala adaptados à sua organização. Roda em uma nuvem aprovada, uma VPC privada ou nas suas instalações — gravações e transcrições ficam no ambiente que você escolher.

Implante em qualquer lugar

Nuvem, on-premise ou no dispositivo — os mesmos modelos.

Comece na API gerenciada. Migre para a sua infraestrutura quando a conformidade exigir. Ou rode na borda com os SDKs open source. Os modelos viajam com você.

API na nuvem

Gerenciada e medida por segundo de áudio. Entre, pegue uma chave e chame o endpoint — nada para hospedar. É o que você está vendo.

Entrar
On-premise

Todo o stack dentro da sua rede — áudio e transcrições nunca saem da sua infraestrutura, para requisitos regulados, air-gapped e de residência de dados. Transcrição com separação de falantes e QA automatizado de conversas, orientação em tempo real para atendentes e vendedores, e modelos de fala adaptados ao seu idioma, geografia, vocabulário e fluxos de trabalho.

SDK no dispositivo

Leve a voz para a borda com nossos SDKs open source — speech-swift para Apple, speech-core para Linux / Windows / macOS / Android — com adaptações de modelo para o seu hardware. Sem ida e volta à rede. Palavras de ativação e comandos de voz funcionam totalmente offline. Uma build Android somente-CPU executa todo o pipeline em 1,2 GB de RAM — parte do nosso runtime de fala privado, disponível sob consulta. No Linux, nosso runtime proprietário executa um loop de comando completo em menos de 400 MB de RAM, para implantações comerciais.

Ver a demo
Adaptação de modelos

Adaptamos nossos próprios modelos à sua organização, sobre o nosso próprio stack de modelos: transcrição Steno ajustada ao seu idioma, vocabulário e fluxos de trabalho, e Soniqo Full Duplex — pipelines de fala a fala full-duplex sobre o nosso runtime. Entregue com implantações on-premise e privadas.

O que está incluído

Tudo para lançar recursos de voz.

Diarização, cobertura de dialetos e compatibilidade direta com a API de áudio da OpenAI.

Locutores atribuídos

Cada fala volta rotulada com o locutor. Registre perfis uma vez e obtenha identidades nomeadas estáveis em reuniões, entrevistas e gravações de chamadas.

Idiomas e dialetos

25+ idiomas com dialetos regionais no modelo principal, mais um modelo de cauda longa com 1.600+ idiomas (híndi, árabe, indonésio, vietnamita e mais). Autodetecção ou dica explícita.

Compatível com OpenAI

Código escrito para a API de áudio da OpenAI funciona no Soniqo mudando uma linha — a URL base. Envie a chave como Bearer ou X-Api-Key. Sem reescrever cliente, sem migrar SDK.