Soniqo · 私有语音智能

私有语音智能。
部署在你的云、私有化环境或设备端。

分离说话人的转写、自动对话质检、面向坐席与销售的实时指导,以及按你的组织适配的语音模型。可运行在经审批的云、私有 VPC 或你的本地机房——录音与文字稿始终留在你选定的环境内。

随处部署

云端、私有化或设备端 — 同一批模型。

从托管 API 开始;合规需要时迁移到自己的基础设施;或用开源 SDK 跑在边缘端。模型随你迁移。

云 API

托管运行,按音频秒计量。登录、拿密钥、调用端点 — 无需自建。你现在看到的就是它。

登录
私有化部署

整套栈运行在你自己的网络内 — 音频与文字稿不出你的基础设施,满足监管、隔离网络与数据驻留需求。包含分离说话人的转写与自动对话质检、面向坐席与销售的实时指导,以及按你的语言、地区、术语与流程适配的语音模型。

设备端 SDK

用我们的开源 SDK 把语音跑在边缘 — Apple 平台用 speech-swift,Linux / Windows / macOS / Android 用 speech-core — 并有针对硬件调优的模型适配。零网络往返。 唤醒词与语音命令完全离线运行。 CPU-only 的 Android 构建可在 1.2 GB 内存内运行完整流水线 — 属于我们的私有语音运行时,可按需提供。 在 Linux 上,我们的专有运行时可在不到 400 MB 内存内运行完整命令回路,面向商业部署。

观看演示
模型适配

把我们自研的模型适配到你的组织——在我们自有的模型栈上:按你的语言、术语与流程调优的 Steno 转写,以及Soniqo Full Duplex — 运行在我们自有运行时上的全双工语音对话流水线。随私有化与私有部署一并交付。

包含什么

交付语音功能所需的一切。

说话人分离、方言覆盖,以及与 OpenAI 音频 API 的即插即用兼容。

说话人归属

每句话都带说话人标签返回。注册一次说话人档案,即可在会议、访谈与通话录音中获得稳定的具名身份。

语言与方言

核心模型覆盖 25+ 种语言及地区方言,另有覆盖 1,600+ 种语言的长尾模型(印地语、阿拉伯语、印尼语、越南语等)。自动检测或显式指定。

兼容 OpenAI

针对 OpenAI 音频 API 写的代码,改一行 base URL 即可对接 Soniqo。密钥以 Bearer 或 X-Api-Key 传递。无需重写客户端,无需迁移 SDK。