Open source · Apache 2.0 · Полностью офлайн

Речь на устройстве.
Для реальных продуктов.

Диаризованная транскрипция, zero-shot клонирование голоса, длинный синтез речи — на Apple Silicon, Android, Windows и embedded Linux. Никаких облачных API, никакой оплаты по минутам, никакие данные не покидают устройство.

Apple · Homebrew
brew install speech
Android · Gradle
implementation("audio.soniqo:speech:0.0.9")
Свежие статьи и видео
Все публикации
YouTube · 2 мин 33 с

Полный дуплекс на MacBook с реальными вызовами инструментов

Реальная сессия с NVIDIA Nemotron VoiceChat 11B, запущенная локально: речевой ход, перебивание на середине фразы и полный вызов инструмента MCP в Напоминания Apple. RTF 0,92 на M5 Pro, и ничего не покидает машину.

Смотреть
YouTube · 90 сек

Полностью офлайновый голосовой агент в 1,2 ГБ на Android

Скажи — и Android сделает: полный командный цикл от речи до реального действия на устройстве и голосового ответа, на одном телефоне в 1,2 ГБ RAM. Silero VAD, Parakeet STT, вызовы инструментов FunctionGemma и Pocket TTS.

Смотреть
YouTube · 4 мин

Локальный голосовой ИИ на MacBook — обзор за 4 минуты

4-минутный тур по open-source библиотеке: транскрипция в реальном времени с Nemotron Streaming, локальный speech-to-speech с PersonaPlex и клонирование 48 кГц с VoxCPM2 — всё на ноутбуке.

Смотреть
7 июля 2026 · Блог Soniqo

Голосовые агенты на устройстве: один конвейер, три бюджета памяти

VAD → STT → LLM → TTS на телефоне и Mac · ~1.2 ГБ iPhone · ~1.5 ГБ S23 · <4 ГБ десктоп

Одна и та же агентная цепочка VAD → STT → LLM → TTS на iPhone, Galaxy S23 и Mac — с измеренной памятью для каждого бюджета.

Читать
Что можно построить

Три группы сценариев — все на устройстве.

Каждая группа охватывает несколько подсценариев, собранных из компонентов Soniqo. Подаёте аудио — получаете диалог, транскрипции или сгенерированную речь локально, в реальном времени.

Все компоненты

Более тридцати моделей. Один стек.

Все пайплайны выше собраны из этих моделей. Выберите компонент, чтобы увидеть его архитектуру, CLI, Swift API и бенчмарки. Все работают на Apple Silicon, большинство — также на Android и Linux.

Текст → речь