مفتوح المصدر · Apache 2.0 · يعمل دون اتصال بالإنترنت

الكلام على الجهاز.
لمنتجات حقيقية.

تفريغ مع تحديد المتحدّثين، واستنساخ صوت بصفر-إطلاق، وتركيب كلام طويل المدى — يعمل على Apple Silicon وAndroid وWindows وLinux المضمّن. بدون واجهات سحابية، بدون تسعير بالدقيقة، وبدون خروج أي بيانات من الجهاز.

Apple · Homebrew
brew install speech
Android · Gradle
implementation("audio.soniqo:speech:0.0.9")
أحدث المقالات والفيديوهات
كل المنشورات
YouTube · 2 دقيقة و33 ثانية

ازدواج كامل على جهاز MacBook مع استدعاء أدوات حقيقية

جلسة حقيقية تشغّل NVIDIA Nemotron VoiceChat 11B محليًا: دور كلامي، ومقاطعة في منتصف الجملة، واستدعاء أداة MCP كامل إلى تطبيق التذكيرات من Apple. معامل RTF 0.92 على M5 Pro، ولا شيء يغادر الجهاز.

شاهد
YouTube · 90 ثانية

وكيل صوتي كامل دون اتصال في 1.2 GB على Android

قلها — وAndroid ينفّذها: حلقة أوامر كاملة من الكلام إلى إجراء حقيقي على الجهاز ثم ردّ منطوق، على هاتف واحد بذاكرة 1.2 GB. Silero VAD وParakeet STT ونداءات أدوات FunctionGemma وPocket TTS.

مشاهدة
YouTube · 4 دقائق

ذكاء صوتي محلي على MacBook — جولة في 4 دقائق

جولة 4 دقائق في المكتبة مفتوحة المصدر: تفريغ فوري مع Nemotron Streaming، وكلام إلى كلام محلي مع PersonaPlex، واستنساخ 48 kHz مع VoxCPM2 — كل ذلك على الحاسوب المحمول.

مشاهدة
7 يوليو 2026 · مدوّنة Soniqo

تشغيل وكيل صوتي على الجهاز: خط أنابيب واحد، ثلاث ميزانيات ذاكرة

VAD ← STT ← LLM ← TTS على الهاتف وMac · iPhone ~1.2 GB · S23 ~1.5 GB · سطح المكتب <4 GB

نفس خط أنابيب الوكيل VAD → STT → LLM → TTS على iPhone وGalaxy S23 وMac — مع ذاكرة مقيسة لكل ميزانية.

اقرأ
ما يمكنك بناؤه

ثلاث مجموعات حالات استخدام على الجهاز.

كل مجموعة تغطّي عدة حالات فرعية مبنية من مكوّنات Soniqo. مرّر صوتك واحصل على محادثة أو نصوص أو صوت مُولَّد — محلياً وفي الزمن الحقيقي.

كل المكوّنات

أكثر من ثلاثين نموذجاً. حزمة واحدة.

خطوط الأنابيب المعروضة أعلاه مبنية من هذه النماذج. اختر مكوّناً لترى بنيته وواجهة سطر الأوامر وSwift API ونتائج الأداء. كلها تعمل على Apple Silicon، ومعظمها على Android وLinux أيضاً.

نص إلى صوت