ओपन-सोर्स · Apache 2.0 · पूरी तरह ऑफ़लाइन

ऑन-डिवाइस स्पीच।
असली प्रोडक्ट्स के लिए।

डायराइज़्ड ट्रांसक्रिप्शन, ज़ीरो-शॉट वॉइस क्लोनिंग, लॉन्ग-फ़ॉर्म स्पीच सिंथेसिस — Apple Silicon, Android, Windows, और एम्बेडेड Linux पर। कोई क्लाउड API नहीं, कोई प्रति-मिनट कीमत नहीं, कोई डेटा डिवाइस से बाहर नहीं।

Stenograf के साथ शुरू करें

आपकी बातचीत की निजी स्मृति

GitHub
Apple · Homebrew
brew install speech
Android · Gradle
implementation("audio.soniqo:speech:0.0.9")
नवीनतम लेख और वीडियो
सभी पोस्ट
September 27, 2026 · Soniqo’s Blog

GLiNER2.5-Decide and Jev: a decision model you run, and one you call.

Open-weight GLiNER2.5-Decide in MLX Swift against TypeSafe’s hosted Jev: what each offers, what the published benchmark compared, and local measurements: 7.6 ms per request at 0.85 GB with INT8.

पढ़ें
YouTube · अवधारणा फ़िल्म

Stenograf — बातचीत से कार्रवाई तक

बातचीत को उपयोगी अगले कदमों में बदलने के Stenograf के विचार को दर्शाती एक अवधारणा फ़िल्म।

देखें
Ivan का ब्लॉग · अंग्रेज़ी में लेख

Apple Silicon पर NVIDIA Nemotron VoiceChat: टूल के साथ फुल-डुप्लेक्स आवाज़

Moshi और PersonaPlex से VoiceChat तक: फुल-डुप्लेक्स आवाज़ बीच में बोलने और MCP टूल को कैसे संभालती है, और Android पर छोटा कमांड पाइपलाइन कहाँ उपयोगी है।

पढ़ें
YouTube · 2 मिनट 33 सेकंड

MacBook पर फुल-डुप्लेक्स, असली टूल कॉल करते हुए

NVIDIA Nemotron VoiceChat 11B को स्थानीय रूप से चलाने वाला वास्तविक सत्र: एक बोला गया टर्न, वाक्य के बीच में टोकाटाकी, और Apple Reminders में एक पूर्ण MCP टूल कॉल। M5 Pro पर RTF 0.92, और कुछ भी मशीन से बाहर नहीं जाता।

देखें
आप क्या बना सकते हैं

तीन ऑन-डिवाइस यूज़-केस ग्रुप।

हर ग्रुप में कई सब-यूज़-केस होते हैं जो Soniqo कॉम्पोनेंट्स से जुड़े होते हैं। ऑडियो डालिए, बातचीत, ट्रांसक्रिप्ट या जेनरेट की हुई आवाज़ पाइए — लोकल, रियल-टाइम में।

सभी कॉम्पोनेंट्स

तीस से ज़्यादा मॉडल। एक ही स्टैक।

ऊपर की यूज़-केस पाइपलाइन्स इन्हीं मॉडल्स से बनी हैं। किसी भी कॉम्पोनेंट का आर्किटेक्चर, CLI, Swift API और बेंचमार्क देखने के लिए उसे चुनिए। सभी Apple Silicon पर चलते हैं, ज़्यादातर Android और Linux पर भी।

टेक्स्ट-टू-स्पीच