आवाज़ अंदर। आवाज़ बाहर।
वॉइस के लिए एक API।
स्पीकर लेबल के साथ ट्रांसक्रिप्शन और प्राकृतिक वाक् संश्लेषण — एक ही OpenAI-संगत API से। वॉइस एजेंट और क्रिएटर्स के लिए। हमारे क्लाउड में, आपके सर्वर पर या डिवाइस पर चलाएँ।
API संदर्भ और दस्तावेज़ अंग्रेज़ी में हैं।
वाक् को समझें — और उत्पन्न करें।
Steno ऑडियो को स्पीकर-सहित ट्रांसक्रिप्ट में बदलता है। Vox बिल्ट-इन प्रीसेट वॉइस से टेक्स्ट को प्राकृतिक आवाज़ में बदलता है। वही कुंजी, वही बिलिंग, वही base URL।
स्पीकर डायराइज़ेशन, स्पीकर पहचान और शब्द-स्तरीय टाइमस्टैम्प के साथ स्पीच-टू-टेक्स्ट। हमारा ट्यून किया मॉडल 25+ भाषाओं और उनकी क्षेत्रीय बोलियों को शब्दशः कवर करता है। भाषा स्वतः पहचानें या संकेत दें।
प्राकृतिक टेक्स्ट-टू-स्पीच — पूरी फ़ाइल या लाइव उपयोग हेतु लो-लेटेंसी स्ट्रीम। OpenAI-संगत ऑडियो API से बिल्ट-इन प्रीसेट वॉइस चुनें।
हर मॉडल को उसके Soniqo नाम से बुलाएँ; नीचे क्या चलता है उसे हम सुधारते रहते हैं — आपकी एक भी पंक्ति बदले बिना।
Soniqo को अपने एजेंट स्टैक में जोड़ें।
Steno और Vox OpenAI ऑडियो API के स्वरूप का पालन करते हैं — LiveKit जैसा फ़्रेमवर्क सिर्फ़ हमारे base URL की ओर इशारा करने से चल पड़ता है। कोई कस्टम प्लगइन नहीं; एजेंट रनटाइम की अपेक्षित दर पर PCM स्ट्रीमिंग।
# LiveKit Agents — Soniqo TTS with no custom plugin
from livekit.plugins import openai
tts = openai.TTS(
base_url="https://api.soniqo.audio/v1",
api_key="sk_...", # sent as Authorization: Bearer
model="tts-1",
voice="af_heart", # built-in Soniqo preset
response_format="pcm", # low-latency 24 kHz stream
)जो भी स्टैक पहले से OpenAI ऑडियो API उपयोग करता है, वैसे ही चलेगा — base URL बदलें, कोड वही रखें।
वॉइस फ़ीचर शिप करने के लिए सब कुछ।
डायराइज़ेशन, बोली कवरेज, ड्रॉप-इन संगतता और सबको समेटती बिलिंग — ट्रांसक्रिप्शन और संश्लेषण में।
हर कथन स्पीकर लेबल के साथ लौटता है। स्पीकर प्रोफ़ाइल एक बार पंजीकृत करें और मीटिंग, इंटरव्यू व कॉल रिकॉर्डिंग में स्थिर नामित पहचान पाएँ।
कोर मॉडल में क्षेत्रीय बोलियों समेत 25+ भाषाएँ, साथ ही 1,600+ भाषाओं वाला लॉन्ग-टेल मॉडल (हिंदी, अरबी, इंडोनेशियाई, वियतनामी आदि)। स्वतः पहचान या स्पष्ट संकेत।
OpenAI ऑडियो API के लिए लिखा कोड एक पंक्ति — base URL — बदलकर Soniqo पर चलता है। कुंजी Bearer या X-Api-Key से भेजें। न क्लाइंट री-राइट, न SDK माइग्रेशन।
ट्रांसक्रिप्शन $0.24 प्रति ऑडियो-घंटा — स्पीच-टू-टेक्स्ट, डायराइज़ेशन व स्पीकर ID सम्मिलित। संश्लेषण $0.22 प्रति उत्पन्न मिनट। सेकंड-दर-सेकंड बिलिंग, कोई न्यूनतम नहीं।
कंसोल हेतु Google या GitHub से साइन इन, सर्वर-से-सर्वर हेतु दीर्घायु API कुंजियाँ। Argon2-हैश्ड, खाते तक सीमित, कभी भी निरस्त करने योग्य।
स्पष्ट पावती व आइडेम्पोटेंसी कुंजियों वाली टिकाऊ कतार। प्रीएम्प्शन से कोई जॉब न खोता है न दोहरा बिल बनता है — लेजर ही सत्य का स्रोत है।
क्लाउड, ऑन-प्रेम या ऑन-डिवाइस — वही मॉडल।
प्रबंधित API से शुरू करें। अनुपालन माँगे तो अपनी इन्फ्रास्ट्रक्चर पर जाएँ। या ओपन-सोर्स SDK के साथ एज पर चलाएँ। मॉडल आपके साथ चलते हैं।
प्रबंधित, ऑडियो-सेकंड से मीटर्ड। साइन इन करें, कुंजी लें, एंडपॉइंट कॉल करें — कुछ होस्ट नहीं करना। आप यही देख रहे हैं।
पूरा स्टैक आपके नेटवर्क के भीतर। ऑडियो व ट्रांसक्रिप्ट आपकी इन्फ्रास्ट्रक्चर से बाहर नहीं जाते — विनियमित, एयर-गैप्ड व डेटा-निवास आवश्यकताओं हेतु। कस्टम SLA और प्रति-ग्राहक मॉडल ट्यूनिंग।
हमारे ओपन-सोर्स SDK से एज पर वाक् चलाएँ — Apple हेतु speech-swift, Linux / Windows / macOS / Android हेतु speech-core — आपके हार्डवेयर हेतु ट्यून की मॉडल अनुकूलन सहित। कोई नेटवर्क राउंड-ट्रिप नहीं।
एक कॉल ट्रांसक्राइब — एक कॉल बोलने के लिए।
साइन इन के बाद प्रारंभिक बैलेंस और एक API कुंजी मिलती है। ट्रांसक्रिप्शन एक HTTP अपलोड है; संश्लेषण ऐसा ऑडियो देता है जो सीधे स्पीकर तक जा सकता है।
# Transcribe with diarization (Soniqo Steno)
curl -X POST https://api.soniqo.audio/v1/transcribe \
-H "Authorization: Bearer $SONIQO_API_KEY" \
-F "[email protected]" \
-F 'config={"language":"en","diarize":true}'
# -> a job id; poll /v1/transcribe/<id> for the attributed transcript
# Synthesize speech (Soniqo Vox)
curl -X POST https://api.soniqo.audio/v1/audio/speech \
-H "Authorization: Bearer $SONIQO_API_KEY" \
-H "Content-Type: application/json" \
-d '{"input":"Hello from Soniqo.","voice":"nova"}' \
--output hello.wavपहले से OpenAI SDK पर हैं? base URL बदलें — मौजूदा कोड चल पड़ेगा:
from openai import OpenAI
client = OpenAI(
base_url="https://api.soniqo.audio/v1",
api_key="<your-soniqo-api-key>",
)
# Transcription
with open("meeting.wav", "rb") as f:
print(client.audio.transcriptions.create(
model="whisper-1", file=f, language="en").text)
# Synthesis
client.audio.speech.create(
model="tts-1", voice="nova", input="Hello from Soniqo.",
).stream_to_file("hello.wav")सरल, प्रति-सेकंड मूल्य।
वही मॉडल, वही API — मुफ़्त।
क्लाउड सुविधा के लिए है। पूर्ण नियंत्रण, ऑन-डिवाइस लेटेंसी या शून्य प्रति-मिनट लागत चाहिए तो ओपन-सोर्स लाइब्रेरी अपने हार्डवेयर पर चलाएँ। Apache 2.0, कुछ भी आपकी मशीनों से बाहर नहीं जाता।
वही ट्रांसक्रिप्शन, स्पीकर विभाजन व संश्लेषण मॉडल, Apple प्लेटफ़ॉर्म हेतु पैक — ऑन-डिवाइस अनुकूलन सहित। Swift API, Homebrew इंस्टॉल, Apache 2.0।
Linux, Windows, macOS और Android हेतु क्रॉस-प्लेटफ़ॉर्म C++ इंजन — ट्रांसक्रिप्शन, डायराइज़ेशन, स्पीकर ID और CPU पर रियलटाइम स्ट्रीमिंग। Apache 2.0।
