Soniqo Cloud · स्पीच AI प्लेटफ़ॉर्म

आवाज़ अंदर। आवाज़ बाहर।
वॉइस के लिए एक API।

स्पीकर लेबल के साथ ट्रांसक्रिप्शन और प्राकृतिक वाक् संश्लेषण — एक ही OpenAI-संगत API से। वॉइस एजेंट और क्रिएटर्स के लिए। हमारे क्लाउड में, आपके सर्वर पर या डिवाइस पर चलाएँ।

$10/माह मुफ़्त क्रेडिट · ट्रांसक्रिप्शन $0.24/घंटा · संश्लेषण $0.22/मिनट · या OSS लाइब्रेरी मुफ़्त चलाएँ

API संदर्भ और दस्तावेज़ अंग्रेज़ी में हैं।

दो क्षमताएँ, एक API

वाक् को समझें — और उत्पन्न करें।

Steno ऑडियो को स्पीकर-सहित ट्रांसक्रिप्ट में बदलता है। Vox बिल्ट-इन प्रीसेट वॉइस से टेक्स्ट को प्राकृतिक आवाज़ में बदलता है। वही कुंजी, वही बिलिंग, वही base URL।

Soniqo Steno
ट्रांसक्रिप्शन

स्पीकर डायराइज़ेशन, स्पीकर पहचान और शब्द-स्तरीय टाइमस्टैम्प के साथ स्पीच-टू-टेक्स्ट। हमारा ट्यून किया मॉडल 25+ भाषाओं और उनकी क्षेत्रीय बोलियों को शब्दशः कवर करता है। भाषा स्वतः पहचानें या संकेत दें।

Soniqo Vox
वाक् संश्लेषण

प्राकृतिक टेक्स्ट-टू-स्पीच — पूरी फ़ाइल या लाइव उपयोग हेतु लो-लेटेंसी स्ट्रीम। OpenAI-संगत ऑडियो API से बिल्ट-इन प्रीसेट वॉइस चुनें।

हर मॉडल को उसके Soniqo नाम से बुलाएँ; नीचे क्या चलता है उसे हम सुधारते रहते हैं — आपकी एक भी पंक्ति बदले बिना।

वॉइस एजेंट

Soniqo को अपने एजेंट स्टैक में जोड़ें।

Steno और Vox OpenAI ऑडियो API के स्वरूप का पालन करते हैं — LiveKit जैसा फ़्रेमवर्क सिर्फ़ हमारे base URL की ओर इशारा करने से चल पड़ता है। कोई कस्टम प्लगइन नहीं; एजेंट रनटाइम की अपेक्षित दर पर PCM स्ट्रीमिंग।

# LiveKit Agents — Soniqo TTS with no custom plugin
from livekit.plugins import openai

tts = openai.TTS(
    base_url="https://api.soniqo.audio/v1",
    api_key="sk_...",          # sent as Authorization: Bearer
    model="tts-1",
    voice="af_heart",          # built-in Soniqo preset
    response_format="pcm",     # low-latency 24 kHz stream
)

जो भी स्टैक पहले से OpenAI ऑडियो API उपयोग करता है, वैसे ही चलेगा — base URL बदलें, कोड वही रखें।

क्या शामिल है

वॉइस फ़ीचर शिप करने के लिए सब कुछ।

डायराइज़ेशन, बोली कवरेज, ड्रॉप-इन संगतता और सबको समेटती बिलिंग — ट्रांसक्रिप्शन और संश्लेषण में।

स्पीकर, नामांकित

हर कथन स्पीकर लेबल के साथ लौटता है। स्पीकर प्रोफ़ाइल एक बार पंजीकृत करें और मीटिंग, इंटरव्यू व कॉल रिकॉर्डिंग में स्थिर नामित पहचान पाएँ।

भाषाएँ और बोलियाँ

कोर मॉडल में क्षेत्रीय बोलियों समेत 25+ भाषाएँ, साथ ही 1,600+ भाषाओं वाला लॉन्ग-टेल मॉडल (हिंदी, अरबी, इंडोनेशियाई, वियतनामी आदि)। स्वतः पहचान या स्पष्ट संकेत।

OpenAI-संगत

OpenAI ऑडियो API के लिए लिखा कोड एक पंक्ति — base URL — बदलकर Soniqo पर चलता है। कुंजी Bearer या X-Api-Key से भेजें। न क्लाइंट री-राइट, न SDK माइग्रेशन।

ऑडियो-सेकंड से भुगतान

ट्रांसक्रिप्शन $0.24 प्रति ऑडियो-घंटा — स्पीच-टू-टेक्स्ट, डायराइज़ेशन व स्पीकर ID सम्मिलित। संश्लेषण $0.22 प्रति उत्पन्न मिनट। सेकंड-दर-सेकंड बिलिंग, कोई न्यूनतम नहीं।

API कुंजियाँ + OAuth

कंसोल हेतु Google या GitHub से साइन इन, सर्वर-से-सर्वर हेतु दीर्घायु API कुंजियाँ। Argon2-हैश्ड, खाते तक सीमित, कभी भी निरस्त करने योग्य।

At-least-once जॉब्स

स्पष्ट पावती व आइडेम्पोटेंसी कुंजियों वाली टिकाऊ कतार। प्रीएम्प्शन से कोई जॉब न खोता है न दोहरा बिल बनता है — लेजर ही सत्य का स्रोत है।

कहीं भी डिप्लॉय करें

क्लाउड, ऑन-प्रेम या ऑन-डिवाइस — वही मॉडल।

प्रबंधित API से शुरू करें। अनुपालन माँगे तो अपनी इन्फ्रास्ट्रक्चर पर जाएँ। या ओपन-सोर्स SDK के साथ एज पर चलाएँ। मॉडल आपके साथ चलते हैं।

क्लाउड API

प्रबंधित, ऑडियो-सेकंड से मीटर्ड। साइन इन करें, कुंजी लें, एंडपॉइंट कॉल करें — कुछ होस्ट नहीं करना। आप यही देख रहे हैं।

ऑन-प्रेमाइज़

पूरा स्टैक आपके नेटवर्क के भीतर। ऑडियो व ट्रांसक्रिप्ट आपकी इन्फ्रास्ट्रक्चर से बाहर नहीं जाते — विनियमित, एयर-गैप्ड व डेटा-निवास आवश्यकताओं हेतु। कस्टम SLA और प्रति-ग्राहक मॉडल ट्यूनिंग।

ऑन-डिवाइस SDK

हमारे ओपन-सोर्स SDK से एज पर वाक् चलाएँ — Apple हेतु speech-swift, Linux / Windows / macOS / Android हेतु speech-core — आपके हार्डवेयर हेतु ट्यून की मॉडल अनुकूलन सहित। कोई नेटवर्क राउंड-ट्रिप नहीं।

क्विकस्टार्ट

एक कॉल ट्रांसक्राइब — एक कॉल बोलने के लिए।

साइन इन के बाद प्रारंभिक बैलेंस और एक API कुंजी मिलती है। ट्रांसक्रिप्शन एक HTTP अपलोड है; संश्लेषण ऐसा ऑडियो देता है जो सीधे स्पीकर तक जा सकता है।

# Transcribe with diarization (Soniqo Steno)
curl -X POST https://api.soniqo.audio/v1/transcribe \
  -H "Authorization: Bearer $SONIQO_API_KEY" \
  -F "[email protected]"
# -> a job id; poll /v1/transcribe/<id> for the attributed transcript

# Synthesize speech (Soniqo Vox)
curl -X POST https://api.soniqo.audio/v1/audio/speech \
  -H "Authorization: Bearer $SONIQO_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"input":"Hello from Soniqo.","voice":"nova"}' \
  --output hello.wav

पहले से OpenAI SDK पर हैं? base URL बदलें — मौजूदा कोड चल पड़ेगा:

from openai import OpenAI

client = OpenAI(
    base_url="https://api.soniqo.audio/v1",
    api_key="<your-soniqo-api-key>",
)

# Transcription
with open("meeting.wav", "rb") as f:
    print(client.audio.transcriptions.create(model="whisper-1", file=f).text)

# Synthesis
client.audio.speech.create(
    model="tts-1", voice="nova", input="Hello from Soniqo.",
).stream_to_file("hello.wav")
मूल्य

सरल, प्रति-सेकंड मूल्य।

मुफ़्त
$10
हर माह मुफ़्त क्रेडिट। बिना भुगतान मूल्यांकन के लिए पर्याप्त — शुरू करने को कार्ड नहीं चाहिए।
Steno · ट्रांसक्रिप्शन
$0.24 / ऑडियो-घंटा
डायराइज़ेशन, स्पीकर ID व बोलियों सहित स्पीच-टू-टेक्स्ट — एक साथ, बिना ऐड-ऑन। सेकंड-दर-सेकंड, कोई न्यूनतम नहीं।
Vox · संश्लेषण
$0.22 / मिनट
बिल्ट-इन प्रीसेट वॉइस के साथ टेक्स्ट-टू-स्पीच। उत्पन्न ऑडियो के प्रति मिनट, सेकंड-दर-सेकंड बिलिंग, कोई न्यूनतम नहीं।
एंटरप्राइज़
कस्टम
वॉल्यूम स्तर, ऑन-प्रेम इंस्टॉल, कस्टम SLA, प्रति-ग्राहक मॉडल ट्यूनिंग। संपर्क करें.
या स्वयं चलाएँ

वही मॉडल, वही API — मुफ़्त।

क्लाउड सुविधा के लिए है। पूर्ण नियंत्रण, ऑन-डिवाइस लेटेंसी या शून्य प्रति-मिनट लागत चाहिए तो ओपन-सोर्स लाइब्रेरी अपने हार्डवेयर पर चलाएँ। Apache 2.0, कुछ भी आपकी मशीनों से बाहर नहीं जाता।

speech-swift

वही ट्रांसक्रिप्शन, स्पीकर विभाजन व संश्लेषण मॉडल, Apple प्लेटफ़ॉर्म हेतु पैक — ऑन-डिवाइस अनुकूलन सहित। Swift API, Homebrew इंस्टॉल, Apache 2.0।

speech-core

Linux, Windows, macOS और Android हेतु क्रॉस-प्लेटफ़ॉर्म C++ इंजन — ट्रांसक्रिप्शन, डायराइज़ेशन, स्पीकर ID और CPU पर रियलटाइम स्ट्रीमिंग। Apache 2.0।