صوتٌ يدخل. صوتٌ يخرج.
واجهة API واحدة للصوت.
فرّغ الصوت مع تسميات المتحدثين وولّد كلامًا طبيعيًا عبر واجهة API واحدة متوافقة مع OpenAI. مبنية لوكلاء الصوت وصنّاع المحتوى. شغّلها في سحابتنا أو على خوادمك أو على الجهاز.
مرجع API والوثائق باللغة الإنجليزية.
افهم الكلام — وولّده.
يحوّل Steno الصوت إلى نصوص منسوبة للمتحدثين، ويحوّل Vox النص إلى كلام طبيعي بأصوات جاهزة مدمجة. نفس المفتاح، نفس الفوترة، ونفس عنوان القاعدة.
تحويل الكلام إلى نص مع فصل المتحدثين وتحديد هويتهم وطوابع زمنية لكل كلمة. نموذجنا المضبوط يغطي أكثر من 25 لغة ولهجاتها الإقليمية — كلمةً بكلمة. اكتشاف اللغة تلقائيًا أو تحديدها.
تحويل نص إلى كلام طبيعي، كملف كامل أو بثًّا منخفض الكمون للاستخدام الحي. اختر من الأصوات الجاهزة المدمجة عبر واجهة الصوت المتوافقة مع OpenAI.
تنادي كل نموذج باسمه لدى Soniqo؛ ونواصل نحن تحسين ما يعمل تحته دون أن تغيّر سطرًا واحدًا.
أدخل Soniqo في منظومة وكلائك.
يتبع Steno وVox صيغة واجهة الصوت لدى OpenAI — إطار مثل LiveKit يعمل بمجرد توجيهه إلى عنوان القاعدة لدينا. بلا إضافات مخصصة، مع بثّ PCM بالمعدل الذي تتوقعه بيئات الوكلاء.
# LiveKit Agents — Soniqo TTS with no custom plugin
from livekit.plugins import openai
tts = openai.TTS(
base_url="https://api.soniqo.audio/v1",
api_key="sk_...", # sent as Authorization: Bearer
model="tts-1",
voice="af_heart", # built-in Soniqo preset
response_format="pcm", # low-latency 24 kHz stream
)أي منظومة تستخدم أصلًا واجهة الصوت لدى OpenAI تعمل بالطريقة نفسها — غيّر عنوان القاعدة وأبقِ شيفرتك.
كل ما تحتاجه لإطلاق ميزات صوتية.
فصل المتحدثين، وتغطية اللهجات، وتوافق فوري، ونموذج فوترة يجمعها كلها — عبر التفريغ والتوليف.
تعود كل عبارة موسومة بمتحدثها. سجّل ملفات المتحدثين مرة واحدة واحصل على هويات مسمّاة ثابتة عبر الاجتماعات والمقابلات وتسجيلات المكالمات.
أكثر من 25 لغة بلهجاتها الإقليمية في النموذج الأساسي، مع نموذج للذيل الطويل يغطي أكثر من 1,600 لغة (الهندية والعربية والإندونيسية والفيتنامية وغيرها). اكتشاف تلقائي أو تلميح صريح.
الشيفرة المكتوبة لواجهة الصوت لدى OpenAI تعمل مع Soniqo بتغيير سطر واحد — عنوان القاعدة. أرسل مفتاحك كـ Bearer أو X-Api-Key. لا إعادة كتابة للعميل ولا هجرة SDK.
التفريغ بـ 0.24$ لساعة الصوت — تحويل الكلام إلى نص وفصل المتحدثين وتحديد هويتهم في حزمة واحدة. التوليف بـ 0.22$ لدقيقة الصوت المولَّد. فوترة بالثانية وبلا حدود دنيا.
سجّل الدخول إلى وحدة التحكم عبر Google أو GitHub، أو أنشئ مفاتيح API طويلة العمر لحركة الخوادم. مجزّأة بـ Argon2، مقيدة بحسابك، قابلة للإلغاء في أي وقت.
طابور متين مع إقرار صريح ومفاتيح عدم التكرار. لا يفقد الاستباقُ مهمةً ولا يفوترها مرتين — السجل هو مصدر الحقيقة.
سحابة أو داخل منشأتك أو على الجهاز — النماذج ذاتها.
ابدأ بالواجهة المُدارة. انتقل إلى بنيتك التحتية حين يفرض الامتثال ذلك. أو اعمل على الطرف عبر حِزم SDK مفتوحة المصدر. النماذج ترافقك.
مُدارة ومُقاسة بثانية الصوت. سجّل الدخول، خذ مفتاحًا، ونادِ نقطة النهاية — لا شيء تستضيفه. هذا ما تنظر إليه الآن.
شغّل الحزمة كاملة داخل شبكتك. لا يغادر الصوتُ ولا النصوصُ بنيتك التحتية — للمتطلبات المنظَّمة والمعزولة ومتطلبات إقامة البيانات. اتفاقيات مستوى خدمة مخصصة وضبط نماذج لكل عميل.
انقل الصوت إلى الطرف عبر حزمنا مفتوحة المصدر — speech-swift لمنصات Apple وspeech-core لأنظمة Linux / Windows / macOS / Android — مع تكييف نماذج موافق لعتادك. بلا ذهاب وإياب عبر الشبكة.
نداء واحد للتفريغ — وآخر للكلام.
بعد تسجيل الدخول سيكون لديك رصيد بداية ومفتاح API واحد. التفريغ رفعُ HTTP؛ والتوليف يعيد صوتًا يمكن تمريره مباشرة إلى السماعة.
# Transcribe with diarization (Soniqo Steno)
curl -X POST https://api.soniqo.audio/v1/transcribe \
-H "Authorization: Bearer $SONIQO_API_KEY" \
-F "[email protected]"
# -> a job id; poll /v1/transcribe/<id> for the attributed transcript
# Synthesize speech (Soniqo Vox)
curl -X POST https://api.soniqo.audio/v1/audio/speech \
-H "Authorization: Bearer $SONIQO_API_KEY" \
-H "Content-Type: application/json" \
-d '{"input":"Hello from Soniqo.","voice":"nova"}' \
--output hello.wavتستخدم SDK الخاص بـ OpenAI أصلًا؟ غيّر عنوان القاعدة وستعمل شيفرتك الحالية:
from openai import OpenAI
client = OpenAI(
base_url="https://api.soniqo.audio/v1",
api_key="<your-soniqo-api-key>",
)
# Transcription
with open("meeting.wav", "rb") as f:
print(client.audio.transcriptions.create(model="whisper-1", file=f).text)
# Synthesis
client.audio.speech.create(
model="tts-1", voice="nova", input="Hello from Soniqo.",
).stream_to_file("hello.wav")تسعير بسيط بالثانية.
النماذج ذاتها والواجهة ذاتها — مجانًا.
السحابة للراحة. إن أردت التحكم الكامل أو كمون الجهاز أو صفر تكلفة بالدقيقة، شغّل المكتبة مفتوحة المصدر على عتادك. Apache 2.0، لا شيء يغادر أجهزتك.
نماذج التفريغ وفصل المتحدثين والتوليف ذاتها، مُحزّمة لمنصات Apple مع تكييفات على الجهاز. واجهة Swift، تثبيت عبر Homebrew، رخصة Apache 2.0.
محرك C++ متعدد المنصات لأنظمة Linux وWindows وmacOS وAndroid — تفريغ وفصل متحدثين وتحديد هوية وبث فوري على المعالج. Apache 2.0.
