Soniqo · Trí tuệ giọng nói riêng tư

Trí tuệ giọng nói riêng tư.
Trên đám mây của bạn, tại chỗ, hoặc trên thiết bị.

Chép lời tách người nói, QA hội thoại tự động, hướng dẫn thời gian thực cho tổng đài viên và nhân viên bán hàng, cùng mô hình tiếng nói thích ứng với tổ chức bạn. Chạy trên đám mây được phê duyệt, VPC riêng hoặc tại chỗ — bản ghi và bản chép luôn ở trong môi trường bạn chọn.

Triển khai mọi nơi

Đám mây, tại chỗ hay trên thiết bị — cùng bộ mô hình.

Bắt đầu với API được quản lý. Chuyển sang hạ tầng của bạn khi tuân thủ yêu cầu. Hoặc chạy ở biên với SDK mã nguồn mở. Mô hình đi cùng bạn.

API đám mây

Được quản lý, đo theo giây âm thanh. Đăng nhập, lấy khóa và gọi endpoint — không phải host gì. Chính là thứ bạn đang xem.

Đăng nhập
Tại chỗ (on-premise)

Chạy cả stack trong mạng của bạn — âm thanh và bản chép không bao giờ rời hạ tầng, cho yêu cầu ràng buộc pháp lý, air-gapped và nơi lưu dữ liệu. Chép lời tách người nói và QA hội thoại tự động, hướng dẫn thời gian thực cho tổng đài viên và nhân viên bán hàng, cùng mô hình tiếng nói thích ứng với ngôn ngữ, khu vực, thuật ngữ và quy trình của bạn.

SDK trên thiết bị

Đưa giọng nói ra biên với SDK mã nguồn mở — speech-swift cho nền tảng Apple, speech-core cho Linux / Windows / macOS / Android — kèm thích ứng mô hình theo phần cứng. Không vòng lặp mạng. Từ đánh thức và lệnh thoại chạy hoàn toàn ngoại tuyến. Bản dựng Android chỉ dùng CPU chạy toàn bộ pipeline trong 1,2 GB RAM — thuộc runtime tiếng nói riêng của chúng tôi, cung cấp theo yêu cầu. Trên Linux, runtime độc quyền của chúng tôi chạy trọn một vòng lệnh trong dưới 400 MB RAM, cho triển khai thương mại.

Xem demo
Thích ứng mô hình

Thích ứng mô hình của chính chúng tôi với tổ chức bạn, trên chính ngăn xếp mô hình của chúng tôi: bản chép Steno tinh chỉnh theo ngôn ngữ, thuật ngữ và quy trình, cùng Soniqo Full Duplex — pipeline tiếng nói hai chiều đồng thời chạy trên runtime riêng của chúng tôi. Đi kèm triển khai tại chỗ và riêng tư.

Bao gồm những gì

Mọi thứ để ra mắt tính năng giọng nói.

Phân tách người nói, độ phủ phương ngữ và tương thích trực tiếp với API âm thanh của OpenAI.

Người nói được gán

Mỗi phát ngôn trả về kèm nhãn người nói. Đăng ký hồ sơ người nói một lần và có danh tính đặt tên ổn định qua các cuộc họp, phỏng vấn và ghi âm cuộc gọi.

Ngôn ngữ và phương ngữ

25+ ngôn ngữ với phương ngữ vùng ở mô hình lõi, cộng mô hình đuôi dài phủ 1.600+ ngôn ngữ (Hindi, Ả Rập, Indonesia, Việt và hơn nữa). Tự phát hiện hoặc chỉ định rõ.

Tương thích OpenAI

Mã viết cho API âm thanh OpenAI chạy với Soniqo chỉ bằng đổi một dòng — base URL. Gửi khóa dạng Bearer hoặc X-Api-Key. Không viết lại client, không di trú SDK.