Mã nguồn mở · Apache 2.0 · Hoàn toàn ngoại tuyến

Giọng nói trên thiết bị.
Cho sản phẩm thực tế.

Nhận dạng có phân tách người nói, nhân bản giọng nói zero-shot, tổng hợp giọng nói dài hạn — chạy trên Apple Silicon, Android, Windows và Linux nhúng. Không cần API đám mây, không tính phí theo phút, không có dữ liệu nào rời khỏi thiết bị.

Apple · Homebrew
brew install speech
Android · Gradle
implementation("audio.soniqo:speech:0.0.9")
Bài viết và video mới nhất
Tất cả bài viết
Những gì bạn có thể xây dựng

Ba nhóm trường hợp sử dụng trên thiết bị.

Mỗi nhóm bao gồm nhiều trường hợp con được ghép từ các thành phần Soniqo. Đưa âm thanh vào và nhận lại hội thoại, bản ghi hoặc giọng nói được tạo — cục bộ, theo thời gian thực.

Toàn bộ thành phần

Hơn ba mươi mô hình. Một stack duy nhất.

Các pipeline trường hợp sử dụng ở trên được ghép từ những mô hình này. Chọn một thành phần để xem kiến trúc, CLI, Swift API và benchmark. Tất cả đều chạy trên Apple Silicon, hầu hết cũng chạy trên Android và Linux.

Văn bản sang giọng nói