Subformer
Miễn phí · Không cần đăng ký · Chạy trong trình duyệt của bạn

Miễn phí Swahili Chuyển văn bản thành giọng nói

Kiswahili

Nhập hoặc dán văn bản Swahili và nghe nó được đọc - tất cả trong trình duyệt của bạn, không cần đăng ký. Mô hình giọng nói được tải xuống một lần (~60 MB) và lưu vào bộ nhớ đệm cục bộ, vì vậy các lần chạy sau là tức thì và hoạt động ngoại tuyến.

Cách hoạt động

  1. 1. Nhập văn bản của bạn

    Dán hoặc gõ bất kỳ văn bản Swahili nào - dấu câu và ngắt dòng được giữ nguyên.

  2. 2. Tạo

    Lần nhấp đầu tiên sẽ tải về mô hình giọng nói ~60 MB vào trình duyệt của bạn. Sau đó, việc tổng hợp là tức thì.

  3. 3. Tải xuống hoặc phát

    Phát âm thanh ngay trên trang hoặc lưu nó dưới dạng tệp WAV. Âm thanh không bao giờ rời khỏi thiết bị của bạn.

Văn bản của bạn vẫn ở trên thiết bị của bạn

Tổng hợp chạy hoàn toàn trong trình duyệt của bạn bằng WebAssembly. Các yêu cầu mạng duy nhất là để tìm nạp mô hình giọng nói và thời gian chạy suy luận - cả hai đều là tài sản công khai, tĩnh. Chúng tôi không thấy văn bản của bạn và chúng tôi không thấy âm thanh được tạo ra.

Cách giọng nói Swahili chạy trong trình duyệt của bạn

Đây là một mô hình TTS thần kinh thực sự chạy trên máy của riêng bạn, không phải là một máy khách mỏng cho API được lưu trữ. Bốn yếu tố làm cho điều đó có thể trong một tab.

Open-source neural voice
Mô hình Swahili được đào tạo trên một người nói duy nhất, đó là lý do tại sao giọng điệu và cách phát âm luôn nhất quán trên mọi thứ bạn tổng hợp.
WebAssembly
Cả thời gian chạy mô hình và bước chuyển văn bản Kiswahili thành âm vị đều được biên dịch thành WebAssembly, vì vậy mã ban đầu được viết cho máy tính để bàn chạy ở tốc độ gần như nguyên bản bên trong sandbox của trình duyệt.
On-device inference
Mạng thần kinh của mô hình được thực thi cục bộ, được ghim vào chế độ đơn luồng để trang không bao giờ cần cách ly đa nguồn gốc và hoạt động trong mọi trình duyệt hiện đại.
Origin Private File System
Mô hình giọng nói ~60 MB được lưu vào bộ nhớ đệm riêng, theo từng nguồn gốc sau lần chạy đầu tiên. Các lần truy cập sau sẽ bỏ qua tải xuống và tổng hợp mà không cần mạng.
Cần giọng nói chất lượng phát sóng?

Subformer Voice Synthesis - TTS Swahili chất lượng studio

Công cụ miễn phí trên trình duyệt phía trên rất thích hợp cho bản nháp và xem trước, nhưng giọng mã nguồn mở nghe rõ ràng là tổng hợp. Dịch vụ Voice Synthesis trả phí của Subformer tạo ra âm thanh tự nhiên, đạt chuẩn phát sóng, với tùy chọn sao chép giọng nói.

Thử Subformer Voice Synthesis
Cao cấp - cũng từ Subformer

Câu hỏi thường gặp

Thử các ngôn ngữ TTS miễn phí khác

Giọng nói được cung cấp bởi Piper. Trọng số giọng nói được cấp phép MIT (rhasspy/piper-voices). Phonemizer wasm được tải từ một CDN công khai khi chạy và không phải là một phần trong phân phối của trang này.