Subformer
Miễn phí · Không cần đăng ký · Chạy trong trình duyệt của bạn

Miễn phí Italian chuyển giọng nói thành văn bản

Italiano

Thả một tệp âm thanh hoặc video Italian và nhận bản chép đầy đủ có dấu thời gian - tất cả trong trình duyệt của bạn, không cần đăng ký. Mô hình được tải xuống một lần (~75 MB) và lưu vào bộ nhớ cục bộ, nên những lần chạy sau tức thì và hoạt động offline.

Đang kiểm tra hỗ trợ trình duyệt…

Cần độ chính xác cao hơn hoặc nhiều ngôn ngữ hơn?

Chuyển giọng nói Italian thành văn bản dựa trên đám mây

Công cụ miễn phí trên trình duyệt chạy một mô hình mã nguồn mở nhỏ - tốt cho âm thanh rõ ràng, nhưng có thể gặp khó khăn với giọng Italian nặng, tiếng ồn hoặc người nói chồng chéo, và chỉ hỗ trợ một số ngôn ngữ hạn chế. Để có độ chính xác cấp độ phát sóng, hỗ trợ ngôn ngữ rộng hơn nhiều và tải xuống SRT/VTT/TXT, hãy sử dụng tính năng Chuyển giọng nói thành văn bản dựa trên đám mây trả phí của chúng tôi.

Thử Chuyển giọng nói thành văn bản dựa trên đám mây

Cách hoạt động

  1. 1. Thả tệp

    Thả bất kỳ tệp âm thanh hoặc video Italian - MP3, WAV, M4A, MP4 và WEBM đều được hỗ trợ

  2. 2. Phiên âm

    Lần nhấp đầu tiên tải mô hình ~75 MB về trình duyệt của bạn. Sau đó, nhận dạng sẽ tức thì và có thể hoạt động ngoại tuyến.

  3. 3. Tải xuống

    Lưu bản chép lời dưới dạng TXT, SRT hoặc VTT. Âm thanh và kết quả của bạn không bao giờ rời khỏi thiết bị.

Âm thanh của bạn ở lại trên thiết bị của bạn

Việc nhận dạng chạy hoàn toàn trong trình duyệt của bạn bằng WebAssembly. Các yêu cầu mạng duy nhất là để tải mô hình và runtime WebAssembly - cả hai đều là tài sản công khai, tĩnh. Chúng tôi không thấy âm thanh của bạn và cũng không thấy bản chép lời.

Cách phiên âm Italian chạy trong trình duyệt của bạn

Nhận dạng giọng nói thông thường có nghĩa là tải âm thanh của bạn lên GPU của ai đó. Ở đây, mô hình chạy trên máy của riêng bạn, điều này làm cho nó vừa miễn phí vừa riêng tư.

Open-source recognition model
Một mô hình thần kinh mã nguồn mở được đào tạo trên âm thanh đa ngôn ngữ - đó là lý do tại sao một lần tải xuống có thể xử lý Italian mà không cần tìm nạp mô hình dành riêng cho ngôn ngữ.
WebAssembly
Thời gian chạy suy luận được biên dịch thành WebAssembly, vì vậy mã số học chạy ở tốc độ gần như gốc bên trong một tab được bảo vệ mà không cần plugin và không cần cài đặt.
On-device inference
Mô hình lượng tử hóa ~75 MB được tải và vòng lặp giải mã được điều khiển hoàn toàn ở phía máy khách. Không có gì trong quy trình gọi đến máy chủ sau khi trang đã tải.
Web Audio API
Tệp của bạn được giải mã và lấy mẫu lại thành âm thanh đơn 16 kHz mà mô hình mong đợi bằng cách sử dụng đường ống âm thanh của trình duyệt, vì vậy bất kỳ định dạng nào trình duyệt của bạn có thể phát đều được chấp nhận.
Cao cấp - cũng từ Subformer

Câu hỏi thường gặp

Thử các ngôn ngữ chuyển giọng nói sang văn bản miễn phí khác