Subformer
Miễn phí · Không cần đăng ký · Chạy trong trình duyệt của bạn

Chuyển giọng nói thành văn bản miễn phí trong 35+ ngôn ngữ

Thả bất kỳ tệp âm thanh hoặc video nào, chọn ngôn ngữ, và nhận bản chép đầy đủ có dấu thời gian - tất cả trong trình duyệt của bạn. Mô hình được tải xuống một lần (~75 MB) và lưu vào bộ nhớ cục bộ, nên những lần chạy sau tức thì và hoạt động offline.

Mặc định là riêng tư

Việc nhận dạng chạy cục bộ. Âm thanh của bạn không bao giờ rời khỏi thiết bị.

Ngay lập tức sau lần tải đầu tiên

Mô hình được lưu vào bộ nhớ đệm trên trình duyệt của bạn. Các lần chạy sau có thể hoạt động ngoại tuyến.

Miễn phí, không cần đăng ký

Không cần tài khoản, không cần credit, không giới hạn sử dụng. Mở và sử dụng.

Chọn ngôn ngữ

Bên trong

Nhận dạng giọng nói thông thường có nghĩa là tải âm thanh của bạn lên GPU của ai đó. Ở đây, mô hình chạy trên máy của riêng bạn, điều này làm cho công cụ này vừa miễn phí vừa riêng tư.

Open-source recognition model
Một bản dựng lượng tử hóa của mô hình nhận dạng giọng nói thần kinh mã nguồn mở, đủ nhỏ để tải xuống một lần và giữ trong trình duyệt của bạn.
WebAssembly
Thời gian chạy suy luận được biên dịch thành WebAssembly, vì vậy mã số học chạy ở tốc độ gần như gốc bên trong một tab được bảo vệ mà không cần plugin và không cần cài đặt.
On-device inference
Tải mô hình, mã hóa và chạy vòng lặp giải mã đều diễn ra ở phía máy khách. Không có phần nào của quy trình gọi đến máy chủ sau khi trang đã tải.
Web Audio API
Tệp của bạn được giải mã và lấy mẫu lại thành âm thanh đơn 16 kHz mà mô hình mong đợi bằng cách sử dụng đường ống âm thanh của trình duyệt, vì vậy bất kỳ định dạng nào trình duyệt của bạn có thể phát đều được chấp nhận.

Đánh đổi là kích thước mô hình. Trọng số trên thiết bị chỉ là một phần nhỏ so với những gì một dịch vụ được lưu trữ chạy, vì vậy độ chính xác giảm trên âm thanh nhiễu, giọng mạnh và người nói chồng chéo - đó là nơi tùy chọn đám mây bên dưới phát huy tác dụng.

Cần độ chính xác cao hơn hoặc nhiều ngôn ngữ hơn?

Chuyển giọng nói thành văn bản dựa trên đám mây

Công cụ miễn phí trên trình duyệt chạy một mô hình mã nguồn mở nhỏ - tốt cho âm thanh rõ ràng, nhưng có thể gặp khó khăn với giọng nặng, tiếng ồn hoặc người nói chồng chéo, và chỉ hỗ trợ một số ngôn ngữ hạn chế. Để có độ chính xác cấp độ phát sóng, hỗ trợ ngôn ngữ rộng hơn nhiều và tải xuống SRT/VTT/TXT, hãy sử dụng tính năng Chuyển giọng nói thành văn bản dựa trên đám mây trả phí của chúng tôi.

Thử Chuyển giọng nói thành văn bản dựa trên đám mây