Thả bất kỳ tệp âm thanh hoặc video nào, chọn ngôn ngữ, và nhận bản chép đầy đủ có dấu thời gian - tất cả trong trình duyệt của bạn. Mô hình được tải xuống một lần (~75 MB) và lưu vào bộ nhớ cục bộ, nên những lần chạy sau tức thì và hoạt động offline.
Việc nhận dạng chạy cục bộ. Âm thanh của bạn không bao giờ rời khỏi thiết bị.
Mô hình được lưu vào bộ nhớ đệm trên trình duyệt của bạn. Các lần chạy sau có thể hoạt động ngoại tuyến.
Không cần tài khoản, không cần credit, không giới hạn sử dụng. Mở và sử dụng.
Nhận dạng giọng nói thông thường có nghĩa là tải âm thanh của bạn lên GPU của ai đó. Ở đây, mô hình chạy trên máy của riêng bạn, điều này làm cho công cụ này vừa miễn phí vừa riêng tư.
Đánh đổi là kích thước mô hình. Trọng số trên thiết bị chỉ là một phần nhỏ so với những gì một dịch vụ được lưu trữ chạy, vì vậy độ chính xác giảm trên âm thanh nhiễu, giọng mạnh và người nói chồng chéo - đó là nơi tùy chọn đám mây bên dưới phát huy tác dụng.
Công cụ miễn phí trên trình duyệt chạy một mô hình mã nguồn mở nhỏ - tốt cho âm thanh rõ ràng, nhưng có thể gặp khó khăn với giọng nặng, tiếng ồn hoặc người nói chồng chéo, và chỉ hỗ trợ một số ngôn ngữ hạn chế. Để có độ chính xác cấp độ phát sóng, hỗ trợ ngôn ngữ rộng hơn nhiều và tải xuống SRT/VTT/TXT, hãy sử dụng tính năng Chuyển giọng nói thành văn bản dựa trên đám mây trả phí của chúng tôi.
Thử Chuyển giọng nói thành văn bản dựa trên đám mây