Subformer
ฟรี · ไม่ต้องลงทะเบียน · ทำงานในเบราว์เซอร์ของคุณ

แปลงเสียงเป็นข้อความ Norwegian ฟรี

Norsk

ลากไฟล์เสียงหรือวิดีโอ Norwegian แล้วรับทรานสคริปต์ฉบับเต็มพร้อมเครื่องหมายเวลา - ทั้งหมดทำได้ในเบราว์เซอร์ของคุณ โดยไม่ต้องสมัครใช้งาน. โมเดลจะถูกดาวน์โหลดเพียงครั้งเดียว (~75 MB) และถูกเก็บไว้ในแคชบนเครื่อง ดังนั้นการรันในครั้งถัดไปจะเร็วทันทีและสามารถทำงานแบบออฟไลน์ได้.

กำลังตรวจสอบการรองรับของเบราว์เซอร์…

ต้องการความแม่นยำสูงขึ้นหรือภาษาเพิ่มเติมหรือไม่?

การแปลงเสียงเป็นข้อความ Norwegian บนคลาวด์

เครื่องมือฟรีในเบราว์เซอร์ใช้โมเดลโอเพนซอร์สขนาดเล็ก ซึ่งเหมาะสำหรับเสียงที่ชัดเจน แต่ก็อาจมีปัญหาในการจัดการกับสำเนียง Norwegian ที่หนักหน่วง เสียงรบกวน หรือผู้พูดที่พูดทับซ้อนกัน และรองรับเพียงชุดภาษาที่จำกัดเท่านั้น สำหรับความแม่นยำระดับออกอากาศ การรองรับภาษาที่กว้างขวางยิ่งขึ้น และการดาวน์โหลด SRT/VTT/TXT โปรดใช้บริการแปลงเสียงเป็นข้อความบนคลาวด์แบบชำระเงินของเรา

ลองใช้การแปลงเสียงเป็นข้อความบนคลาวด์

วิธีการทำงาน

  1. 1. ลากไฟล์มาวาง

    วางไฟล์เสียงหรือวิดีโอ Norwegian ใดก็ได้ - รองรับ MP3, WAV, M4A, MP4 และ WEBM.

  2. 2. ถอดความ

    การคลิกครั้งแรกจะดาวน์โหลดโมเดลขนาดประมาณ 75 MB ไปยังเบราว์เซอร์ของคุณ. หลังจากนั้น การรู้จำจะเป็นแบบทันทีและสามารถใช้งานแบบออฟไลน์ได้.

  3. 3. ดาวน์โหลด

    บันทึกคำถอดความเป็นไฟล์ TXT, SRT หรือ VTT. เสียงของคุณและผลลัพธ์จะไม่ออกจากอุปกรณ์ของคุณ.

ไฟล์เสียงของคุณจะอยู่บนอุปกรณ์ของคุณ

การรู้จำทำงานทั้งหมดในเบราว์เซ์เซอร์ของคุณโดยใช้ WebAssembly. การร้องขอเครือข่ายเพียงอย่างเดียวคือการดึงโมเดลและรันไทม์ WebAssembly - ทั้งคู่เป็นทรัพยากรสาธารณะแบบคงที่. เราไม่เห็นไฟล์เสียงของคุณและเราไม่เห็นคำถอดความ.

การถอดเสียง Norwegian ทำงานในเบราว์เซอร์ของคุณอย่างไร

การรู้จำเสียงพูดโดยปกติหมายถึงการอัปโหลดเสียงของคุณไปยัง GPU ของผู้อื่น ที่นี่โมเดลทำงานบนเครื่องของคุณเองแทน ซึ่งทำให้สิ่งนี้ฟรีและเป็นส่วนตัวในเวลาเดียวกัน

Open-source recognition model
โมเดลโครงข่ายประสาทเทียมโอเพนซอร์สที่ฝึกฝนจากเสียงหลายภาษา ซึ่งเป็นเหตุผลว่าทำไมการดาวน์โหลดครั้งเดียวจึงรองรับ Norwegian โดยไม่ต้องดึงโมเดลเฉพาะภาษา
WebAssembly
รันไทม์การอนุมานถูกคอมไพล์เป็น WebAssembly ดังนั้นโค้ดเชิงตัวเลขจึงทำงานด้วยความเร็วใกล้เคียงเนทีฟภายในแท็บแซนด์บ็อกซ์โดยไม่มีปลั๊กอินและไม่ต้องติดตั้ง
On-device inference
โมเดลที่ถูกควอนไทซ์ขนาด ~75 MB ถูกโหลด และลูปการถอดรหัสถูกขับเคลื่อนทั้งหมดฝั่งไคลเอ็นต์ ไม่มีอะไรในไปป์ไลน์ที่เรียกใช้เซิร์ฟเวอร์เมื่อหน้าเว็บโหลดเสร็จแล้ว
Web Audio API
ไฟล์ของคุณจะถูกถอดรหัสและสุ่มตัวอย่างใหม่เป็นโมโน 16 kHz ที่โมเดลคาดหวัง โดยใช้ไปป์ไลน์เสียงของเบราว์เซอร์เอง ดังนั้นรูปแบบใดๆ ที่เบราว์เซอร์ของคุณสามารถเล่นได้จะได้รับการยอมรับ
Premium - จาก Subformer เช่นกัน

คำถามที่พบบ่อย

ลองใช้ภาษาอื่นๆ สำหรับการถอดเสียงฟรี