แปลงรูปเป็นข้อความแบบเร็ว (OCR)
ดึงข้อความจากรูปด้วยโมเดล OCR ที่เล็กที่สุด ดาวน์โหลดและอ่านได้เร็วที่สุด
ลากรูปที่มีข้อความมาวางที่นี่หรือคลิกเพื่อเลือก
รูปถ่าย ภาพสแกน และภาพหน้าจอ: JPG, PNG, WebP, GIF, BMP, TIFF หรือ AVIF อ่านภาษาอังกฤษและภาษาอื่นที่ใช้อักษรละติน รวมถึงภาษาจีน แต่อ่านภาษาเกาหลีหรือคานะของญี่ปุ่นไม่ได้ ไฟล์ถูกประมวลผลในเบราว์เซอร์และไม่ถูกอัปโหลด รูปจะอยู่ในเบราว์เซอร์นี้จนกว่าคุณจะนำออก
Ctrl+OเลือกCtrl+Vวาง
โมเดลจดจำข้อความ
โมเดลแบบเร็วที่สุด · …
อ่านภาษาอังกฤษและภาษาอื่นที่ใช้อักษรละติน (ฝรั่งเศส เยอรมัน สเปน โปแลนด์…) และภาษาจีน แต่อ่านภาษาเกาหลี คานะของญี่ปุ่น รัสเซียหรืออักษรซีริลลิกอื่น อาหรับ ไทย ฮินดี หรือเวียดนามไม่ได้
สัญญาอนุญาต: โมเดล (Apache-2.0) · เอนจิน (MIT)
เปลี่ยนภาพหน้าจอ รูปถ่าย หรือหน้าเอกสารที่สแกนเป็นข้อความที่คัดลอกและแก้ไขได้อย่างรวดเร็ว นี่คือเครื่องมือที่เบาที่สุดในสามเครื่องมือแปลงรูปเป็นข้อความ โมเดลจดจำข้อความมีขนาดเพียง 6 MB การเริ่มครั้งแรกจึงเร็วแม้บนโทรศัพท์ และหลังจากนั้นภาพหน้าจอหนึ่งภาพจะอ่านเสร็จในหนึ่งถึงสองวินาที ทุกอย่างทำงานในเบราว์เซอร์ รูปของคุณไม่ออกจากอุปกรณ์ ใช้ฟรีและไม่ต้องสมัครสมาชิก
เปรียบเทียบโมเดลแปลงรูปภาพเป็นข้อความทั้งสาม
| แปลงรูปเป็นข้อความ (เร็วที่สุด)หน้านี้ | แปลงรูปเป็นข้อความ (สมดุล) | แปลงรูปเป็นข้อความ (แม่นยำที่สุด) | |
|---|---|---|---|
| ขนาดโมเดล | 6 MB | 29.7 MB | 132.3 MB |
| ใช้ครั้งแรก: ดาวน์โหลดพร้อมเอนจินที่ 50 Mbit/s | 19.6 MB · ≈ 3 วิ | 43.4 MB · ≈ 7 วิ | 145.9 MB · ≈ 24 วิ |
| ครั้งต่อไป | เก็บไว้ในเบราว์เซอร์ — ไม่ต้องดาวน์โหลดซ้ำ | ||
| ความเร็ว | เร็วที่สุด | เร็ว | ช้าที่สุด |
| ความแม่นยำ | ดีกับข้อความที่คมชัด | แม่นยำกว่ากับภาพถ่ายและตัวอักษรเล็ก | ดีที่สุดกับภาพที่อ่านยาก |
| อ่านได้ | อักษรละติน (อังกฤษ ฝรั่งเศส เยอรมัน…)และจีน | อักษรละติน (อังกฤษ ฝรั่งเศส เยอรมัน…) จีน และญี่ปุ่น | อักษรละติน (อังกฤษ ฝรั่งเศส เยอรมัน…) จีน และญี่ปุ่น |
เอนจินจดจำข้อความ (13.7 MB หรือ 27.4 MB ในเบราว์เซอร์ที่มี WebGPU) ดาวน์โหลดเพียงครั้งเดียวและใช้ร่วมกันทั้งสามโมเดล จะไม่มีการดาวน์โหลดใดๆ จนกว่าคุณจะให้เครื่องมืออ่านรูปภาพ
วิธีแปลงรูปเป็นข้อความอย่างรวดเร็ว
- ลากรูปหนึ่งหรือหลายรูปมาวางที่ใดก็ได้บนหน้า วางภาพหน้าจอด้วย Ctrl+V หรือคลิกเพื่อเลือกไฟล์ รูปที่เพิ่มไว้ในเครื่องมือรูปภาพอื่นจะอยู่ในรายการแล้ว และใบเสร็จตัวอย่างแสดงให้เห็นวิธีทำงาน
- ครั้งแรกให้คลิก “ดาวน์โหลดโมเดลและอ่านข้อความ” ไฟล์ราว 20 MB ซึ่งได้แก่โมเดลและเอนจินที่ใช้รัน จะถูกดาวน์โหลดครั้งเดียวและบันทึกไว้ในเบราว์เซอร์ หลังจากนั้นรูปที่เพิ่มจะถูกอ่านทันที รูปที่เลือกอยู่จะถูกอ่านทันทีที่เปิดหน้า ส่วนรูปอื่นที่อยู่ในรายการอยู่แล้วจะถูกอ่านเมื่อคุณคลิก “อ่าน” หรือ “อ่านทั้งหมด”
- ตรวจข้อความข้างรูป คลิกบริเวณหนึ่งในรูปเพื่อหาบรรทัดของบริเวณนั้น บรรทัดที่โมเดลไม่แน่ใจจะมีเส้นใต้ แก้ไขได้ด้วยการพิมพ์ แล้วคลิก “คัดลอกข้อความ” (Ctrl+Shift+C) หรือ “ดาวน์โหลด .txt”
- ไม่บังคับ: ในส่วน “ซ่อนข้อความในรูป” เลือกสี แล้วดาวน์โหลดสำเนารูปที่ข้อความถูกปิดด้วยกล่อง
ความสามารถ
- โมเดลที่เล็กที่สุด: 6 MB รวมเอนจินราว 20 MB ดาวน์โหลดครั้งเดียวแล้วบันทึกไว้ในเบราว์เซอร์
- อ่านภาพหน้าจอเสร็จในหนึ่งถึงสองวินาทีเมื่อบันทึกโมเดลไว้แล้ว
- อ่านภาษาอังกฤษและภาษาอื่นที่ใช้อักษรละติน ตัวเลข และภาษาจีน
- ข้อความเรียงตามลำดับการอ่าน พร้อมกรอบและหมายเลขของแต่ละบริเวณบนรูป
- แก้ไข คัดลอก หรือดาวน์โหลดข้อความเป็น .txt บรรทัดที่โมเดลไม่แน่ใจจะมีเส้นใต้
- ซ่อนข้อความในรูปและดาวน์โหลดสำเนาที่ปิดข้อความแล้ว
- หลายรูปพร้อมกัน
เป็นส่วนตัวหรือไม่
ใช่ การจดจำข้อความทำงานในเบราว์เซอร์ทั้งหมด รูปและข้อความไม่ออกจากอุปกรณ์ของคุณ และรูปจะอยู่ในเบราว์เซอร์นี้จนกว่าคุณจะนำออกจากรายการ สิ่งเดียวที่ดาวน์โหลดคือโมเดลและเอนจินจากเว็บไซต์นี้ ในครั้งแรกที่ใช้งาน
คำถามที่พบบ่อย
ทำไมครั้งแรกจึงช้ากว่า
เพราะครั้งแรกเบราว์เซอร์ต้องดาวน์โหลดโมเดลจดจำข้อความ (6 MB) และเอนจินที่ใช้รัน (14 MB หรือ 27 MB ในเบราว์เซอร์ที่ใช้การ์ดจอผ่าน WebGPU) แล้วเตรียมให้พร้อม ทั้งสองถูกบันทึกไว้ในเบราว์เซอร์ รูปถัดไปและการเข้าใช้ครั้งหน้าจึงเริ่มได้โดยไม่ต้องดาวน์โหลด เอนจินใช้ร่วมกับเครื่องมือแบบสมดุลและแบบแม่นยำที่สุด การลองใช้เครื่องมือเหล่านั้นภายหลังจึงดาวน์โหลดเพียงโมเดลของตัวเอง
อ่านภาษาอะไรได้บ้าง
อ่านภาษาอังกฤษที่พิมพ์และภาษาอื่นที่เขียนด้วยอักษรละติน (ฝรั่งเศส เยอรมัน สเปน โปรตุเกส อิตาลี โปแลนด์ เช็ก ตุรกี…) ตัวเลขและสัญลักษณ์ และภาษาจีน แต่อ่านภาษาเกาหลี คานะของญี่ปุ่น รัสเซียหรืออักษรซีริลลิกอื่น อาหรับ ไทย ฮินดี หรือเวียดนามไม่ได้ สำหรับภาษาญี่ปุ่น ให้ใช้เครื่องมือแบบสมดุลหรือแบบแม่นยำที่สุด
โมเดลที่เร็วที่สุดแม่นยำแค่ไหน
แม่นยำมากกับข้อความพิมพ์ที่ชัดเจน เช่น ภาพหน้าจอ เอกสาร และป้าย สำหรับตัวอักษรเล็กหรือรูปที่เบลอ เครื่องมือแบบสมดุลและแบบแม่นยำที่สุดอ่านได้ถูกต้องกว่า และบรรทัดที่โมเดลไม่แน่ใจจะมีเส้นใต้ให้คุณตรวจ
เร็วที่สุด สมดุล หรือแม่นยำที่สุด ควรใช้แบบไหน
ใช้แบบเร็วที่สุดเมื่อข้อความชัดเจนและต้องการดาวน์โหลดน้อยที่สุด คือราว 20 MB ในครั้งแรก แบบสมดุล (ราว 43 MB) อ่านรูปถ่ายและข้อความเล็กได้แม่นยำกว่าและอ่านภาษาญี่ปุ่นได้ด้วย แบบแม่นยำที่สุด (ราว 146 MB) อ่านรูปที่ยากที่สุดได้ดีที่สุด แต่ช้าเมื่อไม่มีการเร่งความเร็วด้วยกราฟิก (WebGPU)
จะคืนพื้นที่ที่โมเดลใช้ได้อย่างไร
คลิก “ลบโมเดลที่ดาวน์โหลดไว้” ในส่วน “โมเดลจดจำข้อความ” โมเดลทั้งหมดที่บันทึกไว้จะถูกลบออกจากเบราว์เซอร์นี้ และจะดาวน์โหลดใหม่ในครั้งถัดไปที่อ่านข้อความ