Toolonit
  1. หน้าแรก
  2. รูปภาพ
  3. แปลงรูปเป็นข้อความ (แม่นยำที่สุด)

แปลงรูปเป็นข้อความแบบแม่นยำสูง (OCR)

ดึงข้อความจากรูปด้วยโมเดล OCR ที่ใหญ่ที่สุด แม่นยำที่สุด แต่ดาวน์โหลดครั้งแรกใหญ่กว่า

ลากรูปที่มีข้อความมาวางที่นี่หรือคลิกเพื่อเลือก

รูปถ่าย ภาพสแกน และภาพหน้าจอ: JPG, PNG, WebP, GIF, BMP, TIFF หรือ AVIF อ่านภาษาอังกฤษและภาษาอื่นที่ใช้อักษรละติน ภาษาจีน และภาษาญี่ปุ่น แต่อ่านภาษาเกาหลีไม่ได้ ไฟล์ถูกประมวลผลในเบราว์เซอร์และไม่ถูกอัปโหลด รูปจะอยู่ในเบราว์เซอร์นี้จนกว่าคุณจะนำออก

Ctrl+OเลือกCtrl+Vวาง

โมเดลจดจำข้อความ

โมเดลแบบแม่นยำที่สุด · …

อ่านภาษาอังกฤษและภาษาอื่นที่ใช้อักษรละติน (ฝรั่งเศส เยอรมัน สเปน โปแลนด์…) ภาษาจีน (ตัวย่อและตัวเต็ม) และภาษาญี่ปุ่น แต่อ่านภาษาเกาหลี รัสเซียหรืออักษรซีริลลิกอื่น อาหรับ ไทย ฮินดี หรือเวียดนามไม่ได้

 

สัญญาอนุญาต: โมเดล (Apache-2.0) · เอนจิน (MIT)

เมื่อความแม่นยำสำคัญที่สุด เช่น ตัวอักษรเล็ก หน้าเอกสารที่ถ่ายรูปมา ใบเสร็จ รูปที่คอนทราสต์ต่ำหรือรก เครื่องมือนี้ใช้โมเดลจดจำข้อความที่ใหญ่ที่สุดในสามแบบ โมเดลขนาด 132 MB ดาวน์โหลดครั้งเดียวแล้วเก็บไว้ในเบราว์เซอร์ เมื่อมีการเร่งความเร็วด้วยกราฟิก (WebGPU ซึ่งมีในเบราว์เซอร์เดสก์ท็อปรุ่นปัจจุบันส่วนใหญ่) หน้าที่มีข้อความแน่นจะอ่านเสร็จในไม่กี่วินาที หากใช้เพียงโปรเซสเซอร์ หน้าสั้น ๆ ใช้เวลาราวครึ่งนาที รูปของคุณไม่ออกจากอุปกรณ์ ใช้ฟรีและไม่ต้องสมัครสมาชิก

เปรียบเทียบโมเดลแปลงรูปภาพเป็นข้อความทั้งสาม

แปลงรูปเป็นข้อความ (เร็วที่สุด)แปลงรูปเป็นข้อความ (สมดุล)แปลงรูปเป็นข้อความ (แม่นยำที่สุด)หน้านี้
ขนาดโมเดล6 MB29.7 MB132.3 MB
ใช้ครั้งแรก: ดาวน์โหลดพร้อมเอนจินที่ 50 Mbit/s19.6 MB · ≈ 3 วิ43.4 MB · ≈ 7 วิ145.9 MB · ≈ 24 วิ
ครั้งต่อไปเก็บไว้ในเบราว์เซอร์ — ไม่ต้องดาวน์โหลดซ้ำ
ความเร็วเร็วที่สุดเร็วช้าที่สุด
ความแม่นยำดีกับข้อความที่คมชัดแม่นยำกว่ากับภาพถ่ายและตัวอักษรเล็กดีที่สุดกับภาพที่อ่านยาก
อ่านได้อักษรละติน (อังกฤษ ฝรั่งเศส เยอรมัน…)และจีนอักษรละติน (อังกฤษ ฝรั่งเศส เยอรมัน…) จีน และญี่ปุ่นอักษรละติน (อังกฤษ ฝรั่งเศส เยอรมัน…) จีน และญี่ปุ่น

เอนจินจดจำข้อความ (13.7 MB หรือ 27.4 MB ในเบราว์เซอร์ที่มี WebGPU) ดาวน์โหลดเพียงครั้งเดียวและใช้ร่วมกันทั้งสามโมเดล จะไม่มีการดาวน์โหลดใดๆ จนกว่าคุณจะให้เครื่องมืออ่านรูปภาพ

วิธีดึงข้อความจากรูปอย่างแม่นยำสูง

  1. ลากรูปมาวางที่ใดก็ได้บนหน้า วางด้วย Ctrl+V หรือคลิกเพื่อเลือกไฟล์ รูปที่เพิ่มไว้แล้วในเครื่องมือรูปภาพอื่น เช่น ในหน้าสมดุลเพื่อเปรียบเทียบ จะอยู่ในรายการแล้ว
  2. ครั้งแรกให้คลิก “ดาวน์โหลดโมเดลและอ่านข้อความ” การดาวน์โหลด (ราว 146 MB รวมเอนจิน) เกิดขึ้นครั้งเดียว โดยแผงความคืบหน้าจะแสดงขนาด เปอร์เซ็นต์ และเวลาที่เหลือ จากนั้นจะถูกบันทึกไว้ในเบราว์เซอร์ ครั้งต่อไปรูปที่เลือกอยู่จึงถูกอ่านทันทีที่เปิดหน้า ส่วนรูปอื่นในรายการอ่านได้ด้วย “อ่าน” หรือ “อ่านทั้งหมด”
  3. ตรวจข้อความข้างรูป คลิกบริเวณหนึ่งเพื่อหาบรรทัดของบริเวณนั้น และดับเบิลคลิกเพื่อแก้บรรทัดนั้น บรรทัดที่มีเส้นใต้ควรตรวจซ้ำ จากนั้นคลิก “คัดลอกข้อความ” (Ctrl+Shift+C) หรือ “ดาวน์โหลด .txt”
  4. หากจะแชร์รูปโดยไม่มีข้อความ ให้ดาวน์โหลดสำเนาที่ปิดข้อความในส่วน “ซ่อนข้อความในรูป” โดยเลือกสีและบริเวณที่จะปิด

ความสามารถ

  • โมเดลที่ใหญ่ที่สุด: 132 MB รวมเอนจินราว 146 MB ดาวน์โหลดครั้งเดียวแล้วบันทึกไว้ในเบราว์เซอร์
  • อ่านข้อความที่เล็ก เบลอ หมุนเอียง หรือคอนทราสต์ต่ำได้แม่นยำที่สุด
  • เมื่อมี WebGPU อ่านหน้าที่มีข้อความแน่นได้ในไม่กี่วินาที หากใช้เพียงโปรเซสเซอร์ หน้าสั้น ๆ ใช้เวลาราวครึ่งนาที
  • อ่านภาษาอังกฤษและภาษาอื่นที่ใช้อักษรละติน ภาษาจีน (ตัวย่อและตัวเต็ม) และภาษาญี่ปุ่น
  • ข้อความเรียงตามลำดับการอ่าน พร้อมกรอบและหมายเลขของแต่ละบริเวณบนรูป
  • แก้ไข คัดลอก หรือดาวน์โหลดข้อความเป็น .txt และดาวน์โหลดสำเนารูปที่ซ่อนข้อความแล้ว
  • ทุกไฟล์ที่ดาวน์โหลดจะถูกตรวจสอบก่อนใช้ และไฟล์ที่มาถึงครบแล้วจะถูกเก็บไว้หากการดาวน์โหลดถูกขัดจังหวะ

เป็นส่วนตัวหรือไม่

ใช่ โมเดลทำงานในเบราว์เซอร์ของคุณ รูปและข้อความที่จดจำได้ไม่เคยถูกอัปโหลด และรูปจะอยู่ในเบราว์เซอร์นี้จนกว่าคุณจะนำออกจากรายการ จึงเหมาะกับใบเสร็จ บัตรประจำตัว สัญญา และเอกสารอื่นที่คุณไม่อยากส่งให้บริการออนไลน์

คำถามที่พบบ่อย

ต่างจากอีกสองเครื่องมืออย่างไร

อ่านข้อความที่เล็ก เบลอ หมุนเอียง หรือคอนทราสต์ต่ำได้ถูกต้องกว่า เพราะใช้โมเดลจดจำข้อความที่ใหญ่ที่สุด แลกกับการดาวน์โหลดครั้งแรกที่ใหญ่กว่า (โมเดล 132 MB เทียบกับ 6 MB และ 30 MB) และอ่านช้ากว่าในเบราว์เซอร์ที่ไม่มีการเร่งความเร็วด้วยกราฟิก คือราวครึ่งนาทีสำหรับหน้าสั้น ๆ และหลายนาทีสำหรับหน้าที่มีข้อความแน่น บนโทรศัพท์จะนานกว่านั้น สำหรับภาพหน้าจอที่ชัดเจน แบบเร็วที่สุดหรือแบบสมดุลก็เพียงพอ

ต้องดาวน์โหลดทุกครั้งไหม

ไม่ต้อง โมเดลและเอนจิน (14 MB หรือ 27 MB เมื่อใช้ WebGPU ซึ่งใช้ร่วมกับอีกสองเครื่องมือ) ดาวน์โหลดครั้งเดียวและบันทึกไว้ในเบราว์เซอร์ และทุกไฟล์จะถูกตรวจสอบก่อนใช้ ครั้งถัดไปเครื่องมือจะเริ่มได้โดยไม่ต้องดาวน์โหลด และ “ลบโมเดลที่ดาวน์โหลดไว้” จะคืนพื้นที่ได้ทุกเมื่อที่ต้องการ

อ่านภาษาอะไรได้บ้าง

อ่านภาษาอังกฤษที่พิมพ์และภาษาอื่นที่ใช้อักษรละติน (ฝรั่งเศส เยอรมัน สเปน โปรตุเกส อิตาลี โปแลนด์ เช็ก ตุรกี…) ตัวเลขและสัญลักษณ์ ภาษาจีน (ตัวย่อและตัวเต็ม) และภาษาญี่ปุ่น (คันจิ ฮิรางานะ และคาตากานะ) แต่อ่านภาษาเกาหลี รัสเซียหรืออักษรซีริลลิกอื่น อาหรับ ไทย ฮินดี หรือเวียดนามไม่ได้

อ่านหน้าที่กลับหัวหรือถ่ายเอียงได้ไหม

ได้ หน้าที่กลับหัวจะถูกตรวจพบและอ่านให้ถูกทิศ และบรรทัดของรูปที่เอียงเล็กน้อยจะถูกปรับให้ตรงก่อนเรียงตามลำดับการอ่าน จึงไม่ปนกัน ข้อความภาษาจีนและญี่ปุ่นแนวตั้งจะอ่านเป็นคอลัมน์จากขวาไปซ้าย

ถ้าการดาวน์โหลดถูกขัดจังหวะจะทำอย่างไร

ลองใหม่ได้เลย แผงความคืบหน้าจะบอกว่าเกิดอะไรขึ้นและมีปุ่ม “ลองอีกครั้ง” ไฟล์ที่มาถึงครบและผ่านการตรวจสอบแล้วจะถูกเก็บไว้ การลองใหม่จึงดาวน์โหลดเฉพาะส่วนที่เหลือ และไม่มีการใช้ไฟล์ที่ดาวน์โหลดมาไม่ครบเลย

เครื่องมือที่เกี่ยวข้อง