Toolonit
  1. Trang chủ
  2. Hình ảnh
  3. Ảnh sang văn bản (Chính xác nhất)

Chuyển ảnh thành văn bản chính xác cao (OCR)

Trích xuất chữ từ ảnh bằng mô hình OCR lớn nhất — chính xác nhất, dung lượng tải lần đầu lớn hơn.

Thả ảnh có chữ vào đây hoặc nhấp để chọn

Ảnh chụp, bản scan và ảnh chụp màn hình: JPG, PNG, WebP, GIF, BMP, TIFF hoặc AVIF. Đọc tiếng Anh và các ngôn ngữ dùng chữ Latinh khác, tiếng Trung và tiếng Nhật. Không đọc được tiếng Hàn. Tệp được xử lý trong trình duyệt và không bao giờ được tải lên. Ảnh được giữ trong trình duyệt này cho đến khi bạn xóa.

Ctrl+OchọnCtrl+Vdán

Mô hình nhận dạng chữ

Mô hình Chính xác nhất · …

Đọc tiếng Anh và các ngôn ngữ dùng chữ Latinh khác (tiếng Pháp, Đức, Tây Ban Nha, Ba Lan…), tiếng Trung (giản thể và phồn thể) và tiếng Nhật. Không đọc được tiếng Hàn, tiếng Nga hay chữ Kirin khác, tiếng Ả Rập, tiếng Thái, tiếng Hindi hoặc tiếng Việt.

 

Giấy phép: mô hình (Apache-2.0) · bộ máy (MIT)

Khi độ chính xác quan trọng nhất — chữ nhỏ, trang giấy được chụp ảnh, hóa đơn, ảnh tương phản thấp hoặc nền rối — công cụ này dùng mô hình lớn nhất trong ba mô hình nhận dạng. Mô hình 132 MB được tải về một lần và giữ trong trình duyệt. Với tăng tốc đồ họa (WebGPU, có trên hầu hết trình duyệt máy tính hiện nay), một trang dày chữ được đọc trong vài giây; chỉ dùng bộ xử lý thì một trang ngắn mất khoảng nửa phút. Ảnh của bạn không bao giờ rời khỏi thiết bị, miễn phí và không cần đăng ký.

So sánh ba mô hình chuyển ảnh thành văn bản

Ảnh sang văn bản (Nhanh nhất)Ảnh sang văn bản (Cân bằng)Ảnh sang văn bản (Chính xác nhất)Trang này
Dung lượng mô hình6 MB29,7 MB132,3 MB
Lần đầu: tải cùng bộ máy ở tốc độ 50 Mbit/s19,6 MB · ≈ 3 giây43,4 MB · ≈ 7 giây145,9 MB · ≈ 24 giây
Những lần sauLưu trong trình duyệt — không tải lại
Tốc độNhanh nhấtNhanhChậm nhất
Độ chính xácTốt với chữ rõ nétChính xác hơn với ảnh chụp và chữ nhỏTốt nhất với ảnh khó đọc
Đọc đượcchữ Latinh (tiếng Anh, tiếng Pháp, tiếng Đức…) và Tiếng Trungchữ Latinh (tiếng Anh, tiếng Pháp, tiếng Đức…), Tiếng Trung và Tiếng Nhậtchữ Latinh (tiếng Anh, tiếng Pháp, tiếng Đức…), Tiếng Trung và Tiếng Nhật

Bộ máy nhận dạng (13,7 MB, hoặc 27,4 MB trên trình duyệt có WebGPU) chỉ tải một lần và dùng chung cho cả ba. Không có gì được tải cho đến khi bạn yêu cầu công cụ đọc ảnh.

Cách lấy chữ từ ảnh với độ chính xác cao

  1. Thả ảnh vào bất kỳ đâu trên trang, dán ảnh bằng Ctrl+V, hoặc nhấp để chọn tệp. Ảnh bạn đã thêm ở công cụ ảnh khác — chẳng hạn ở trang Cân bằng, để so sánh — đã có sẵn trong danh sách.
  2. Lần đầu tiên, bấm Tải mô hình và đọc chữ. Việc tải về (khoảng 146 MB kèm bộ máy) chỉ diễn ra một lần — bảng tiến độ hiển thị dung lượng, phần trăm và thời gian còn lại — rồi được lưu trong trình duyệt, nên lần sau ảnh đang chọn được đọc ngay khi mở trang, còn các ảnh khác trong danh sách thì đọc bằng Đọc hoặc Đọc tất cả.
  3. Kiểm tra văn bản bên cạnh ảnh: nhấp vào một vùng để tìm dòng tương ứng, nhấp đúp để sửa dòng đó. Những dòng được gạch chân nên xem lại. Sau đó bấm Sao chép văn bản (Ctrl+Shift+C) hoặc Tải xuống .txt.
  4. Để chia sẻ ảnh mà không lộ chữ, tải xuống bản sao đã che ở mục Che chữ trong ảnh — chọn màu và các vùng cần che.

Tính năng

  • Mô hình lớn nhất: 132 MB, khoảng 146 MB kèm bộ máy, tải về một lần rồi lưu trong trình duyệt
  • Đọc chính xác nhất chữ nhỏ, mờ, bị xoay hoặc tương phản thấp
  • Với WebGPU, một trang dày chữ trong vài giây; chỉ dùng bộ xử lý thì khoảng nửa phút cho một trang ngắn
  • Đọc tiếng Anh và các ngôn ngữ dùng chữ Latinh khác, tiếng Trung (giản thể và phồn thể) và tiếng Nhật
  • Văn bản theo thứ tự đọc, các vùng chữ được khoanh và đánh số trên ảnh
  • Sửa, sao chép hoặc tải văn bản xuống dạng .txt, và tải xuống bản sao của ảnh đã che chữ
  • Mọi tệp tải về đều được kiểm tra trước khi dùng, và các tệp đã tải trọn vẹn được giữ lại nếu quá trình tải bị gián đoạn

Có riêng tư không?

Có. Mô hình chạy trong trình duyệt; ảnh và văn bản nhận dạng được không bao giờ bị tải lên, và ảnh ở lại trình duyệt này cho đến khi bạn xóa khỏi danh sách. Nhờ vậy công cụ phù hợp với hóa đơn, giấy tờ tùy thân, hợp đồng và những tài liệu khác mà bạn không muốn gửi lên dịch vụ trực tuyến.

Câu hỏi thường gặp

Công cụ này khác hai công cụ còn lại thế nào?

Nó đọc đúng hơn chữ nhỏ, mờ, bị xoay hoặc tương phản thấp, vì dùng mô hình nhận dạng lớn nhất. Cái giá là dung lượng tải về một lần lớn hơn (mô hình 132 MB, so với 6 MB và 30 MB) và đọc chậm hơn khi trình duyệt không có tăng tốc đồ họa: khoảng nửa phút cho một trang ngắn và vài phút cho một trang dày chữ, lâu hơn nữa trên điện thoại. Với ảnh chụp màn hình rõ nét, Nhanh nhất hoặc Cân bằng là đủ.

Tôi có phải tải về mỗi lần không?

Không. Mô hình và bộ máy của nó (14 MB, hoặc 27 MB với WebGPU, dùng chung với hai công cụ kia) được tải về một lần và lưu trong trình duyệt, và mọi tệp đều được kiểm tra trước khi dùng. Lần sau công cụ khởi động mà không cần tải gì. Xóa các mô hình đã tải giúp giải phóng dung lượng bất cứ lúc nào bạn muốn.

Công cụ đọc được những ngôn ngữ nào?

Chữ in tiếng Anh và các ngôn ngữ khác dùng chữ Latinh (tiếng Pháp, Đức, Tây Ban Nha, Bồ Đào Nha, Ý, Ba Lan, Séc, Thổ Nhĩ Kỳ…), chữ số và ký hiệu, tiếng Trung (giản thể và phồn thể) và tiếng Nhật (kanji, hiragana và katakana). Công cụ không đọc được tiếng Hàn, tiếng Nga hay chữ Kirin khác, tiếng Ả Rập, tiếng Thái, tiếng Hindi hoặc tiếng Việt.

Có đọc được trang bị lộn ngược hoặc chụp nghiêng không?

Được. Trang bị lộn ngược được phát hiện và đọc đúng chiều, và các dòng của ảnh chụp hơi nghiêng được làm thẳng trước khi sắp xếp theo thứ tự đọc, nên không bị lẫn lộn. Chữ tiếng Trung và tiếng Nhật viết dọc được đọc theo cột từ phải sang trái.

Nếu quá trình tải bị gián đoạn thì sao?

Chỉ cần thử lại: bảng tiến độ cho biết lỗi gì đã xảy ra và có nút Thử lại. Những tệp đã tải trọn vẹn và vượt qua kiểm tra được giữ lại, nên lần thử lại chỉ tải phần còn lại; không có tệp tải dở nào được sử dụng.

Công cụ liên quan