Chuyển ảnh thành văn bản (OCR)
Trích xuất chữ từ ảnh bằng mô hình OCR cỡ vừa — cân bằng giữa tốc độ và độ chính xác.
Thả ảnh có chữ vào đây hoặc nhấp để chọn
Ảnh chụp, bản scan và ảnh chụp màn hình: JPG, PNG, WebP, GIF, BMP, TIFF hoặc AVIF. Đọc tiếng Anh và các ngôn ngữ dùng chữ Latinh khác, tiếng Trung và tiếng Nhật. Không đọc được tiếng Hàn. Tệp được xử lý trong trình duyệt và không bao giờ được tải lên. Ảnh được giữ trong trình duyệt này cho đến khi bạn xóa.
Ctrl+OchọnCtrl+Vdán
Mô hình nhận dạng chữ
Mô hình Cân bằng · …
Đọc tiếng Anh và các ngôn ngữ dùng chữ Latinh khác (tiếng Pháp, Đức, Tây Ban Nha, Ba Lan…), tiếng Trung (giản thể và phồn thể) và tiếng Nhật. Không đọc được tiếng Hàn, tiếng Nga hay chữ Kirin khác, tiếng Ả Rập, tiếng Thái, tiếng Hindi hoặc tiếng Việt.
Giấy phép: mô hình (Apache-2.0) · bộ máy (MIT)
Sao chép chữ từ ảnh chụp tài liệu, trang scan hay ảnh chụp màn hình, rồi chỉnh sửa và lưu lại. Đây là lựa chọn hằng ngày trong ba công cụ Ảnh sang văn bản: mô hình nhận dạng 30 MB đọc chữ nhỏ, ảnh chụp nghiêng và nền rối tốt hơn hẳn mô hình nhanh nhất, mà vẫn đọc một ảnh chụp màn hình chỉ trong vài giây. Mọi thứ chạy trong trình duyệt: ảnh của bạn không bao giờ rời khỏi thiết bị, miễn phí và không cần đăng ký.
So sánh ba mô hình chuyển ảnh thành văn bản
| Ảnh sang văn bản (Nhanh nhất) | Ảnh sang văn bản (Cân bằng)Trang này | Ảnh sang văn bản (Chính xác nhất) | |
|---|---|---|---|
| Dung lượng mô hình | 6 MB | 29,7 MB | 132,3 MB |
| Lần đầu: tải cùng bộ máy ở tốc độ 50 Mbit/s | 19,6 MB · ≈ 3 giây | 43,4 MB · ≈ 7 giây | 145,9 MB · ≈ 24 giây |
| Những lần sau | Lưu trong trình duyệt — không tải lại | ||
| Tốc độ | Nhanh nhất | Nhanh | Chậm nhất |
| Độ chính xác | Tốt với chữ rõ nét | Chính xác hơn với ảnh chụp và chữ nhỏ | Tốt nhất với ảnh khó đọc |
| Đọc được | chữ Latinh (tiếng Anh, tiếng Pháp, tiếng Đức…) và Tiếng Trung | chữ Latinh (tiếng Anh, tiếng Pháp, tiếng Đức…), Tiếng Trung và Tiếng Nhật | chữ Latinh (tiếng Anh, tiếng Pháp, tiếng Đức…), Tiếng Trung và Tiếng Nhật |
Bộ máy nhận dạng (13,7 MB, hoặc 27,4 MB trên trình duyệt có WebGPU) chỉ tải một lần và dùng chung cho cả ba. Không có gì được tải cho đến khi bạn yêu cầu công cụ đọc ảnh.
Cách lấy chữ từ ảnh
- Thả ảnh vào bất kỳ đâu trên trang, dán ảnh bằng Ctrl+V, hoặc nhấp để chọn tệp — nhiều ảnh cùng lúc cũng được. Ảnh đã thêm ở bất kỳ công cụ ảnh nào, kể cả các trang Nhanh nhất và Chính xác nhất, đang chờ trong danh sách.
- Lần đầu tiên, bấm Tải mô hình và đọc chữ. Mô hình (30 MB) và bộ máy chạy nó — tổng cộng khoảng 43 MB — được tải về một lần và giữ trong trình duyệt, nên về sau ảnh bạn thêm được đọc ngay, ảnh đang chọn được đọc ngay khi mở trang, còn các ảnh khác đã có trong danh sách thì đọc bằng Đọc hoặc Đọc tất cả.
- So sánh văn bản với ảnh: nhấp vào một vùng để tìm dòng tương ứng, hoặc nhấp vào một dòng để tìm vùng của nó. Những dòng được gạch chân là dòng mô hình không chắc chắn. Chỉnh sửa, rồi bấm Sao chép văn bản (Ctrl+Shift+C) hoặc Tải xuống .txt.
- Để chia sẻ ảnh mà không lộ chữ, mở mục Che chữ trong ảnh, chọn một màu, để lộ những vùng bạn muốn giữ, rồi tải xuống bản sao đã che.
Tính năng
- Đọc chữ in tiếng Anh và các ngôn ngữ dùng chữ Latinh khác, tiếng Trung (giản thể và phồn thể) và tiếng Nhật
- Văn bản theo thứ tự đọc: các cột lần lượt nối tiếp nhau, các món trên hóa đơn nằm cạnh giá tiền
- Các vùng chữ được khoanh và đánh số trên ảnh; nhấp vào một vùng để tìm dòng tương ứng
- Chỉnh sửa văn bản, rồi sao chép hoặc tải xuống dạng .txt; những dòng mô hình không chắc chắn được gạch chân
- Che chữ: tải xuống bản sao của ảnh với phần chữ bị che bằng các ô màu
- Nhiều ảnh cùng lúc; trang bị lộn ngược được phát hiện và đọc đúng chiều
- Tải về một lần khoảng 43 MB (mô hình 30 MB và bộ máy của nó), rồi lưu trong trình duyệt
Có riêng tư không?
Có. Ảnh được đọc bởi một mô hình chạy trong trình duyệt; cả ảnh lẫn văn bản đều không được gửi đi đâu, và ảnh của bạn ở lại trình duyệt này cho đến khi bạn xóa khỏi danh sách. Chỉ có mô hình và bộ máy của nó được tải về, một lần, từ chính trang này, và chúng được lưu lại trong trình duyệt.
Câu hỏi thường gặp
Công cụ đọc được những ngôn ngữ nào?
Chữ in tiếng Anh và các ngôn ngữ khác dùng chữ Latinh (tiếng Pháp, Đức, Tây Ban Nha, Bồ Đào Nha, Ý, Ba Lan, Séc, Thổ Nhĩ Kỳ…), chữ số và ký hiệu, tiếng Trung (giản thể và phồn thể) và tiếng Nhật (kanji, hiragana và katakana). Công cụ không đọc được tiếng Hàn, tiếng Nga hay chữ Kirin khác, tiếng Ả Rập, tiếng Thái, tiếng Hindi hoặc tiếng Việt.
Vì sao lần chạy đầu tiên chậm hơn?
Vì chỉ lần đầu tiên, trình duyệt mới tải về mô hình và bộ máy chạy nó (14 MB, hoặc 27 MB trên trình duyệt dùng card đồ họa qua WebGPU) rồi chuẩn bị chúng. Sau đó chúng được lưu lại, nên việc đọc bắt đầu mà không cần tải gì, và trang đang mở vẫn hoạt động khi mất kết nối. Nếu bạn đã dùng một công cụ Ảnh sang văn bản khác, bộ máy đã có sẵn và chỉ mô hình được tải về.
Nhanh nhất, Cân bằng hay Chính xác nhất — nên dùng cái nào?
Cân bằng phù hợp với hầu hết ảnh. Nhanh nhất (mô hình 6 MB, khoảng 20 MB tải về lần đầu) là đủ cho ảnh chụp màn hình và tài liệu rõ nét bằng tiếng Anh hoặc tiếng Trung. Cân bằng (30 MB, khoảng 43 MB) chính xác hơn với ảnh chụp và chữ nhỏ và đọc được cả tiếng Nhật. Chính xác nhất (132 MB, khoảng 146 MB) đọc tốt nhất những ảnh khó nhất, nhưng không có tăng tốc đồ họa (WebGPU) thì cần khoảng nửa phút cho một trang ngắn. Mỗi mô hình được tải về một lần rồi lưu trong trình duyệt.
Công cụ có giữ bố cục của trang không?
Công cụ giữ thứ tự đọc, không giữ đúng bố cục: các đoạn chữ trên cùng một hàng được nối lại, mỗi hàng là một dòng, và một dòng trống ngăn cách các đoạn văn. Các cột đặt cạnh nhau được đọc lần lượt, và bảng được xuất thành văn bản theo thứ tự đọc, không phải bảng tính.
Có đọc nhiều ảnh cùng lúc được không?
Được. Thêm bao nhiêu ảnh tùy thích; từng ảnh sẽ được đọc lần lượt. Sao chép tất cả ảnh sao chép mọi văn bản kèm tên tệp của nó, và Tải tất cả (ZIP) lưu các bản sao đã che.