Toolonit
  1. Beranda
  2. Gambar
  3. Gambar ke Teks (Seimbang)

Ubah Gambar ke Teks (OCR)

Ambil teks dari gambar dengan model OCR berukuran sedang — seimbang antara kecepatan dan akurasi.

Letakkan gambar berisi teks di sini atau klik untuk memilih

Foto, hasil pindaian, dan tangkapan layar: JPG, PNG, WebP, GIF, BMP, TIFF, atau AVIF. Membaca bahasa Inggris dan bahasa lain beraksara Latin, Mandarin, serta Jepang. Tidak bisa membaca bahasa Korea. File diproses di browser Anda dan tidak pernah diunggah. Gambar tetap ada di browser ini sampai Anda menghapusnya.

Ctrl+OpilihCtrl+Vtempel

Model pengenalan teks

Model Seimbang · …

Membaca bahasa Inggris dan bahasa lain beraksara Latin (Prancis, Jerman, Spanyol, Polandia…), Mandarin (sederhana dan tradisional), serta Jepang. Tidak bisa membaca bahasa Korea, Rusia atau aksara Sirilik lainnya, Arab, Thai, Hindi, maupun Vietnam.

 

Lisensi: model (Apache-2.0) · mesin (MIT)

Salin teks dari foto dokumen, halaman hasil pindaian, atau tangkapan layar, lalu edit dan simpan. Ini adalah pilihan sehari-hari di antara tiga alat Gambar ke Teks: model pengenalannya yang berukuran 30 MB membaca tulisan kecil, foto yang diambil miring, dan latar yang ramai dengan jauh lebih baik daripada model tercepat, dan tetap membaca tangkapan layar dalam hitungan detik. Semuanya berjalan di browser Anda: gambar tidak pernah keluar dari perangkat, gratis, dan tanpa perlu mendaftar.

Perbandingan tiga model gambar ke teks

Gambar ke Teks (Tercepat)Gambar ke Teks (Seimbang)Halaman iniGambar ke Teks (Paling Akurat)
Unduhan model6 MB29,7 MB132,3 MB
Pemakaian pertama: unduhan bersama mesin pada 50 Mbit/s19,6 MB · ≈ 3 dtk43,4 MB · ≈ 7 dtk145,9 MB · ≈ 24 dtk
SetelahnyaDisimpan di browser — tidak diunduh lagi
KecepatanTercepatCepatPaling lambat
AkurasiBaik untuk teks yang jelasLebih baik untuk foto dan huruf kecilTerbaik untuk gambar yang sulit
Membacaalfabet Latin (Inggris, Indonesia, Prancis…) dan Tionghoaalfabet Latin (Inggris, Indonesia, Prancis…), Tionghoa, dan Jepangalfabet Latin (Inggris, Indonesia, Prancis…), Tionghoa, dan Jepang

Mesin pengenal (13,7 MB, atau 27,4 MB di browser dengan WebGPU) diunduh sekali saja dan dipakai bersama oleh ketiganya. Tidak ada yang diunduh sampai Anda meminta alat membaca gambar.

Cara mengambil teks dari gambar

  1. Letakkan gambar di mana saja di halaman, tempel dengan Ctrl+V, atau klik untuk memilih file — beberapa sekaligus juga bisa. Gambar yang sudah ditambahkan di alat gambar mana pun, termasuk halaman Tercepat dan Paling Akurat, menunggu di daftar.
  2. Pertama kali, klik Unduh model & baca teks. Model (30 MB) dan mesin yang menjalankannya — sekitar 43 MB totalnya — diunduh sekali dan disimpan di browser Anda, jadi berikutnya gambar yang Anda tambahkan langsung dibaca, gambar yang dipilih begitu halaman dibuka, dan gambar lain yang sudah ada di daftar dengan Baca atau Baca semua.
  3. Bandingkan teks dengan gambarnya: klik sebuah area untuk menemukan barisnya, atau sebuah baris untuk menemukan areanya. Baris bergaris bawah adalah yang kurang diyakini model. Edit, lalu Salin teks (Ctrl+Shift+C) atau Unduh .txt.
  4. Untuk membagikan gambar tanpa teksnya, buka Sembunyikan teks di gambar, pilih warna, biarkan terlihat area yang ingin dipertahankan, lalu unduh salinan yang sudah ditutup.

Fitur

  • Membaca teks cetak bahasa Inggris dan bahasa lain beraksara Latin, Mandarin (sederhana dan tradisional), serta Jepang
  • Teks sesuai urutan baca: kolom satu per satu, item struk di samping harganya
  • Area teks diberi garis tepi dan nomor di gambar; klik sebuah area untuk menemukan barisnya
  • Edit teks, lalu salin atau unduh sebagai .txt; baris yang kurang diyakini model diberi garis bawah
  • Sembunyikan teks: unduh salinan gambar dengan teks yang tertutup kotak
  • Beberapa gambar sekaligus; halaman yang terbalik dikenali dan dibaca dengan arah yang benar
  • Satu kali unduhan sekitar 43 MB (model 30 MB dan mesinnya), lalu disimpan di browser Anda

Apakah privasi terjaga?

Ya. Gambar dibaca oleh model yang berjalan di browser Anda; baik gambar maupun teksnya tidak dikirim ke mana pun, dan gambar Anda tetap ada di browser ini sampai Anda menghapusnya dari daftar. Hanya model dan mesinnya yang diunduh, sekali, dari situs ini, dan keduanya tetap tersimpan di browser Anda.

Pertanyaan umum

Bahasa apa saja yang dibaca?

Teks cetak bahasa Inggris dan bahasa lain beraksara Latin (Prancis, Jerman, Spanyol, Portugis, Italia, Polandia, Ceko, Turki…), angka dan simbol, Mandarin (sederhana dan tradisional), serta Jepang (kanji, hiragana, dan katakana). Alat ini tidak bisa membaca bahasa Korea, Rusia atau aksara Sirilik lainnya, Arab, Thai, Hindi, maupun Vietnam.

Mengapa proses pertama lebih lambat?

Karena hanya pada kali pertama, browser mengunduh model dan mesin yang menjalankannya (14 MB, atau 27 MB di browser yang memakai kartu grafis lewat WebGPU) lalu menyiapkannya. Setelah itu keduanya tersimpan, jadi pembacaan dimulai tanpa unduhan, dan halaman yang sudah terbuka tetap berfungsi tanpa koneksi. Jika Anda sudah memakai alat Gambar ke Teks lainnya, mesinnya sudah ada dan hanya modelnya yang diunduh.

Tercepat, Seimbang, atau Paling Akurat — mana yang sebaiknya dipakai?

Seimbang cocok untuk sebagian besar gambar. Tercepat (model 6 MB, sekitar 20 MB untuk diunduh pada kali pertama) sudah cukup untuk tangkapan layar dan dokumen yang jelas dalam bahasa Inggris atau Mandarin. Seimbang (30 MB, sekitar 43 MB) lebih akurat pada foto dan teks kecil dan juga membaca bahasa Jepang. Paling Akurat (132 MB, sekitar 146 MB) paling baik membaca gambar tersulit, tetapi tanpa akselerasi grafis (WebGPU) butuh sekitar setengah menit untuk satu halaman pendek. Masing-masing diunduh sekali lalu disimpan di browser Anda.

Apakah tata letak halaman dipertahankan?

Yang dipertahankan adalah urutan bacanya, bukan tata letak persisnya: potongan teks pada baris yang sama digabungkan, setiap baris menjadi satu baris teks, dan baris kosong memisahkan paragraf. Kolom yang bersebelahan dibaca satu per satu, dan tabel dihasilkan sebagai teks sesuai urutan baca, bukan sebagai spreadsheet.

Bisakah saya membaca beberapa gambar sekaligus?

Bisa. Tambahkan sebanyak yang Anda mau; masing-masing dibaca bergiliran. Salin semua gambar menyalin setiap teks di bawah nama filenya, dan Unduh semua (ZIP) menyimpan salinan yang sudah ditutup.

Alat terkait