Gambar ke Teks Cepat (OCR)
Ambil teks dari gambar dengan model OCR terkecil — paling cepat diunduh dan dijalankan.
Letakkan gambar berisi teks di sini atau klik untuk memilih
Foto, hasil pindaian, dan tangkapan layar: JPG, PNG, WebP, GIF, BMP, TIFF, atau AVIF. Membaca bahasa Inggris dan bahasa lain beraksara Latin, serta Mandarin. Tidak bisa membaca bahasa Korea atau kana Jepang. File diproses di browser Anda dan tidak pernah diunggah. Gambar tetap ada di browser ini sampai Anda menghapusnya.
Ctrl+OpilihCtrl+Vtempel
Model pengenalan teks
Model Tercepat · …
Membaca bahasa Inggris dan bahasa lain beraksara Latin (Prancis, Jerman, Spanyol, Polandia…) serta Mandarin. Tidak bisa membaca bahasa Korea, kana Jepang, Rusia atau aksara Sirilik lainnya, Arab, Thai, Hindi, maupun Vietnam.
Lisensi: model (Apache-2.0) · mesin (MIT)
Ubah tangkapan layar, foto, atau halaman hasil pindaian menjadi teks yang bisa disalin dan diedit — dengan cepat. Ini adalah yang paling ringan di antara tiga alat Gambar ke Teks: model pengenalannya hanya 6 MB, jadi awal pertama tetap cepat bahkan di ponsel, dan setelah itu tangkapan layar terbaca dalam satu atau dua detik. Semuanya berjalan di browser Anda: gambar tidak pernah keluar dari perangkat, gratis, dan tanpa perlu mendaftar.
Perbandingan tiga model gambar ke teks
| Gambar ke Teks (Tercepat)Halaman ini | Gambar ke Teks (Seimbang) | Gambar ke Teks (Paling Akurat) | |
|---|---|---|---|
| Unduhan model | 6 MB | 29,7 MB | 132,3 MB |
| Pemakaian pertama: unduhan bersama mesin pada 50 Mbit/s | 19,6 MB · ≈ 3 dtk | 43,4 MB · ≈ 7 dtk | 145,9 MB · ≈ 24 dtk |
| Setelahnya | Disimpan di browser — tidak diunduh lagi | ||
| Kecepatan | Tercepat | Cepat | Paling lambat |
| Akurasi | Baik untuk teks yang jelas | Lebih baik untuk foto dan huruf kecil | Terbaik untuk gambar yang sulit |
| Membaca | alfabet Latin (Inggris, Indonesia, Prancis…) dan Tionghoa | alfabet Latin (Inggris, Indonesia, Prancis…), Tionghoa, dan Jepang | alfabet Latin (Inggris, Indonesia, Prancis…), Tionghoa, dan Jepang |
Mesin pengenal (13,7 MB, atau 27,4 MB di browser dengan WebGPU) diunduh sekali saja dan dipakai bersama oleh ketiganya. Tidak ada yang diunduh sampai Anda meminta alat membaca gambar.
Cara mengubah gambar menjadi teks dengan cepat
- Letakkan satu atau beberapa gambar di mana saja di halaman, tempel tangkapan layar dengan Ctrl+V, atau klik untuk memilih file. Gambar yang Anda tambahkan di alat gambar lain sudah ada di daftar, dan contoh struk menunjukkan cara kerjanya.
- Pertama kali, klik Unduh model & baca teks. Sekitar 20 MB — model dan mesin yang menjalankannya — diunduh sekali dan disimpan di browser Anda; sejak itu, gambar yang Anda tambahkan langsung dibaca, gambar yang dipilih begitu halaman dibuka, dan gambar lain yang sudah ada di daftar saat Anda mengeklik Baca atau Baca semua.
- Periksa teks di samping gambar. Klik sebuah area di gambar untuk menemukan barisnya; baris yang kurang diyakini model diberi garis bawah. Perbaiki dengan mengetik, lalu klik Salin teks (Ctrl+Shift+C) atau Unduh .txt.
- Opsional: di bawah Sembunyikan teks di gambar, pilih warna lalu unduh salinan gambar dengan teks yang tertutup kotak.
Fitur
- Model terkecil: 6 MB, sekitar 20 MB bersama mesinnya, diunduh sekali lalu disimpan di browser Anda
- Tangkapan layar terbaca dalam satu atau dua detik setelah model tersimpan
- Membaca bahasa Inggris dan bahasa lain beraksara Latin, angka, serta Mandarin
- Teks sesuai urutan baca, dengan area yang diberi garis tepi dan nomor di gambar
- Edit, salin, atau unduh teks sebagai .txt; baris yang kurang diyakini model diberi garis bawah
- Sembunyikan teks di gambar dan unduh salinan yang sudah ditutup
- Beberapa gambar sekaligus
Apakah privasi terjaga?
Ya. Pengenalan teks berjalan sepenuhnya di browser Anda; gambar dan teksnya tidak pernah keluar dari perangkat, dan gambar tetap ada di browser ini sampai Anda menghapusnya dari daftar. Satu-satunya unduhan adalah model dan mesinnya, dari situs ini, saat pertama kali Anda memakainya.
Pertanyaan umum
Mengapa proses pertama lebih lambat?
Karena pada kali pertama, browser Anda mengunduh model pengenalan (6 MB) dan mesin yang menjalankannya (14 MB, atau 27 MB di browser yang memakai kartu grafis lewat WebGPU), lalu menyiapkannya. Keduanya disimpan di browser, jadi gambar berikutnya dan kunjungan Anda selanjutnya dimulai tanpa unduhan. Mesinnya dipakai bersama oleh alat Seimbang dan Paling Akurat, jadi jika Anda mencobanya nanti, hanya modelnya yang diunduh.
Bahasa apa saja yang bisa dibaca?
Teks cetak bahasa Inggris dan bahasa lain yang ditulis dengan alfabet Latin (Prancis, Jerman, Spanyol, Portugis, Italia, Polandia, Ceko, Turki…), angka dan simbol, serta Mandarin. Alat ini tidak bisa membaca bahasa Korea, kana Jepang, Rusia atau aksara Sirilik lainnya, Arab, Thai, Hindi, maupun Vietnam; untuk bahasa Jepang, gunakan alat Seimbang atau Paling Akurat.
Seberapa akurat model tercepat ini?
Sangat baik pada teks cetak yang jelas seperti tangkapan layar, dokumen, dan papan tanda. Untuk tulisan kecil atau foto yang buram, alat Seimbang dan Paling Akurat membaca dengan lebih tepat, dan baris yang kurang diyakini model diberi garis bawah agar bisa Anda periksa.
Tercepat, Seimbang, atau Paling Akurat — mana yang sebaiknya dipakai?
Tercepat, jika teksnya jelas dan Anda ingin unduhan terkecil: sekitar 20 MB pada kali pertama. Seimbang (sekitar 43 MB) membaca foto dan teks kecil dengan lebih akurat dan juga bisa membaca bahasa Jepang; Paling Akurat (sekitar 146 MB) paling baik membaca gambar tersulit, tetapi lambat tanpa akselerasi grafis (WebGPU).
Bagaimana cara mengosongkan ruang yang dipakai model?
Klik Hapus model yang diunduh di bawah Model pengenalan teks: semua model yang tersimpan dihapus dari browser ini. Model akan diunduh lagi saat Anda membaca teks berikutnya.