Kolay Araçlar

Taranmış Belgeden Metin (OCR)

Taranmış PDF, fotoğraf ve ekran görüntüsündeki yazıyı metne çevirin. Tarayıcınız yoksa belgeyi telefonla çekin. Türkçe ve İngilizce, belge cihazınızdan çıkmaz.

Dosya seçin veya buraya sürükleyin

PDF, JPG, PNG veya WEBP · en fazla 60 MB

Taranmış PDF, fotoğraf ya da ekran görüntüsü verin. Yazı bu cihazda taranır, belge hiçbir sunucuya gönderilmez.

İşlem bu cihazda yapılır · sunucuya giden 0 bayt

OCR sonucu her zaman hatalı olabilir. Resmî bir belgeyi, faturayı veya bordroyu çıkan metne dayanarak işleme koymadan önce özgün belgeyle karşılaştırın.

Güncelleme

Taranmış belgede yazı neden kopyalanamaz?

Tarayıcıdan veya telefon kamerasından çıkan bir PDF, göründüğü gibi "yazı" içermez, fotoğraf içerir. Ekranda harfleri siz görürsünüz ama dosyanın içinde harf yoktur, yalnızca koyu ve açık pikseller vardır. Metni seçmeye çalıştığınızda hiçbir şey seçilmemesinin sebebi budur.

OCR (optik karakter tanıma) bu piksellere bakıp hangi harf olduklarını çözer. Bu araç tanımayı sizin cihazınızda yapar: belge hiçbir sunucuya yüklenmez. Kimlik fotokopisi, tapu, bordro, sözleşme, hepsi cihazınızda kalır. Çoğu çevrimiçi OCR hizmeti belgenizi kendi sunucusuna gönderir; bu araçta gönderilecek bir şey yoktur.

Türkçe ve İngilizce

Dil seçimi tanıma kalitesini doğrudan belirler. İngilizce için hazırlanmış bir motor Türkçe metinde "ş" harfini "s", "ğ" harfini "g" okur ve noktasız "ı" ile noktalı "i" harfini birbirine karıştırır. Bu araçta Türkçe dil verisi ayrı yükleniyor.

Üçüncü bir seçenek daha var: Türkçe + İngilizce. Türkçe belgelerde İngilizce terim geçmesi kural, istisna değil: teknik belgeler, sözleşmeler, akademik metinler. Bu seçenek iki dili birlikte çalıştırır; biraz daha yavaştır ama karışık metinde belirgin biçimde doğrudur.

Ne kadar iniyor, neden?

Tanıma motoru ve dil verisi ilk kullanımda tarayıcınıza iner: motor yaklaşık 3,9 MB, Türkçe dil verisi 2,1 MB, İngilizce 2,9 MB. Sunucuda çalışan bir hizmette bu indirme olmaz, çünkü orada belgeniz karşıya çıkar. İndirme, belgenin cihazdan çıkmamasının bedeli. Tarayıcınız dosyaları sakladığı için sonraki kullanımlarda yeniden inmez.

Dosyalar bizim alan adımızdan gelir, üçüncü taraf bir dağıtım ağından değil. Böylece belgeniz cihazınızda kalırken tarayıcınız da başka bir siteye istek atmaz.

Tarayıcınız yoksa: belgeyi telefonla çekin

Elinizde tarayıcı olmak zorunda değil. Araç telefonunuzun kamerasını kullanabiliyor: belgeyi masaya koyup çekiyorsunuz, sonra dört köşesini işaretliyorsunuz ve eğrilik düzeltiliyor. Kağıdı kameraya tam dik tutmanız gerekmiyor, düzeltme işaretlediğiniz köşelere göre yapılıyor.

Bu adım tanıma başarısını doğrudan etkiliyor. Eğik duran bir sayfada satırlar da eğik oluyor ve motor satır sırasını karıştırıyor; düzeltilmiş sayfada bu sorun ortadan kalkıyor.

Köşeleri siz işaretliyorsunuz, otomatik bulunmuyor. Sebebi basit: masa deseni, gölge ve düşük kontrast otomatik köşe bulmayı yanıltıyor ve yanlış bulunan köşe sessizce eğri bir belge üretiyor, hatayı ancak metin bozuk çıkınca fark ederdiniz. Dört noktayı sürüklemek birkaç saniye alıyor ve ne olacağını görüyorsunuz.

Sınırlar: baştan bilinsin

  • OCR hiçbir zaman tam doğru değildir. Sonuçta bir güven kademesi gösterilir ve metni kullanmadan önce gözden geçirmeniz istenir. Özellikle rakamlarda hata pahalıdır: bir faturayı veya bordroyu doğrulamadan kullanmayın.
  • El yazısı okunmaz. Bu motor basılı yazı için eğitilmiştir.
  • Tarama kalitesi belirleyicidir. Eğri, karanlık, gölgeli veya çok düşük çözünürlüklü görüntülerde sonuç düşer. En iyi sonuç düz konmuş, iyi aydınlatılmış, 300 dpi civarı taramadan çıkar. Telefonla çekiyorsanız gölge düşürmeyin ve dört köşeyi işaretlemeyi atlamayın.
  • Sayfa sınırı var. Bir seferde en fazla 50 sayfa taranır. Daha uzun belgeyi önce PDF bölme aracıyla parçalayın.

Belgeniz zaten gerçek metin içeriyorsa OCR'a gerek yok: PDF metin çıkarma aracı metni doğrudan alır ve sonuç kusursuz olur. O araç belgenin taranmış olduğunu fark ederse sizi buraya yönlendirir.

Nasıl kullanılır?

  1. Dosyayı verin ya da belgeyi çekin, Taranmış PDF, fotoğraf veya ekran görüntüsü yükleyin. Tarayıcınız yoksa "Belgeyi kameraya tut" ile telefonunuzdan çekip dört köşesini işaretleyin; eğrilik düzeltilsin.
  2. Belgenin dilini seçin, Türkçe, İngilizce ya da ikisi birlikte. Türkçe metinde İngilizce terimler varsa karışık seçeneği belirgin biçimde daha doğrudur.
  3. Yazıyı tarayın, İlk kullanımda motor ve dil verisi iner; ne kadar ineceği düğmenin üstünde yazılıdır. İşlem sürerken durdurabilirsiniz.
  4. Metni gözden geçirin ve alın, Sonucu panoya kopyalayın veya .txt olarak indirin. Güven kademesi düşükse metni satır satır kontrol edin.

Sık sorulan sorular

Tarayıcım yok, belgeyi telefonla çekebilir miyim?

Evet. "Belgeyi kameraya tut" seçeneği kamerayı açar; kareyi yakaladıktan sonra belgenin dört köşesini işaretlersiniz ve yamuk duran sayfa dikdörtgene çekilir. Kağıdı kameraya tam dik tutmanız gerekmez. Bu adımı atlamayın: eğik sayfada satırlar da eğik olur ve motor satır sırasını karıştırır. Görüntü tarayıcınızın içinde kalır, hiçbir yere gönderilmez.

Köşeleri neden otomatik bulmuyorsunuz?

Otomatik köşe bulma masa deseni, gölge ve düşük kontrastta yanılıyor ve yanlış bulunan köşe sessizce eğri bir belge üretiyor, hatayı ancak metin bozuk çıkınca fark edersiniz. Dört noktayı sürüklemek birkaç saniye alıyor ve sonucu önceden görüyorsunuz. Emin olmadığımız bir şeyi sizin adınıza tahmin etmemeyi tercih ediyoruz.

Belgem sunucuya gönderiliyor mu?

Hayır. Tanıma tarayıcınızın içinde, kendi cihazınızda çalışır. Belge hiçbir sunucuya yüklenmez ve kaydedilmez. İlk kullanımda inen dosyalar tanıma motoru ve dil verisidir; belgeniz o istekte yer almaz.

Neden ilk kullanımda birkaç MB iniyor?

Tanıma işini yapan motor ve dil verisi cihazınıza inmek zorunda, çünkü iş cihazınızda yapılıyor. Sunucuda çalışan hizmetlerde bu indirme olmaz ama orada belgeniz karşıya gider. Tarayıcınız dosyaları sakladığı için indirme yalnızca bir kez olur.

Türkçe karakterler doğru çıkıyor mu?

Türkçe dil verisi seçildiğinde evet: ş, ğ, ı, İ, ç, ö, ü için eğitilmiş model kullanılır. İngilizce modelle taranan Türkçe metinde bu harfler sistematik olarak yanlış okunur, o yüzden dil seçimi önemlidir.

El yazısını okuyabilir mi?

Hayır. Kullanılan motor basılı yazı için eğitilmiştir. El yazısı, imza ve süslü yazı tiplerinde sonuç güvenilir olmaz.

Sonuç neden kusurlu?

OCR bir tahmin işlemidir ve tarama kalitesine bağlıdır. Eğri konmuş, karanlık, gölgeli, lekeli ya da düşük çözünürlüklü görüntülerde hata artar. Aracın gösterdiği güven kademesi düşükse belgeyi daha iyi koşullarda yeniden tarayıp denemek genellikle sonucu belirgin biçimde düzeltir.

Kaç sayfa tarayabilirim?

Bir seferde en fazla 50 sayfa. Sınır hem belleği hem bekleme süresini makul tutmak için var: her sayfa cihazınızda birkaç saniye sürer. Daha uzun belgeleri PDF bölme aracıyla parçalayıp sırayla tarayabilirsiniz.

İlgili araçlar

Bu işi yapanların genelde sırada ihtiyacı olanlar.

Bu araçtan doğan yazılar

Aracı yazarken cevaplamak zorunda kaldığımız sorular.