Başlangıç
ocr
9 dk okuma

OCR Nedir ve Nasıl Kullanılır? Optik Karakter Tanıma Rehberi

OCR (Optical Character Recognition, optik karakter tanıma), bir görüntü içindeki yazılı metni — basılı veya el yazısı — bilgisayarın işleyebileceği, aranabilir ve düzenlenebilir metne dönüştüren teknolojidir. Taranmış bir kitap sayfasını, bir fatura fotoğrafını veya bir PDF'i alıp içindeki harfleri tanır ve düz metne çevirir. Bu rehberde OCR'ın nasıl çalıştığını ve bir belgeyi açık kaynak araçlarla adım adım nasıl metne dönüştüreceğinizi öğreneceksiniz.

OCR Nedir ve Nasıl Çalışır?

Modern OCR sistemleri genellikle iki aşamadan oluşur. İlk aşama metin algılama (text detection): görüntüde metnin nerede olduğunu, satır ve kelime bölgelerini bulur. İkinci aşama metin tanıma (text recognition): bulunan her bölgedeki karakterleri tahmin eder. Eski sistemler harfleri şablonlarla eşleştiren kural tabanlı yaklaşımlar kullanırdı; günümüzde ise LSTM ve transformer gibi derin öğrenme modelleri çok daha yüksek doğruluk sağlar. Çıktı genellikle düz metin, koordinat bilgisi içeren hOCR ya da aranabilir PDF biçiminde sunulur.

Adım 1: Doğru OCR Aracını Seçin

İhtiyacınıza göre bir motor seçin. Temiz, yüksek çözünürlüklü basılı belgeler için hızlı ve hafif Tesseract idealdir. Karmaşık düzenler, akademik makaleler, faturalar, tablolar ve el yazısı için en yüksek doğruluğu Surya OCR sunar. Fotoğraf, tabela ve plaka gibi gerçek dünya görüntüleri için EasyOCR güçlüdür. Mobil veya edge dağıtım ile tablo çıkarma gerekiyorsa PaddleOCR hafif modelleriyle öne çıkar. Hepsi açık kaynaklı ve ücretsizdir.

Adım 2: Görüntüyü Hazırlayın (Ön İşleme)

OCR doğruluğu büyük ölçüde girdi kalitesine bağlıdır. En iyi sonuç için görüntüyü gri tonlamaya çevirin, kontrastı artırın ve gerekiyorsa ikilileştirme (binarization) uygulayın. Eğik taramaları düzeltin (deskewing), gürültüyü azaltın ve mümkünse en az 300 DPI çözünürlük kullanın. Düşük çözünürlüklü veya bulanık görüntüler, en iyi motorlarda bile doğruluğu ciddi şekilde düşürür. İyi bir ön işleme, çoğu zaman daha güçlü bir modelden daha fazla fark yaratır.

Adım 3: Dili ve Parametreleri Ayarlayın

Doğru dil modelini seçmek doğruluğu belirgin biçimde artırır. Türkçe belgelerde Tesseract için 'tur' dil dosyasını, EasyOCR için ['tr'] okuyucusunu kullanın; bu sayede ç, ğ, ı, ö, ş, ü gibi özel karakterler doğru tanınır. Çok dilli belgelerde birden fazla dili birlikte yükleyebilirsiniz. Belge düzeni karmaşıksa (çok sütun, tablo), düzen analizi sunan Surya veya PaddleOCR'ı tercih edin; aksi halde okuma sırası karışabilir.

Adım 4: OCR'ı Çalıştırın ve Çıktıyı Alın

Seçtiğiniz aracı çalıştırarak metni çıkarın. Örneğin Python'da Tesseract için pytesseract kütüphanesiyle bir görüntüyü pytesseract.image_to_string(image, lang='tur') ile metne dönüştürebilirsiniz. EasyOCR'da reader = easyocr.Reader(['tr']) ardından reader.readtext(image) çağrısı, her metin bölgesi için koordinat, metin ve güven puanı döndürür. Çıktıyı düz metin, JSON ya da aranabilir PDF olarak kaydedebilirsiniz.

Adım 5: Sonucu Doğrulayın ve İyileştirin

Çıktıyı gözden geçirin ve düşük güven puanlı bölgeleri işaretleyin. Sık karşılaşılan hataları (örneğin 0/O, 1/l karışması) sözlük tabanlı son işleme veya basit kurallarla düzeltebilirsiniz. Doğruluk yeterli değilse ön işlemeyi gözden geçirin, daha yüksek çözünürlüklü bir tarama alın veya daha güçlü bir motora (ör. Surya OCR) geçin. Tekrarlayan belge türleri için özel eğitilmiş modeller doğruluğu daha da artırabilir.

OCR ile Neler Yapabilirsiniz?

OCR; arşiv ve kitap dijitalleştirme, aranabilir PDF oluşturma, fatura ve fiş işleme, kimlik ve form okuma, akademik makale çıkarma ve erişilebilirlik (metni sesli okuyuculara besleme) gibi birçok senaryoda kullanılır. Açık kaynak araçlar sayesinde tüm bu işlemleri bulut maliyeti olmadan, gizlilik hassasiyetli belgeleri yerelde işleyerek gerçekleştirebilirsiniz. Hangi aracın size uygun olduğunu görmek için açık kaynak OCR araçları karşılaştırmamıza göz atabilirsiniz.

Sıkça Sorulan Sorular

OCR ücretsiz mi? Evet — Tesseract, EasyOCR ve PaddleOCR izin verici Apache 2.0 lisansıyla, Surya OCR ise GPL-3.0 ile ücretsiz ve açık kaynaktır. OCR Türkçe destekliyor mu? Evet, bu araçların tamamı Türkçe karakterleri tanır; doğru dil modelini seçmek doğruluğu artırır. El yazısı tanınır mı? En iyi el yazısı performansını Surya OCR sunar; Tesseract'ın varsayılan modelleri el yazısında zayıftır.

Etiketler:
#ocr
#optik karakter tanıma
#metin tanıma
#belge dijitalleştirme
#tesseract
#surya ocr