BELGE ARAÇLARI · %100 ÜCRETSİZ

PDF OCR

Taranmış bir PDF'i — sayfaların fotoğraf olduğu, tek bir kelimeyi bile seçemediğiniz türden — okuyun ve iki şey geri alın: düz metin ve aynı PDF'in üzerine görünmez metin katmanı eklenmiş aranabilir kopyası. Türkçe ve İngilizce desteklenir. Her şey tarayıcınızın içinde çalışır, belge cihazınızdan hiç çıkmaz.

50Sayfa / dosya
TarayıcıdaDosya yüklenmez
ÜcretsizHesap gerekmez
PDF OCR

PDF'inizi okuyun

Başlamak için taranmış ya da görsel tabanlı bir PDF seçin.

Ücretsiz · üyelik yok

The OCR engine is a WebAssembly build of Tesseract that we host ourselves. Your image is read on your own device and never uploaded, so there is no server copy and no account.

NASIL KULLANILIR

Üç adımda taranmış PDF yazıya çevirme

  1. PDF'i seçin. Taranmış ya da görsel tabanlı PDF'i yukarıdaki kutuya bırakın. En fazla 40 MB ve 50 sayfa; daha uzun belgeler bu sınıra kadar okunur ve sayfa bunu size söyler.
  2. Dilleri seçip başlatın. Sayfalar sırayla işlenir; her sayfa bitince karakter sayısını ve güven oranını bildirir, böylece kalite sorununu sonda değil işlem sürerken görürsünüz.
  3. Metni ya da aranabilir PDF'i alın. Düz metin düzenlenebilir bir kutuda çıkar. Aranabilir PDF orijinalinizle birebir aynı görünür ama içindeki kelimeleri seçebilir, kopyalayabilir ve arayabilirsiniz.

Aranabilir PDF tam olarak nedir

Taranmış PDF, üst üste konmuş fotoğraflardan ibarettir. İçinde metin olmadığı için arama hiçbir şey bulmaz ve bir cümleyi kopyalayamazsınız. Aranabilir PDF o fotoğrafları olduğu gibi bırakır ve kelimelerin ikinci, görünmez bir kopyasını her kelimenin göründüğü yere yerleştirir. Sayfa birebir aynı görünür ama okuyucu artık kelimeleri bulabilir ve seçebilir. Bu araç o katmanı OCR sonucundan kelime kelime kurar.

Kalite taramaya bağlıdır. Temiz bir 300 dpi tarama çok iyi okunur; açılı çekilmiş sayfa fotoğrafı, soluk bir faks ya da aşırı sıkıştırılmış belge doğruluğu düşürür. Her sayfa kendi güven oranını bildirir ve ortalama %70'in altına düştüğünde araç sizi uyarır. Görünmez katmanda Unicode bir font gömülür, bu yüzden ı, ğ, ş, İ gibi Türkçe harfler de doğru saklanır ve aranabilir.

Bir yere yükleniyor mu?

Hayır. Sayfaları pdf.js çizer, Tesseract okur, yeni dosyayı pdf-lib yazar — üçü de tarayıcı sekmenizin içinde, genel bir CDN'den değil kendi alan adımızdan gelerek çalışır. PDF hiç gönderilmez; sözleşme, fatura ve sağlık belgesi gibi üçüncü bir tarafa verilmemesi gereken dosyalarda önemli olan da budur.

Ayrıntılı anlatım ve sık sorulanlar için PDF OCR rehberini okuyun.