Taranmış PDF'den metne

Bu araç, taranmış PDF'leri düzenlenebilir metne dönüştürür; böylece içeriği kolayca kopyalayabilir, düzenleyebilir ve ekleyebilirsiniz.

Dosyanızı yükleyin

veya bırakın, yapıştırın ya da buluttan seçin

URL yapıştır Örnek dene
Google Drive Dropbox OneDrive
%100 Ücretsiz Kurulum gerekmez Güvenli ve gizli
Reklam
Güvenenler
eBay Booking.com University of Michigan Cornell University Columbia University
Bu aracı değerlendirin
0/5 · 0 oy

Taranmış bir PDF ne zaman OCR ister, ne zaman istemez

Taranmış bir PDF'yi metne dönüştürmek aslında iki farklı iştir ve dönüştürücü hangisinin çalışacağını seçmenize izin verir. İçinde gerçek karakterler olan bir PDF'nin yalnızca okunması gerekir. Sayfa resimleri içeren bir PDF ise önce tanınmalıdır, çünkü içinde henüz metin yoktur.

İkisini bir saniyede ayırt edebilirsiniz. Dosyayı herhangi bir okuyucuda açın ve bir satır seçmeyi deneyin. Kelimeler vurgulanıyorsa PDF'de bir metin katmanı vardır; bu durumda Dönüştür'ü seçin ve metin yazıldığı gibi çıkar. Hiçbir şey vurgulanmıyorsa veya tüm sayfa tek bir blok olarak seçiliyorsa bu bir taramadır ve optik karakter tanıma gerektirir.

Bu tek seçim, kullanıcıların başka yerlerde aldıkları çoğu hayal kırıklığı yaratan sonucu açıklar. Her yüklemeye tek bir yolu çalıştıran bir dönüştürücü, bazı dosyalar için temiz metin, diğerleri için boş bir sayfa döndürür ve hiçbirinde nedenini açıklamaz. Motoru kendiniz seçtiğinizde tahmin yürütmeye gerek kalmaz.

Taranmış PDF belgelerinden metin nasıl kopyalanır

Bir tarama, imlecinizi bir cümlenin üzerinde sürüklemenize izin vermez, çünkü seçilecek hiçbir şey yoktur. Taranmış bir PDF'den metni çıkarmak bunu çözer: dosyayı yükleyin, dönüştürmeyi çalıştırın ve kopyalayabileceğiniz, e-postaya yapıştırabileceğiniz veya herhangi bir editörde bul komutuyla arayabileceğiniz düz bir metin dosyası elde edin.

Çıktı bir .txt dosyasıdır, bu yüzden özel yazılım olmadan her bilgisayarda ve telefonda açılır. Kelimeleri ve satır sonlarını taşır, düzeni ise geride bırakır; içerik önemli olduğunda, sayfanın birebir kopyası yerine bu doğru tercihtir.

Birden fazla tarama aynı anda içe aktarılabilir. Her PDF ayrı ayrı dönüştürülür ve kendi metin dosyası olarak geri döner; tümü için aynı motor ve aynı dil seçimi uygulanır.

TXT dosyası nedir?

.txt dosya uzantısı düz metin dosyaları için kullanılır. Bu dosyalar metin satırları içerir ve farklı platform ve cihazlardaki birçok metin düzenleyici ile açılabilir. Metin herhangi bir biçimlendirme içermez.

Bu yüzden, taramadan geri kazanılan metni koymak için en güvenli yer burasıdır. Dosya hakkında hiçbir şey eskiyemez, açmak için hiçbir lisans gerekmez ve metin, orijinali üreten programın yerini başka bir program alsa bile okunabilir kalır.

Dosya uzantısı: .txt, MIME türü: text/plain

Wikipedia'da TXT

Hangi OCR motorunu seçmeli

Burada taranmış bir PDF'yi okumanın 5 yolu vardır ve ayarlar paneli aralarında geçiş yapmanıza izin verir. Karşınızdaki dosyayla eşleşen seçeneği seçin.

OCR motoru Şunlar için seçin
Dönüştür PDF'de zaten seçilebilir metin vardır. Tanıma çalıştırılmaz, bu yüzden kelimeler yazıldığı gibi çıkar.
Standart OCR Tarama temiz, düz ve nettir. Bu, taranmış bir PDF'den metne gitmenin en hızlı yoludur.
Gelişmiş Yapay Zeka OCR Tarama silik, düşük çözünürlüklü veya biraz eğridir ve standart motor karakterleri düşürür.
Gelişmiş Yapay Zeka OCR+ Sayfada gölgeler, düzensiz ışık veya eğri bir omurga vardır; bu, bir kitabın fotoğrafı çekildiğinde yaygındır.
Fotoğraf OCR Metin taranmaktan çok fotoğraflanmıştır; örneğin bir tabela, etiket veya ekran.

Dönüştürücü, dikey yerleşimli basitleştirilmiş ve geleneksel Çince ile Azerice, Sırpça ve Özbekçenin Kiril biçimleri de dahil olmak üzere 124 kaynak dili tanır. Dosyanızda geçen tüm dilleri seçin.

Taranmış bir PDF'yi metne dönüştürmenin yaygın nedenleri

Bir taramadaki kelimeler bir görüntünün içine kilitlenmiştir. Aşağıdaki durumlarda onları dışarı almak en çok emeği kazandırır.

Aramanız gereken evraklar

Faturalar, sözleşmeler, makbuzlar ve mektuplar genellikle tarama olarak gelir. Metin çıkarıldığında, her sayfayı okumak yerine bir tutarı, tarihi veya ismi aratabilirsiniz.

Çalışma ve araştırma materyali

Kütüphane taramaları, dergi makaleleri ve kitap sayfaları alıntılanabilir hale gelir. Metni bir kez çıkarın ve ihtiyacınız olan pasajları notlarınıza yapıştırın; yeniden yazmak zorunda kalmayın.

Kayıtlar ve arşivler

Eski dosyalar genellikle uzun, çok sayfalı taramalar halinde saklanır. Birkaçını aynı anda yükleyin; dönüştürücü partiyi tek seferde işler.

Verileriniz, koruma altında

Taranan kağıtlarınız ve dönüştürdüğünüz belgeler kişisel olabilir. Sizinkilerin tam olarak nasıl işlendiği burada açıklanıyor.

TLS şifreleme

Her yükleme ve indirme şifreli bir bağlantı üzerinden gerçekleşir, bu nedenle dosyalarınız aktarım sırasında okunamaz.

İnsan erişimi yok

Metin tanıma tamamen otomatiktir. Hiç kimse taramalarınızı veya belgelerinizi okumaz ve hiçbir şey üçüncü taraflarla paylaşılmaz.

ISO 27001 veri merkezleri

İşleme, Avrupa Birliği içindeki sertifikalı veri merkezlerinde gerçekleşir.

Taranmış bir PDF'yi metne nasıl dönüştürürsünüz

1

Yükle

Taranmış PDF'nizi yükleyin.

2

Seç

Dosyanıza uyan OCR motorunu seçin. PDF'deki metin zaten seçilebiliyorsa Dönüştür'ü kullanın.

3

Ayarla

Daha iyi sonuç için PDF'nizin dilini seçin (isteğe bağlı).

4

Dönüştür

Dönüştürmeyi başlatın ve indirme işleminiz hazır olana kadar bekleyin.

Taranmış PDF'den metne SSS

Bu taranmış PDF'den metne dönüştürücü ücretsiz mi?

Evet. Taranmış bir PDF'yi metne dönüştürmek ücretsizdir ve hesap gerektirmez. Dosyayı yükleyin, bir motor seçin ve sonucu indirin. 100 MB'a kadar dosyalar ücretsiz sınır içindedir; bir plan yalnızca daha büyük dosyalar ve daha uzun işlemler için önemlidir.

Bir PDF'ye ücretsiz OCR yapabilir miyim?

Evet. Standart OCR ücretsiz motordur ve normal taramaları kaydolmadan işler. 3 gelişmiş yapay zeka motoru ise, soluk kopyalar veya kötü ışıkta çekilmiş fotoğraflar gibi standart motorun okuyamadığı sayfalar için yükseltmedir.

Neden taranmış PDF'imden metin çıkarmak için OCR gerekiyor?

Çünkü dosya karakterler yerine sayfa resimleri içeriyor. Tarayıcı kağıdın fotoğrafını çeker, böylece her kelime bir piksel desenidir. Optik karakter tanıma bu pikselleri okur ve gerçek karakterler yazar; metni seçilebilir, aranabilir ve düzenlenebilir hale getiren budur.

Taranmış bir PDF'den metni nasıl kopyalarım?

PDF'yi yukarıdan yükleyin, bir OCR motoru seçin ve dönüştürmeyi başlatın. Sonuç, herhangi bir editörde açıp kopyalayabileceğiniz düz bir metin dosyasıdır. Doğrudan bir PDF okuyucudan kopyalama, yalnızca dosyada bir metin katmanı varsa işe yarar.

Metin tanıma hangi dilleri okuyabilir?

Dikey yerleşimli hem basitleştirilmiş hem geleneksel Çinceyi ve Azerice, Sırpça ile Özbekçenin Kiril varyantlarını da içeren 124 kaynak dili tanır. Dosyada geçen her dili seçin; çünkü bir sayfada karışık diller en iyi, hepsi listelendiğinde okunur.

Taranmış bir PDF'yi Word'e dönüştürebilir miyim?

Bu sayfadan değil; burası düz bir metin dosyası yazar. Kelimeleri korur, düzeni bırakır. Biçimlendirmeli bir DOC veya DOCX için, aynı metin tanımayı çalıştırıp bir Word belgesi oluşturan Word'e dönüştür uygulamasını kullanın.

Çıkarılan metin neden hatalı görünüyor?

Tanıma kalitesi, tarama kalitesini takip eder. Eğri bir sayfa, düşük çözünürlük, kağıt üzerindeki bir gölge veya elde çekilmiş bir fotoğraf, doğruluğa mal olur. Kusurlu taramalar için Gelişmiş AI-OCR'yi, kötü ışık için Gelişmiş AI-OCR+'yı deneyin ve mümkün olduğunda 300 dpi'de yeniden tarayın. Parola korumalı veya hasarlı bir kaynak dosya hiç dönüştürülmez.

Taranmış belgelerim gizli mi?

Evet. Yüklemeler ve indirmeler şifreli bir bağlantı üzerinden yapılır, işlem Avrupa Birliği içindeki sertifikalı veri merkezlerinde gerçekleşir ve tüm işlem hattı otomatiktir; bu yüzden kimse taramalarınızı okumaz. Dosyalarınız hiçbir zaman yapay zeka modellerini eğitmek için kullanılmaz ve hakları sizde kalır.

Metin tanıma hakkında daha fazlası

Sarı bir masanın üzerinde, tarayıcı kılavuzlarıyla çerçevelenmiş açık bir kitap ve sayfaya basılmış Save Valuable Text With OCR makale başlığı
Nasıl Yapılır

Değerli Metinleri OCR ile Kaydedin

Taranmış belgelerden ve görsellerden değerli metinleri OCR (Optik Karakter Tanıma) ile dijitalleştirin. Görsellerden metni kolayca ve çevrimiçi olarak çıkarın.

Makaleyi oku