Taranmış veya fotoğrafı çekilmiş belgelerden metin çıkarın.
veya bırakın, yapıştırın ya da buluttan seçin
Taranmış belgeden metne dönüştürme tek bir anlama gelir: sadece bir resim olan bir sayfadaki kelimeleri almak. Tarayıcı veya telefon kamerası kağıdı düz bir görüntü olarak kaydeder, bu yüzden içindeki harfler karakter değil pikseldir. Sayfa okunup metin olarak yazılana kadar dosyadaki hiçbir şey seçilemez, aranamaz ya da düzeltilemez.
OCR nedir? Optik karakter tanıma, taranmış bir belge veya görüntüdeki harfleri, rakamları veya özel karakterleri tanımlamak için kullanılır. Bir OCR dönüştürücü kullanarak bu tür dosyalardan metni çıkarabilir, böylece onu değiştirebilir, düzenleyebilir, yazdırabilir veya kaydedebilirsiniz.
Geri dönen şey düz bir metin dosyasıdır. Belgedeki kelimeleri ve satır sonlarını içerir, sayfa tasarımını değil. Çoğu iş için amaç da budur: mektubun metnine, formdaki rakamlara ya da yanıtlamanız gereken paragrafa ihtiyacınız vardı.
Taranmış belgeden metne dönüştürme aynı anda birden fazla dosyada çalışır. Bir raporun her sayfasını ya da taranmış mektuplardan oluşan bir klasörü ekleyin; her dosya ayrı ayrı dönüştürülür ve kendi metin dosyası olarak döner. Hesap olmadan tek yüklemede 10 tarama gönderebilirsiniz.
Tanımanın ne kadar iyi çalıştığını belirleyen tek ayar, belgenin dilidir. İngilizce zaten seçilidir, bu yüzden İngilizce bir sayfa için herhangi bir değişiklik gerekmez. Diğer tüm diller için, başlamadan önce listeden 124 dil arasından uygun olanı seçin.
Kağıt fotoğrafları burada tarama olarak sayılır. Bu sayfayı telefonda açın, kamera rulonuzdan resmi yükleyin ve aynı tanıma onun üzerinde de çalışsın. Telefon sayfayı bir görüntü yerine PDF olarak kaydettiyse, PDF taramaları için hazırlanmış uygulama daha doğru seçimdir.
Taranmış PDF'yi metne dönüştür.txt dosya uzantısı düz metin dosyaları için kullanılır. Bu dosyalar metin satırları içerir ve farklı platform ve cihazlardaki birçok metin düzenleyici ile açılabilir. Metin herhangi bir biçimlendirme içermez.
Kağıt üzerinde başlamış bir belge için, sonuçta düz metin en taşınabilir formattır. Dosya küçüktür, her bilgisayar veya telefonda lisans olmadan açılır ve kelimeler, özgün sayfanın görünümünü yanında taşımadan bir e-postaya, forma veya çeviri aracına yapıştırılabilir.
Dosya uzantısı: .txt, MIME türü: text/plain
Wikipedia'da TXTMetin tanıma yalnızca taramanın gösterdiğini okuyabilir. İnsanların en sık yüklediği belgelerin nasıl sonuç verdiği şöyle.
| Belge | Nasıl yakalandı | Ne çıkar |
|---|---|---|
| 300 dpi’lik basılı sayfa | Ofis tarayıcısı veya çok işlevli yazıcı | Çok temiz. Okunması en kolay belge türüdür. |
| Çok sayfalı rapor | Sayfa başına bir tarama, birlikte yüklenmiş | Her sayfa, eklediğiniz sırayla kendi metin dosyası olarak döner. |
| Belge fotoğrafı | Kağıdın üzerinde tutulan bir telefon kamerası | İyi, sayfa düz, kadrajı dolduruyor ve gölge yoksa. |
| Form ya da tablo | Herhangi bir tarayıcı veya kamera | Kelimeler çıkar, sütunlar çıkmaz. Düz metinde tablo yapısı yoktur. |
| Soluk, eğik veya el yazısı sayfa | Eski bir kopya, yamuk bir besleme veya kalem | Güvenilmez. Bu uygulama sayfayı düzleştirmez ve el yazısı tanıma için tasarlanmamıştır. |
Kötü okunan taranmış bir belge neredeyse her zaman yakalama sorunundan kaynaklanır. Aynı sayfayı tekrar, düz ve 300 dpi’da taramak, bu sayfadaki herhangi bir ayardan çok daha fazla sonucu düzeltir.
Bu dönüştürücüye en sık getirilen işler şunlardır.
Birisi tarama gönderdi ve sizin fotoğrafını değil, metnini kullanmanız gerekiyor. Taranmış belgeyi metne dönüştürün, paragraflar yanıta, forma veya rapora yapıştırılmaya hazır olsun.
Tanıma 124 belge dilini kapsar, bu yüzden Endonezce, Arapça, Hintçe veya Japonca bir tarama, doğrudan çeviri aracına veya arama kutusuna yapıştırabileceğiniz metin olarak döner.
Yığını tarayın, görüntüleri birlikte yükleyin ve her belge kendi metin dosyası olarak döner. Hiçbir şey kurulmaz ve bunu yapmak için hesap gerekmez.
Her yükleme ve her indirme şifreli bir bağlantı üzerinden çalışır, bu nedenle belge dönüştürücüye giderken veya geri gelirken okunamaz. Hazır metin dosyanıza ait bağlantı rastgele oluşturulur ve tahmin edilemez.
Buradaki metin tanıma tamamen otomatiktir. Gönderdiğiniz belgeleri kimse okumaz, açmaz veya kopyalamaz, hiçbir şey izlenmez ve dosyalarınız yapay zeka modellerini eğitmek için kullanılmaz.
Dönüştürme yalnızca Avrupa'da bulunan ve bir veri işleme anlaşması kapsamında işletilen sunucularda çalışır. Dosyayla birlikte yalnızca IP adresiniz ile tarih ve saat işlenir ve bu da yalnızca hizmetin kötüye kullanımını önlemek içindir.
Taranan belgenin ve ortaya çıkan metin dosyasının telif hakkı ve mülkiyeti sizde kalır. Burada bir dosya dönüştürmek, hiç kimseye hiçbir hak devretmez.
Taranmış belgenizi yükleyin.
Açılır listeden taranmış belgenin dilini seçin (isteğe bağlı).
"Başlat"a tıklayın ve kısa bir beklemenin ardından dönüştürülen metin dosyanızı indirin.
Evet. Taranmış bir belgeyi metne dönüştürmek tüm planlarda ücretsizdir, hesap gerekmez ve kredi harcamaz. Taramayı yükleyin, Başlat'a basın ve metin dosyasını indirin. Ücretli plan yalnızca dosya boyutu ve toplu iş sınırlarını artırır.
Yukarıya taranmış belgeyi yükleyin, yazıldığı dili seçin ve ardından Başlat'a basın. Dönüştürücü sayfayı okur ve herhangi bir editörde açabileceğiniz, arayabileceğiniz ve düzenleyebileceğiniz düz bir metin dosyası döndürür. Kurmanız gereken hiçbir şey yoktur.
Evet. Hesap olmadan tek yüklemede 10 tarama ekleyebilirsiniz; her belge ayrı ayrı dönüştürülür ve kendi metin dosyası olarak geri gelir. Seçtiğiniz dil hepsi için geçerli olur.
Bir PDF taraması, taranmış PDF'yi metne dönüştürme uygulaması ile daha iyi işlenir. PDF sayfalarına göre tasarlanmıştır ve uzun belgelerde fark yaratan tanıma motorunu seçmenize izin verir. Bunun dışındaki her şey aynı şekilde çalışır.
İngilizce, Endonezce ve İspanyolca'dan Arapça, Hintçe, Japonca ve Korece'ye kadar 124 belge dili. Sayfadaki kelimelere uyan dili seçin. İngilizce önceden seçilidir; bu yüzden İngilizce bir belge için değiştirmeniz gerekmez.
Hayır, ve metin dosyası zaten bunun içindir. Kelimeler ve satır sonları aktarılır; sütunlar, tablolar, başlıklar ve sayfa numaraları aktarılmaz, çünkü düz metnin sayfa kavramı yoktur. Düzeni geri istiyorsanız Word'e dönüştürme uygulamasını kullanın.
İki şeyi kontrol edin. Birincisi, seçili dilin belge ile eşleştiğini. İkincisi ise taramanın kendisini: soluk, eğik veya düşük çözünürlüklü bir sayfada karakterler kaybolur ve bu uygulama sizin için sayfayı düzeltmez veya temizlemez. 300 dpi ile yeniden taramak çoğunu düzeltir.
Evet. Şifreli bir bağlantı üzerinden iletilir ve Avrupa Birliği'ndeki sunucularda otomatik olarak işlenirler. Kimse onları okumaz veya kopyalamaz, yapay zeka modellerini eğitmek için asla kullanılmazlar ve indirme bağlantısı rastgele olduğu için tahmin edilemez.
Taranmış belgelerden ve görsellerden değerli metinleri OCR (Optik Karakter Tanıma) ile dijitalleştirin. Görsellerden metni kolayca ve çevrimiçi olarak çıkarın.
Makaleyi okuBunların her biri tarayıcıda çalışır, arkasında aynı metin tanıma vardır ve kurulacak hiçbir şey yoktur.