Ücretsiz yerel OCR · 21 dil · karışık sayfalar · yükleme yok

Resmi Markdown'a Çevir (OCR)

Bu dönüştürücü, basılı metin içeren bir fotoğrafı ya da ekran görüntüsünü Markdown'a çevirir; resmi Markdown'a çevirme işlemi tamamen cihazınızda gerçekleşir, resim hiçbir yere gönderilmez. OCR motoru tarayıcınızın içinde çalışır, 21 dil bilir ve karışık sayfaları okur: metnin ana dilini, gerekirse ikinci bir dili seçersiniz; kendi başına İngilizce okuyamayan yazı sistemleri için İngilizce paketi de otomatik olarak yüklenir. Resim cihazınızda kalır; motor ve kullandığınız paketler bir kez indikten sonra dönüştürücü çevrimdışı da çalışır.

Resim → Markdown

Basılı metin içeren bir resim seçin

Yalnızca tarayıcınızda
Resim

Tarayıcının okuyabildiği bir fotoğraf ya da ekran görüntüsü seçin, buraya bırakın ya da Ctrl+V / ⌘V ile yapıştırın. LensUp onu yüklemez.

Metnin dili
Bu sayfanın diline göre önceden seçildi. Sayfada basılı olan dili seçin.
.md indir

Yalnızca basılı metin. Bir sayfada iki dil olabilir: ana dili seçin, ikincisini ekleyin; ihtiyaç duyan yazı sistemlerine İngilizce eklenir. Çizgili tablolar Markdown tablosu olur; el yazısı, çizgisiz tablolar, formüller ve sütunlar yaklaşıktır; güvenmeden önce kontrol edin.

Bir resmi Markdown'a nasıl çeviririm?

Resimden Markdown'a dönüştürücüyü açın, basılı metin içeren bir fotoğraf ya da ekran görüntüsü seçin, metnin dilini kontrol edin ve “Metni tanı” düğmesine basın. LensUp OCR'ı doğrudan cihazınızda çalıştırır: sayfada iki dil bir aradaysa ikinci bir dili de okur, İngilizceyi tek başına okuyamayan yazı sistemleri için İngilizce paketini de yükler. Paragrafları, madde işaretlerini ve numaralı listeleri Markdown bloklarına dönüştürür; sonucu düzeltebilir, kopyalayabilir ya da .md olarak indirebilirsiniz. Resim hiçbir zaman yüklenmez.

Resim olarak değil not olarak saklamak istediğiniz metinler için tasarlandı: bir kitap ya da ders notu sayfası, projektördeki bir slayt, düzgün büyük harflerle yazılmış bir tahta özeti, basılı bir tarif, bir ürün etiketi, bir form ya da bir afişteki paragraf. Tanınan metin düzenlenebilir Markdown olarak gelir; Obsidian'a, Notion'a, GitHub’daki bir issue kaydına ya da herhangi bir düz metin defterine hazırdır.

Kapsamı bilerek dar tutuldu. Yalnızca basılı metni, seçtiğiniz dilde ve isteğe bağlı olarak ikinci bir dilde okur; görebildiği yapıyı (paragraflar, madde işaretli ve numaralı listeler, büyük başlıklar ve çizgili tablolar) korur; sütunları, el yazısını ve matematik gösterimini satır satır kontrol etmeniz gereken yaklaşık metin olarak bırakır. Resmi Markdown'a çevir, resimden MD'ye, fotoğraftan Markdown'a, ekran görüntüsünden Markdown'a, JPG'den Markdown'a, fotoğraftan OCR ile metin: adı değişir, iş aynıdır ve sonuç her zaman, güvenmeden önce gözden geçirmeniz gereken bir Markdown metnidir.

Resmi Markdown'a çevirme adımları

  1. Bir resim seçinBasılı metin içeren bir fotoğraf ya da ekran görüntüsü seçin, araca sürükleyin ya da Ctrl+V / ⌘V ile panodan yapıştırın. JPG, PNG, WebP, iPhone HEIC ve TIFF yerel olarak okunur; sayfa resmi ve boyutunu hiçbir şey yüklemeden gösterir.
  2. Dili kontrol edin ve metni tanıyınBasılı metnin dilini seçin (menü bu sayfanın dilini önceden seçer), sayfada iki dil bir aradaysa ikinci bir dil ekleyin ve “Metni tanı” düğmesine basın. İlk çalıştırmada OCR motoru (yaklaşık 1,5 MB) ve gereken dil paketleri (her biri 0,4–3 MB) indirilir, sonra önbellekte kalır. Okuma cihazınızda, ilerleme çubuğuyla yapılır.
  3. Gözden geçirin, kopyalayın ya da indirinMarkdown, fotoğrafın yanındaki düzenlenebilir kutuda sözcük ya da karakter sayısı ve ortalama güven değeriyle görünür. Motorun yanlış okuduklarını düzeltin, sonra panoya kopyalayın ya da .md dosyası olarak indirin.

Neler Markdown olur, neler olmaz

Her basılı paragraf tek bir Markdown paragrafı olur: satır sonları birleştirilir, satır sonunda tireyle bölünmüş sözcükler onarılır; Çince, Japonca ve Tayca satırlar boşluksuz birleştirilir ve sözcük yerine karakter olarak sayılır. Madde işaretiyle başlayan satırlar listeye, 1., 2., 3. ile (Doğu Asya metinlerinde 一、二、三 ve 1、2、3 ile) başlayanlar numaralı listeye dönüşür; gövde metninden belirgin biçimde büyük ya da tamamı büyük harfle basılmış kısa tek satır ikinci düzey başlık olur. Geri kalan her şey okuma sırasına göre düz metin olarak kalır.

Çizgilerle çizilmiş bir tablo Markdown tablosu olur: ızgara tanıma işleminden önce silinir, basılı her satır bir tablo satırına, satırların paylaştığı boşluklar sütunlara dönüşür; bu yüzden birleştirilmiş hücreler ve hiç çizgisi olmayan tablolar metin satırları olarak çıkar. Matematik formülleri tanınmaz; kesirler, üsler ve semboller bozuk çıkar. İki sütunlu düzenler iç içe geçebilir; el yazısı, süslü yazı tipleri, çok küçük puntolar ve desenli zemin üstündeki metin kötü okunur ya da atlanır. Sayılar, adlar ve kodlar ikinci bir bakışı hak eder; oradaki tek bir yanlış karakter düz metindekinden daha ağır basar. Sonucun altındaki ortalama güven değeri motorun kendi tahminidir, garanti değildir.

Telefon fotoğrafından temiz okuma almak

Karakter tanıma en iyi sonucu sayfa düz durduğunda, metin net ve eşit aydınlatılmış olduğunda ve fotoğraf tam karşıdan çekildiğinde, aşağı yukarı 300 dpi taramanın netliğinde verir. Kadrajı metinle doldurun, gölge ve parlamadan kaçının, netleme oturana kadar sabit tutun. Çok büyük fotoğraflar, tanıma işleminden önce uzun kenarları 2600 piksel olacak şekilde küçültülür; sıradan kitap ve belge metni tamamen okunur kalır, bellek ve zaman kazanılır.

Sayfa eğik ya da gölgeliyse önce LensUp tarayıcısından geçirin: perspektif düzeltme ve gölge silme düz, yüksek kontrastlı bir sayfa verir; tarayıcıdan indirilen JPG ya da PNG buraya iyi bir girdidir. Tanıyıcı ekran görüntülerini de kabul eder; bunlar çoğunlukla en kolay durumdur.

Yerel motor yetmediğinde: Pro ile düzeltin

Ücretsiz yolun arkasındaki açık kaynaklı motor Tesseract matematik gösterimini okumaz; çizgisiz tablolarda ya da birleştirilmiş hücrelerde zorlanır. Bu sayfalar için sonuç kutusu “Pro ile düzelt” seçeneğini sunabilir: sitede ödemeler açıldığında görünen ücretli bir seçenektir. Fotoğrafın tamamı bir kez, LensUp sunucusu üzerinden, formül ve tablolar için yapılmış ticari bir tanıyıcı olan Mathpix'e gönderilir; onun Markdown'ı yerel sonucun yerini alır. Formüller dolar işaretleri arasında LaTeX, tablolar Markdown tablosu olarak gelir. LensUp fotoğrafı geçiş sırasında saklamaz (Mathpix onu kendi koşullarına göre işler); yerel sonuç bir tık uzağınızdadır.

Pro'nun kullanım başına ücretli olması, ücretsiz yolun ücretsiz ve yerel kalabilmesi içindir: sunulduğu sürece e-posta bağlantısıyla (parolasız) giriş yapar, 50 kullanımı tek seferlik 4,99 ABD doları karşılığında satın alırsınız (abonelik yoktur); her Pro düzeltmesi bir kullanım harcar. Sağlayıcı çağrısı başarısız olursa kullanım hakkınızdan düşülmez.

Karışık diller, cihazda, bilerek

Sayfa 21 dil sunar: İngilizce, Fransızca, Almanca, İspanyolca, Portekizce, İtalyanca, Lehçe, Türkçe, Endonezce, Vietnamca, Çince (basitleştirilmiş ve geleneksel), Japonca, Korece, Rusça, Arapça, Farsça, Urduca, Hintçe, Bengalce ve Tayca; yani LensUp'ın desteklediği diller. Her dil ayrı bir pakettir ve yalnızca seçtiğinizde indirilir: Fransızca bir sayfa için 0,7 MB'lık, Çince bir sayfa içinse yaklaşık 1,7 MB'lık bir paket indirilir; hiçbir zaman tüm set indirilmez. Gerçekten basılı olan dili seçin, sayfa karışıksa ikinci bir dil ekleyin; Korece, Rusça, Arapça, Farsça, Urduca, Hintçe, Bengalce ve Tayca paketleriyle birlikte İngilizce paketi otomatik olarak yüklenir, çünkü bu paketler tek başına İngilizce sözcükleri benzer görünümlü harflere çevirir. Yanlış paketle Markdown yerine parçalar çıkar, durum satırı bunu söyler ve “Dili algıla” her yazı sistemi için bir paket deneyerek doğrusunu bulur; böylece karışık bir sayfa da temiz Markdown olur.

Her şey, LensUp'ın diğer görselleri işlediği gibi, açık kaynaklı bir motorla yerel olarak çalışır: yükleme yok, hesap yok, fotoğrafınızın ya da metninin sunucuda kopyası yok. Motor dosyaları ve paketler lensup.ai'den sunulur ve tarayıcınız tarafından önbelleğe alınır; aynı dildeki ikinci tanıma anında başlar. LensUp'ın tarama araçlarında hâlâ OCR yoktur ve bu araçlar aranabilir PDF üretmez.

Sık sorulan sorular

Resmi Markdown'a çevirirken resim cihazımdan çıkıyor mu?

Ücretsiz yolda hayır: OCR motoru ve seçtiğiniz dil paketi tarayıcınıza indirilir, tanıma orada yapılır; ne fotoğraf, ne tanınan metin, ne de .md dosyası bir LensUp sunucusuna ulaşır. Tek istisna açık ve isteğe bağlıdır: sonuç kutusu “Pro ile düzelt” sunduğunda (ödemeler açıkken görünen ücretli bir seçenek) o tık fotoğrafın tamamını LensUp üzerinden Mathpix'e (formül ve tablolar için ticari bir tanıyıcı) gönderir ve onun Markdown'ını getirir; LensUp fotoğrafı geçiş sırasında saklamaz (Mathpix onu kendi koşullarına göre işler), e-postayla giriş ve ücretli kullanım hakkı gerekir (50 kullanım, tek seferlik 4,99 ABD doları) ve yerel sonuç geri getirilebilir.

Resimden Markdown'a dönüştürücü hangi dilleri destekliyor?

Yirmi bir basılı dil: İngilizce, Fransızca, Almanca, İspanyolca, Portekizce, İtalyanca, Lehçe, Türkçe, Endonezce, Vietnamca, Çince (basitleştirilmiş ve geleneksel), Japonca, Korece, Rusça, Arapça, Farsça, Urduca, Hintçe, Bengalce ve Tayca. Bir sayfada bunlardan ikisi olabilir: ana dili seçin, karışık sayfa için ikinci bir dil ekleyin; Korece, Rusça, Arapça, Farsça, Urduca, Hintçe, Bengalce ve Tayca ile birlikte İngilizce otomatik okunur, çünkü bu paketler tek başına İngilizce sözcükleri benzer görünümlü harflere çevirir. El yazısı hiçbir dilde desteklenmez.

Neden bazı metinler yanlış ya da eksik?

Önce dil paketini kontrol edin: Markdown'ın altındaki uyarı “Dili algıla” sunar; her yazı sistemi için bir OCR paketi dener ve en iyisini tutar. Sonra fotoğrafı: bulanıklık, parlama, gölge, eğiklik, küçük punto, süslü yazı tipleri ve karmaşık zemin tanıma kalitesini düşürür; tablolar ya da çok sütunlu sayfalar yanlış sırada çıkabilir. Fotoğrafı düz ve net biçimde yeniden çekin ya da önce LensUp tarayıcısında temizleyin, sonra kullanmadan önce Markdown'ı kontrol edin.