Darmowy lokalny OCR · 21 języków · strony mieszane · bez wysyłania

Konwerter obrazu na Markdown (OCR)

Ten konwerter zamienia obraz na Markdown — zdjęcie lub zrzut ekranu z drukowanym tekstem — nie wysyłając go nigdzie. Silnik OCR działa w Twojej przeglądarce, zna 21 języków i czyta strony mieszane: wybierasz główny język tekstu, w razie potrzeby drugi, a dla pism, których pakiety same nie umieją czytać angielskiego, pakiet angielski jest dołączany automatycznie. Obraz zostaje na Twoim urządzeniu, a po pierwszym pobraniu silnika i używanych pakietów konwerter działa także offline.

Obraz → Markdown

Wybierz obraz z drukowanym tekstem

Tylko w przeglądarce
Obraz

Wybierz plik ze zdjęciem lub zrzutem ekranu, który przeglądarka potrafi odczytać, upuść go tutaj albo wklej skrótem Ctrl+V / ⌘V. LensUp go nie wysyła.

Język tekstu
Wybrany wstępnie według języka tej strony. Wybierz język wydrukowany na stronie.

Tylko tekst drukowany. Strona może zawierać dwa języki: wybierz główny, dodaj drugi, a dla pism, których pakiety nie czytają angielskiego, dołączany jest pakiet angielski. Tabele z liniami stają się tabelami Markdown; pismo odręczne, tabele bez linii, wzory i kolumny są przybliżone — sprawdź, zanim im zaufasz.

Jak zamienić obraz na Markdown?

Otwórz konwerter obrazu na Markdown, wybierz zdjęcie lub zrzut ekranu z drukowanym tekstem, sprawdź język tekstu i kliknij „Rozpoznaj tekst”. LensUp wykonuje OCR na Twoim urządzeniu — z drugim językiem, jeśli strona łączy dwa, a dla pism, których pakiety same nie czytają angielskiego, dołącza pakiet angielski — zamienia akapity, punkty i listy numerowane w bloki Markdown, a wynik możesz poprawić, skopiować lub pobrać jako .md. Obraz nigdy nie jest wysyłany.

Powstał z myślą o tekście, który chcesz zachować jako notatkę, a nie jako obraz: strona książki lub skryptu, slajd z rzutnika, podsumowanie z tablicy zapisane czytelnymi wielkimi literami, wydrukowany przepis, etykieta produktu, formularz albo akapit z plakatu. Rozpoznany tekst trafia do Ciebie jako edytowalny Markdown, gotowy do Obsidiana, Notion, issue na GitHubie czy dowolnego notatnika w czystym tekście.

Zakres jest celowo wąski. Czyta wyłącznie tekst drukowany w wybranym języku, ewentualnie także w drugim; zachowuje strukturę, którą widzi — akapity, listy punktowane i numerowane, większe nagłówki i tabele z liniami — a kolumny, pismo odręczne i zapis matematyczny rozpoznaje tylko orientacyjnie, dlatego wynik trzeba sprawdzić linijka po linijce. Obraz na Markdown, obraz na MD, zdjęcie na Markdown, zrzut ekranu na Markdown, JPG na Markdown, OCR ze zdjęcia do tekstu: nazwa się zmienia, zadanie jest to samo, a wynikiem jest zawsze Markdown, który sprawdzasz, zanim mu zaufasz.

Jak zamienić obraz na Markdown

  1. Wybierz jeden obrazWybierz zdjęcie lub zrzut ekranu z drukowanym tekstem, przeciągnij go na narzędzie albo wklej ze schowka skrótem Ctrl+V / ⌘V. JPG, PNG, WebP, HEIC z iPhone’a i TIFF są czytane lokalnie; strona pokazuje obraz i jego rozmiar, niczego nie wysyłając.
  2. Sprawdź język i rozpoznajWybierz język drukowanego tekstu (menu podpowiada język tej strony), dodaj drugi, jeśli strona łączy dwa, i kliknij „Rozpoznaj tekst”. Za pierwszym razem pobierane są silnik OCR (ok. 1,5 MB) i potrzebne pakiety językowe (po 0,4–3 MB), potem zostają w pamięci podręcznej. Odczyt odbywa się na Twoim urządzeniu, z paskiem postępu.
  3. Sprawdź, skopiuj lub pobierzMarkdown pojawia się w edytowalnym polu obok zdjęcia, z liczbą słów lub znaków oraz średnim poziomem pewności rozpoznania. Popraw to, co silnik odczytał źle, a potem skopiuj do schowka lub pobierz plik .md.

Co staje się Markdownem, a co nie

Każdy drukowany akapit staje się jednym akapitem Markdown: podziały wierszy są łączone, a słowa przeniesione dywizem na końcu wiersza sklejane z powrotem; wiersze chińskie, japońskie i tajskie łączone są bez spacji i liczone w znakach, nie w słowach. Wiersze zaczynające się od punktora stają się listą; zaczynające się od 1., 2., 3. — lub od 一、二、三 i 1、2、3 w tekstach wschodnioazjatyckich — listą numerowaną; a krótki, samotny wiersz wydrukowany wyraźnie większą czcionką niż tekst główny albo w całości wielkimi literami staje się nagłówkiem drugiego poziomu. Reszta pozostaje zwykłym tekstem w kolejności czytania.

Tabela narysowana liniami staje się tabelą Markdown: siatka jest wymazywana przed rozpoznaniem, każdy drukowany wiersz staje się wierszem tabeli, a wspólne dla wierszy odstępy wyznaczają kolumny; dlatego komórki scalone i tabele bez linii wychodzą jako zwykłe wiersze tekstu. Wzory matematyczne nie są rozpoznawane — ułamki, wykładniki i symbole wychodzą zniekształcone; układy dwukolumnowe mogą się przeplatać; pismo odręczne, czcionki ozdobne, bardzo drobny druk i tekst na niejednolitym lub wzorzystym tle są czytane źle lub pomijane. Liczby, nazwiska i kody warto sprawdzić drugi raz — jeden błędny znak waży tam więcej niż w prozie. Średnia pewność pod wynikiem to szacunek samego silnika, nie obietnica.

Jak uzyskać czysty odczyt ze zdjęcia z telefonu

Rozpoznawanie znaków działa najlepiej, gdy strona leży płasko, tekst jest wyraźny i równomiernie oświetlony, a zdjęcie wykonano na wprost, z jakością zbliżoną do skanu 300 dpi. Wypełnij kadr tekstem, unikaj cieni i odblasków i nie ruszaj telefonem, aż ostrość się ustawi. Bardzo duże zdjęcia są przed rozpoznaniem zmniejszane do 2600 px na dłuższym boku — zwykły tekst książek i dokumentów pozostaje w pełni czytelny, a oszczędza to pamięć i czas.

Jeśli strona została sfotografowana pod kątem albo jest zacieniona, przepuść ją najpierw przez skaner LensUp: korekta perspektywy i usuwanie cieni dają płaską, kontrastową stronę, a pobrany ze skanera JPG lub PNG to tutaj dobry materiał wejściowy. Rozpoznawanie przyjmuje też zrzuty ekranu, które zwykle są najłatwiejszym przypadkiem.

Gdy lokalny silnik nie wystarcza: popraw z Pro

Tesseract, silnik open source używany w wersji bezpłatnej, nie czyta zapisu matematycznego i słabo radzi sobie z tabelami bez linii lub ze scalonymi komórkami. Dla takich stron pole wyniku może zaproponować „Popraw z Pro” — płatną opcję, która pojawia się, gdy w serwisie włączone są płatności: całe zdjęcie jest wysyłane raz, przez serwer LensUp, do Mathpix — komercyjnego systemu rozpoznawania stworzonego do wzorów i tabel — a jego Markdown zastępuje wynik lokalny, ze wzorami w LaTeX-u między znakami dolara i tabelami jako tabelami Markdown. LensUp nie zapisuje zdjęcia podczas przesyłania (Mathpix przetwarza je na własnych warunkach); wynik lokalny można przywrócić jednym kliknięciem.

Pro rozlicza się za każde użycie, dzięki czemu wersja bezpłatna pozostaje bezpłatna i lokalna: dopóki jest oferowane, logujesz się linkiem z e-maila (bez hasła), kupujesz 50 użyć za jednorazową opłatę 4,99 USD, bez subskrypcji, a każda poprawka z Pro zużywa jedno. Jeśli wywołanie usługi dostawcy zakończy się błędem, nie zostanie zużyte żadne płatne użycie.

Języki mieszane, na urządzeniu, celowo

Strona oferuje 21 języków: angielski, francuski, niemiecki, hiszpański, portugalski, włoski, polski, turecki, indonezyjski, wietnamski, chiński (uproszczony i tradycyjny), japoński, koreański, rosyjski, arabski, perski, urdu, hindi, bengalski i tajski — te, którymi mówi sam LensUp. Każdy język to osobny pakiet, pobierany tylko wtedy, gdy go wybierzesz: strona po francusku wymaga pakietu o rozmiarze 0,7 MB, a strona po chińsku — około 1,7 MB; cały zestaw nigdy nie jest pobierany. Wybierz język, w którym rzeczywiście wydrukowano tekst, i dodaj drugi, gdy strona łączy dwa; pakiet angielski jest automatycznie dołączany do pakietów koreańskiego, rosyjskiego, arabskiego, perskiego, urdu, hindi, bengalskiego i tajskiego, bo te pakiety same zamieniają angielskie słowa w podobnie wyglądające litery. Ze złym pakietem zamiast Markdowna wychodzą strzępy, wiersz stanu o tym informuje, a „Wykryj język” znajduje właściwy pakiet, próbując po jednym na system pisma — więc strona mieszana też staje się czystym Markdownem.

Wszystko działa lokalnie z użyciem silnika open source, tak jak reszta LensUp przetwarza obrazy: bez wysyłania, bez konta, bez kopii Twojego zdjęcia ani jego tekstu na serwerze. Pliki silnika i pakiety są serwowane z lensup.ai i zapisywane w pamięci podręcznej przeglądarki, więc drugie rozpoznanie w danym języku rusza natychmiast. Same narzędzia skanera nadal nie zawierają OCR i nie tworzą przeszukiwalnych PDF-ów.

Najczęstsze pytania

Czy obraz jest wysyłany z mojego urządzenia, gdy zamieniam obraz na Markdown?

W wersji bezpłatnej nie: silnik OCR i wybrany pakiet językowy są pobierane do Twojej przeglądarki i tam odbywa się rozpoznawanie, więc ani zdjęcie, ani rozpoznany tekst, ani plik .md nie trafiają na serwer LensUp. Jedyny wyjątek jest jawny i dobrowolny: gdy pole wyniku proponuje „Popraw z Pro” (płatna opcja widoczna przy włączonych płatnościach), to kliknięcie wysyła całe zdjęcie przez LensUp do Mathpix (komercyjnego systemu rozpoznawania wzorów i tabel) i przynosi jego Markdown; LensUp nie zapisuje zdjęcia podczas przesyłania (Mathpix przetwarza je na własnych warunkach), funkcja wymaga zalogowania się przez e-mail oraz wykupienia płatnych użyć (50 użyć za 4,99 USD, jednorazowo), a wynik lokalny można przywrócić.

Jakie języki obsługuje konwerter obrazu na Markdown?

Dwadzieścia jeden języków drukowanych: angielski, francuski, niemiecki, hiszpański, portugalski, włoski, polski, turecki, indonezyjski, wietnamski, chiński (uproszczony i tradycyjny), japoński, koreański, rosyjski, arabski, perski, urdu, hindi, bengalski i tajski. Strona może zawierać dwa z nich: wybierz główny, dodaj drugi dla strony mieszanej, a angielski jest czytany automatycznie obok koreańskiego, rosyjskiego, arabskiego, perskiego, urdu, hindi, bengalskiego i tajskiego, bo te pakiety same zamieniają angielskie słowa w podobnie wyglądające litery. Pismo odręczne nie jest obsługiwane w żadnym języku.

Dlaczego część tekstu jest błędna lub jej brakuje?

Najpierw sprawdź pakiet językowy: pod Markdownem pojawia się opcja „Wykryj język”, która próbuje po jednym pakiecie OCR na system pisma i zostawia najlepszy. Potem zdjęcie: rozmycie, odblaski, cienie, przekrzywienie, drobny druk, ozdobne czcionki i niespokojne tło obniżają jakość, a tabele lub strony wielokolumnowe mogą wyjść w złej kolejności. Ponownie sfotografuj płasko ułożoną stronę i zadbaj o ostrość, albo najpierw oczyść je w skanerze, a Markdown sprawdź przed użyciem.