OCR رایگان و محلی · ۲۱ زبان · صفحه‌های چندزبانه · بدون آپلود

تبدیل عکس به Markdown (OCR)

این ابزار تبدیل عکس به Markdown، عکس یا اسکرین‌شاتی از متن چاپی را بدون این‌که عکس را جایی بفرستد به Markdown تبدیل می‌کند. موتور OCR داخل مرورگر شما اجرا می‌شود، از ۲۱ زبان پشتیبانی می‌کند و صفحه‌های چندزبانه را هم می‌خواند: زبان اصلی متن را انتخاب می‌کنید، در صورت نیاز زبان دوم را، و بستهٔ انگلیسی خودبه‌خود در کنار بستهٔ زبان‌هایی بارگذاری می‌شود که به‌تنهایی نمی‌توانند انگلیسی را بخوانند. عکس روی دستگاه شما می‌ماند و وقتی موتور و بسته‌های زبان یک بار دانلود شدند، مبدل آفلاین هم کار می‌کند.

عکس ← Markdown

یک عکس از متن چاپی انتخاب کنید

فقط داخل مرورگر
عکس

عکس یا اسکرین‌شاتی را که مرورگر می‌تواند بخواند انتخاب کنید، این‌جا رها کنید یا با Ctrl+V / ⌘V بچسبانید. LensUp آن را آپلود نمی‌کند.

زبان متن
بر اساس زبان این صفحه از قبل انتخاب شده. زبانی را انتخاب کنید که روی صفحه چاپ شده.

فقط متن چاپی. یک صفحه می‌تواند دو زبان داشته باشد: زبان اصلی را انتخاب کنید، زبان دوم را اضافه کنید، و بستهٔ انگلیسی کنار بسته‌های زبانی که به‌تنهایی انگلیسی را نمی‌خوانند بارگذاری می‌شود. جدول‌های خط‌دار جدول Markdown می‌شوند؛ دست‌خط، جدول بی‌خط، فرمول و ستون‌بندی تقریبی‌اند — پیش از اتکا بررسی کنید.

تبدیل عکس به Markdown چطور انجام می‌شود؟

مبدل عکس به Markdown را باز کنید، یک عکس یا اسکرین‌شات از متن چاپی انتخاب کنید، زبان متن را چک کنید و «تشخیص متن» را بزنید. LensUp تشخیص متن را روی همین دستگاه شما انجام می‌دهد — اگر صفحه دو زبان دارد با زبان دوم، و با بارگذاری بستهٔ انگلیسی در کنار بسته‌های زبانی که به‌تنهایی انگلیسی را نمی‌خوانند — پاراگراف‌ها، بولت‌ها و فهرست‌های شماره‌دار را به بلوک‌های Markdown تبدیل می‌کند و می‌گذارد نتیجه را اصلاح کنید، کپی کنید یا به‌صورت .md دانلود کنید. عکس هرگز آپلود نمی‌شود.

برای متنی ساخته شده که می‌خواهید به‌صورت یادداشت نگه دارید نه عکس: صفحه‌ای از کتاب یا جزوه، اسلایدی روی پروژکتور، خلاصهٔ تخته‌ای که با حروف خوانا نوشته شده، دستور آشپزی چاپی، برچسب محصول، فرم، یا پاراگرافی روی پوستر. متن تشخیص‌داده‌شده به‌صورت Markdown قابل‌ویرایش می‌آید؛ آمادهٔ Obsidian، Notion، ایشوی GitHub یا هر دفترچهٔ متنی ساده.

دامنه‌اش عمداً محدود است. فقط متن چاپی را می‌خواند، به زبانی که انتخاب می‌کنید به‌علاوهٔ یک زبان دوم اختیاری؛ ساختاری را که می‌بیند — پاراگراف، فهرست بولت‌دار، فهرست شماره‌دار، تیترهای بزرگ و جدول‌های خط‌دار — نگه می‌دارد و ستون‌بندی، دست‌خط و فرمول‌های ریاضی را فقط به‌صورت تقریبی به متن تبدیل می‌کند که باید خط‌به‌خط بررسی شود. تبدیل عکس به Markdown، عکس به MD، تصویر به Markdown، اسکرین‌شات به Markdown، JPG به Markdown، استخراج متن از عکس: اسم فرق می‌کند، کار یکی است، و نتیجه همیشه Markdown است که قبل از اتکا به آن مرورش می‌کنید.

مراحل تبدیل عکس به Markdown

  1. یک عکس انتخاب کنیدعکس یا اسکرین‌شاتی از متن چاپی بردارید، روی ابزار بکشید یا با Ctrl+V / ⌘V از کلیپ‌بورد بچسبانید. JPG، PNG، WebP، HEIC آیفون و TIFF همه به‌صورت محلی خوانده می‌شوند؛ صفحه عکس و اندازه‌اش را نشان می‌دهد بی‌آن‌که چیزی بفرستد.
  2. زبان را چک کنید و تشخیص بدهیدزبان متن چاپی را انتخاب کنید (منو زبان این صفحه را از قبل انتخاب کرده)، اگر صفحه دو زبان دارد زبان دوم را اضافه کنید و «تشخیص متن» را بزنید. بار اول موتور OCR (حدود ۱٫۵ مگابایت) و بسته‌های زبان لازم (هرکدام ۰٫۴ تا ۳ مگابایت) دانلود می‌شوند و بعد در حافظهٔ نهان می‌مانند. خواندن روی دستگاه شما و با نوار پیشرفت انجام می‌شود.
  3. بررسی کنید، کپی یا دانلود کنیدMarkdown در کادری قابل‌ویرایش کنار عکس ظاهر می‌شود، همراه با تعداد کلمه یا نویسه و میانگین اطمینان. هرچه را موتور اشتباه خوانده اصلاح کنید، بعد در کلیپ‌بورد کپی کنید یا فایل .md را دانلود کنید.

چه چیزی Markdown می‌شود و چه چیزی نه

هر پاراگراف چاپی یک پاراگراف Markdown می‌شود: سطرها به هم پیوسته می‌شوند و کلمه‌هایی که با خط تیره در انتهای سطر شکسته‌اند دوباره جور می‌شوند؛ سطرهای چینی، ژاپنی و تایلندی بدون فاصله به هم می‌چسبند و به‌جای کلمه، با نویسه شمرده می‌شوند. سطرهایی که با علامت بولت شروع می‌شوند فهرست می‌شوند؛ سطرهایی که با 1. و 2. و 3. — یا با 一、二、三 و 1、2、3 در متن‌های شرق آسیا — شروع می‌شوند فهرست شماره‌دار می‌شوند؛ و یک سطر کوتاه و تنها که آشکارا درشت‌تر از متن یا تماماً با حروف بزرگ چاپ شده، تیتر سطح دو می‌شود. بقیه به ترتیب خواندن، متن ساده می‌ماند.

جدولی که با خط کشیده شده جدول Markdown می‌شود: شبکه پیش از تشخیص پاک می‌شود، هر سطر چاپی یک ردیف جدول می‌شود و فاصله‌های مشترک ردیف‌ها ستون‌ها را می‌سازند؛ برای همین سلول‌های ادغام‌شده و جدول‌های بی‌خط به‌صورت سطرهای متن بیرون می‌آیند. فرمول‌های ریاضی تشخیص داده نمی‌شوند — کسرها، توان‌ها و نمادها به‌هم می‌ریزند؛ صفحه‌بندی دوستونی ممکن است درهم شود؛ دست‌خط، فونت‌های تزئینی، حروف خیلی ریز و متن روی پس‌زمینهٔ شلوغ بد خوانده یا رد می‌شوند. اعداد، اسم‌ها و کدها یک نگاه دوباره می‌ارزند؛ یک نویسهٔ غلط آن‌جا از غلط توی پاراگراف سنگین‌تر است. میانگین اطمینانی که زیر نتیجه می‌بینید تخمین خود موتور است، نه تضمین.

چطور با دوربین گوشی عکسی بگیرید که تمیز خوانده شود

تشخیص متن روی صفحه‌ای صاف با نوشتهٔ واضح و نور یکنواخت که از روبه‌رو عکس گرفته شده بهترین نتیجه را می‌دهد؛ چیزی حدود وضوح اسکن ۳۰۰ dpi. کادر را با متن پر کنید، از سایه و انعکاس دوری کنید و تا وقتی فوکوس قفل نشده تکان نخورید. عکس‌های خیلی بزرگ پیش از تشخیص به ۲۶۰۰ پیکسل در ضلع بلند کوچک می‌شوند؛ متن معمولی کتاب و مدارک همچنان کاملاً خوانا می‌ماند و در مصرف حافظه و زمان صرفه‌جویی می‌شود.

اگر صفحه کج یا سایه‌دار است، اول از اسکنر LensUp ردش کنید: اصلاح پرسپکتیو و حذف سایه یک صفحهٔ صاف و پرکنتراست می‌دهد، و JPG یا PNG دانلودشده از اسکنر ورودی خوبی برای این‌جاست. اسکرین‌شات را هم می‌خواند — معمولاً ساده‌ترین حالت ممکن.

وقتی موتور محلی کافی نیست: اصلاح با Pro

Tesseract، موتور متن‌باز پشت مسیر رایگان، فرمول ریاضی نمی‌خواند و با جدول‌های بی‌خط یا سلول‌های ادغام‌شده مشکل دارد. برای چنین صفحه‌هایی کادر نتیجه ممکن است «اصلاح با Pro» را پیشنهاد کند — گزینه‌ای پولی که با فعال شدن پرداخت در سایت ظاهر می‌شود: کل عکس یک بار از طریق سرور LensUp به Mathpix — تشخیص‌دهنده‌ای تجاری که برای فرمول و جدول ساخته شده — فرستاده می‌شود و Markdown آن جای نتیجهٔ محلی را می‌گیرد؛ فرمول‌ها به‌صورت LaTeX میان علامت دلار و جدول‌ها به‌صورت جدول Markdown. LensUp در مسیر چیزی ذخیره نمی‌کند (Mathpix عکس را طبق شرایط خودش پردازش می‌کند)؛ نتیجهٔ محلی با یک کلیک برمی‌گردد.

هزینهٔ Pro بر اساس هر اجرا حساب می‌شود تا مسیر رایگان، رایگان و محلی بماند: تا وقتی ارائه می‌شود با لینک ایمیل وارد می‌شوید (بدون رمز)، ۵۰ اجرا را با یک پرداخت یک‌باره به ۴٫۹۹ دلار می‌خرید (بدون اشتراک) و هر اصلاح با Pro یکی مصرف می‌کند. اگر درخواست در سمت ارائه‌دهنده ناموفق باشد، هیچ اجرایی کم نمی‌شود.

پشتیبانی محلی و هدفمند از صفحه‌های چندزبانه

صفحه ۲۱ زبان دارد: انگلیسی، فرانسوی، آلمانی، اسپانیایی، پرتغالی، ایتالیایی، لهستانی، ترکی، اندونزیایی، ویتنامی، چینی (ساده و سنتی)، ژاپنی، کره‌ای، روسی، عربی، فارسی، اردو، هندی، بنگالی و تایلندی — همان زبان‌هایی که خود LensUp حرف می‌زند. هر زبان یک بستهٔ جداست که فقط وقتی انتخابش کنید دانلود می‌شود: صفحهٔ فرانسوی یک بستهٔ ۰٫۷ مگابایتی می‌خواهد و صفحهٔ چینی حدود ۱٫۷ مگابایت، و هیچ‌وقت کل مجموعه دانلود نمی‌شود. زبانی را انتخاب کنید که واقعاً چاپ شده و اگر صفحه دو زبان دارد زبان دوم را اضافه کنید؛ انگلیسی خودبه‌خود کنار کره‌ای، روسی، عربی، فارسی، اردو، هندی، بنگالی و تایلندی بارگذاری می‌شود، چون بستهٔ این زبان‌ها به‌تنهایی کلمه‌های انگلیسی را به حروف شبیه‌شان تبدیل می‌کند. با بستهٔ اشتباه به‌جای Markdown تکه‌پاره بیرون می‌آید، خط وضعیت این موضوع را اعلام می‌کند، و «تشخیص زبان» با امتحان یک بسته برای هر نظام نوشتاری، بستهٔ درست را پیدا می‌کند — پس صفحهٔ مخلوط هم Markdown تمیز می‌شود.

همه‌چیز به‌صورت محلی با موتوری متن‌باز اجرا می‌شود، همان‌طور که LensUp بقیهٔ عکس‌ها را پردازش می‌کند: بدون آپلود، بدون حساب، بدون نسخه‌ای از عکس یا متن شما روی هیچ سروری. فایل‌های موتور و بسته‌ها از lensup.ai می‌آیند و مرورگرتان نگهشان می‌دارد، پس تشخیص دوم به همان زبان فوراً شروع می‌شود. ابزارهای اسکنر همچنان OCR ندارند و PDF قابل‌جست‌وجو نمی‌سازند.

پرسش‌های متداول

وقتی عکس را به Markdown تبدیل می‌کنم، عکس از دستگاهم بیرون می‌رود؟

در مسیر رایگان نه: موتور OCR و بستهٔ زبانی که انتخاب می‌کنید به مرورگرتان دانلود می‌شوند و تشخیص همان‌جا انجام می‌شود، پس نه عکس، نه متن تشخیص‌داده‌شده و نه فایل .md به سرور LensUp نمی‌رسد. تنها استثنا صریح و به انتخاب خودتان است: وقتی کادر نتیجه «اصلاح با Pro» را پیشنهاد می‌کند (گزینه‌ای پولی که با فعال بودن پرداخت ظاهر می‌شود)، با کلیک روی آن، کل عکس از طریق LensUp به Mathpix (تشخیص‌دهنده‌ای تجاری برای فرمول و جدول) فرستاده می‌شود و Markdown آن برمی‌گردد؛ LensUp در مسیر چیزی ذخیره نمی‌کند (Mathpix عکس را طبق شرایط خودش پردازش می‌کند)، ورود با ایمیل و اجراهای پولی لازم دارد (۵۰ اجرا به ۴٫۹۹ دلار، پرداخت یک‌باره)، و نتیجهٔ محلی قابل‌بازگردانی است.

تبدیل عکس به Markdown از چه زبان‌هایی پشتیبانی می‌کند؟

بیست‌ویک زبان چاپی: انگلیسی، فرانسوی، آلمانی، اسپانیایی، پرتغالی، ایتالیایی، لهستانی، ترکی، اندونزیایی، ویتنامی، چینی (ساده و سنتی)، ژاپنی، کره‌ای، روسی، عربی، فارسی، اردو، هندی، بنگالی و تایلندی. یک صفحه می‌تواند دو تا از این‌ها را داشته باشد: زبان اصلی را انتخاب کنید، برای صفحهٔ مخلوط زبان دوم را اضافه کنید، و انگلیسی خودبه‌خود کنار کره‌ای، روسی، عربی، فارسی، اردو، هندی، بنگالی و تایلندی خوانده می‌شود، چون بستهٔ این زبان‌ها به‌تنهایی کلمه‌های انگلیسی را به حروف شبیه‌شان تبدیل می‌کند. دست‌خط در هیچ زبانی پشتیبانی نمی‌شود.

چرا بخشی از متن غلط است یا جا افتاده؟

اول بستهٔ زبان را چک کنید: هشدار زیر Markdown «تشخیص زبان» را پیشنهاد می‌کند که برای هر نظام نوشتاری یک بستهٔ OCR امتحان می‌کند و بهترین را نگه می‌دارد. بعد خود عکس: تاری، انعکاس، سایه، کجی، حروف ریز، فونت تزئینی و پس‌زمینهٔ شلوغ همه کیفیت تشخیص را پایین می‌آورند، و جدول‌ها یا صفحه‌های چندستونی ممکن است با ترتیب غلط بیرون بیایند. صفحه را صاف بگذارید و عکس واضح‌تری بگیرید یا اول در اسکنر تمیزش کنید، بعد Markdown را پیش از استفاده بررسی کنید.