OCR رایگان و محلی · ۲۱ زبان · صفحههای چندزبانه · بدون آپلود
تبدیل عکس به Markdown (OCR)
این ابزار تبدیل عکس به Markdown، عکس یا اسکرینشاتی از متن چاپی را بدون اینکه عکس را جایی بفرستد به Markdown تبدیل میکند. موتور OCR داخل مرورگر شما اجرا میشود، از ۲۱ زبان پشتیبانی میکند و صفحههای چندزبانه را هم میخواند: زبان اصلی متن را انتخاب میکنید، در صورت نیاز زبان دوم را، و بستهٔ انگلیسی خودبهخود در کنار بستهٔ زبانهایی بارگذاری میشود که بهتنهایی نمیتوانند انگلیسی را بخوانند. عکس روی دستگاه شما میماند و وقتی موتور و بستههای زبان یک بار دانلود شدند، مبدل آفلاین هم کار میکند.
عکس ← Markdown
یک عکس از متن چاپی انتخاب کنید
عکس یا اسکرینشاتی را که مرورگر میتواند بخواند انتخاب کنید، اینجا رها کنید یا با Ctrl+V / ⌘V بچسبانید. LensUp آن را آپلود نمیکند.
فقط متن چاپی. یک صفحه میتواند دو زبان داشته باشد: زبان اصلی را انتخاب کنید، زبان دوم را اضافه کنید، و بستهٔ انگلیسی کنار بستههای زبانی که بهتنهایی انگلیسی را نمیخوانند بارگذاری میشود. جدولهای خطدار جدول Markdown میشوند؛ دستخط، جدول بیخط، فرمول و ستونبندی تقریبیاند — پیش از اتکا بررسی کنید.
Pro کل این عکس را یک بار از طریق سرور LensUp به Mathpix — تشخیصدهندهای تجاری که فرمول و جدول میخواند — میفرستد و Markdown را با نتیجهٔ آن جایگزین میکند (فرمولها بهصورت $…$). LensUp عکس را ذخیره نمیکند؛ Mathpix آن را طبق شرایط خودش پردازش میکند. هر اصلاح یک اجرا مصرف میکند؛ قیمت ۵۰ اجرا ۴٫۹۹ دلار است؛ پرداخت یکباره است و اشتراکی در کار نیست.
تبدیل عکس به Markdown چطور انجام میشود؟
مبدل عکس به Markdown را باز کنید، یک عکس یا اسکرینشات از متن چاپی انتخاب کنید، زبان متن را چک کنید و «تشخیص متن» را بزنید. LensUp تشخیص متن را روی همین دستگاه شما انجام میدهد — اگر صفحه دو زبان دارد با زبان دوم، و با بارگذاری بستهٔ انگلیسی در کنار بستههای زبانی که بهتنهایی انگلیسی را نمیخوانند — پاراگرافها، بولتها و فهرستهای شمارهدار را به بلوکهای Markdown تبدیل میکند و میگذارد نتیجه را اصلاح کنید، کپی کنید یا بهصورت .md دانلود کنید. عکس هرگز آپلود نمیشود.
برای متنی ساخته شده که میخواهید بهصورت یادداشت نگه دارید نه عکس: صفحهای از کتاب یا جزوه، اسلایدی روی پروژکتور، خلاصهٔ تختهای که با حروف خوانا نوشته شده، دستور آشپزی چاپی، برچسب محصول، فرم، یا پاراگرافی روی پوستر. متن تشخیصدادهشده بهصورت Markdown قابلویرایش میآید؛ آمادهٔ Obsidian، Notion، ایشوی GitHub یا هر دفترچهٔ متنی ساده.
دامنهاش عمداً محدود است. فقط متن چاپی را میخواند، به زبانی که انتخاب میکنید بهعلاوهٔ یک زبان دوم اختیاری؛ ساختاری را که میبیند — پاراگراف، فهرست بولتدار، فهرست شمارهدار، تیترهای بزرگ و جدولهای خطدار — نگه میدارد و ستونبندی، دستخط و فرمولهای ریاضی را فقط بهصورت تقریبی به متن تبدیل میکند که باید خطبهخط بررسی شود. تبدیل عکس به Markdown، عکس به MD، تصویر به Markdown، اسکرینشات به Markdown، JPG به Markdown، استخراج متن از عکس: اسم فرق میکند، کار یکی است، و نتیجه همیشه Markdown است که قبل از اتکا به آن مرورش میکنید.
مراحل تبدیل عکس به Markdown
- یک عکس انتخاب کنیدعکس یا اسکرینشاتی از متن چاپی بردارید، روی ابزار بکشید یا با Ctrl+V / ⌘V از کلیپبورد بچسبانید. JPG، PNG، WebP، HEIC آیفون و TIFF همه بهصورت محلی خوانده میشوند؛ صفحه عکس و اندازهاش را نشان میدهد بیآنکه چیزی بفرستد.
- زبان را چک کنید و تشخیص بدهیدزبان متن چاپی را انتخاب کنید (منو زبان این صفحه را از قبل انتخاب کرده)، اگر صفحه دو زبان دارد زبان دوم را اضافه کنید و «تشخیص متن» را بزنید. بار اول موتور OCR (حدود ۱٫۵ مگابایت) و بستههای زبان لازم (هرکدام ۰٫۴ تا ۳ مگابایت) دانلود میشوند و بعد در حافظهٔ نهان میمانند. خواندن روی دستگاه شما و با نوار پیشرفت انجام میشود.
- بررسی کنید، کپی یا دانلود کنیدMarkdown در کادری قابلویرایش کنار عکس ظاهر میشود، همراه با تعداد کلمه یا نویسه و میانگین اطمینان. هرچه را موتور اشتباه خوانده اصلاح کنید، بعد در کلیپبورد کپی کنید یا فایل .md را دانلود کنید.
چه چیزی Markdown میشود و چه چیزی نه
هر پاراگراف چاپی یک پاراگراف Markdown میشود: سطرها به هم پیوسته میشوند و کلمههایی که با خط تیره در انتهای سطر شکستهاند دوباره جور میشوند؛ سطرهای چینی، ژاپنی و تایلندی بدون فاصله به هم میچسبند و بهجای کلمه، با نویسه شمرده میشوند. سطرهایی که با علامت بولت شروع میشوند فهرست میشوند؛ سطرهایی که با 1. و 2. و 3. — یا با 一、二、三 و 1、2、3 در متنهای شرق آسیا — شروع میشوند فهرست شمارهدار میشوند؛ و یک سطر کوتاه و تنها که آشکارا درشتتر از متن یا تماماً با حروف بزرگ چاپ شده، تیتر سطح دو میشود. بقیه به ترتیب خواندن، متن ساده میماند.
جدولی که با خط کشیده شده جدول Markdown میشود: شبکه پیش از تشخیص پاک میشود، هر سطر چاپی یک ردیف جدول میشود و فاصلههای مشترک ردیفها ستونها را میسازند؛ برای همین سلولهای ادغامشده و جدولهای بیخط بهصورت سطرهای متن بیرون میآیند. فرمولهای ریاضی تشخیص داده نمیشوند — کسرها، توانها و نمادها بههم میریزند؛ صفحهبندی دوستونی ممکن است درهم شود؛ دستخط، فونتهای تزئینی، حروف خیلی ریز و متن روی پسزمینهٔ شلوغ بد خوانده یا رد میشوند. اعداد، اسمها و کدها یک نگاه دوباره میارزند؛ یک نویسهٔ غلط آنجا از غلط توی پاراگراف سنگینتر است. میانگین اطمینانی که زیر نتیجه میبینید تخمین خود موتور است، نه تضمین.
چطور با دوربین گوشی عکسی بگیرید که تمیز خوانده شود
تشخیص متن روی صفحهای صاف با نوشتهٔ واضح و نور یکنواخت که از روبهرو عکس گرفته شده بهترین نتیجه را میدهد؛ چیزی حدود وضوح اسکن ۳۰۰ dpi. کادر را با متن پر کنید، از سایه و انعکاس دوری کنید و تا وقتی فوکوس قفل نشده تکان نخورید. عکسهای خیلی بزرگ پیش از تشخیص به ۲۶۰۰ پیکسل در ضلع بلند کوچک میشوند؛ متن معمولی کتاب و مدارک همچنان کاملاً خوانا میماند و در مصرف حافظه و زمان صرفهجویی میشود.
اگر صفحه کج یا سایهدار است، اول از اسکنر LensUp ردش کنید: اصلاح پرسپکتیو و حذف سایه یک صفحهٔ صاف و پرکنتراست میدهد، و JPG یا PNG دانلودشده از اسکنر ورودی خوبی برای اینجاست. اسکرینشات را هم میخواند — معمولاً سادهترین حالت ممکن.
وقتی موتور محلی کافی نیست: اصلاح با Pro
Tesseract، موتور متنباز پشت مسیر رایگان، فرمول ریاضی نمیخواند و با جدولهای بیخط یا سلولهای ادغامشده مشکل دارد. برای چنین صفحههایی کادر نتیجه ممکن است «اصلاح با Pro» را پیشنهاد کند — گزینهای پولی که با فعال شدن پرداخت در سایت ظاهر میشود: کل عکس یک بار از طریق سرور LensUp به Mathpix — تشخیصدهندهای تجاری که برای فرمول و جدول ساخته شده — فرستاده میشود و Markdown آن جای نتیجهٔ محلی را میگیرد؛ فرمولها بهصورت LaTeX میان علامت دلار و جدولها بهصورت جدول Markdown. LensUp در مسیر چیزی ذخیره نمیکند (Mathpix عکس را طبق شرایط خودش پردازش میکند)؛ نتیجهٔ محلی با یک کلیک برمیگردد.
هزینهٔ Pro بر اساس هر اجرا حساب میشود تا مسیر رایگان، رایگان و محلی بماند: تا وقتی ارائه میشود با لینک ایمیل وارد میشوید (بدون رمز)، ۵۰ اجرا را با یک پرداخت یکباره به ۴٫۹۹ دلار میخرید (بدون اشتراک) و هر اصلاح با Pro یکی مصرف میکند. اگر درخواست در سمت ارائهدهنده ناموفق باشد، هیچ اجرایی کم نمیشود.
پشتیبانی محلی و هدفمند از صفحههای چندزبانه
صفحه ۲۱ زبان دارد: انگلیسی، فرانسوی، آلمانی، اسپانیایی، پرتغالی، ایتالیایی، لهستانی، ترکی، اندونزیایی، ویتنامی، چینی (ساده و سنتی)، ژاپنی، کرهای، روسی، عربی، فارسی، اردو، هندی، بنگالی و تایلندی — همان زبانهایی که خود LensUp حرف میزند. هر زبان یک بستهٔ جداست که فقط وقتی انتخابش کنید دانلود میشود: صفحهٔ فرانسوی یک بستهٔ ۰٫۷ مگابایتی میخواهد و صفحهٔ چینی حدود ۱٫۷ مگابایت، و هیچوقت کل مجموعه دانلود نمیشود. زبانی را انتخاب کنید که واقعاً چاپ شده و اگر صفحه دو زبان دارد زبان دوم را اضافه کنید؛ انگلیسی خودبهخود کنار کرهای، روسی، عربی، فارسی، اردو، هندی، بنگالی و تایلندی بارگذاری میشود، چون بستهٔ این زبانها بهتنهایی کلمههای انگلیسی را به حروف شبیهشان تبدیل میکند. با بستهٔ اشتباه بهجای Markdown تکهپاره بیرون میآید، خط وضعیت این موضوع را اعلام میکند، و «تشخیص زبان» با امتحان یک بسته برای هر نظام نوشتاری، بستهٔ درست را پیدا میکند — پس صفحهٔ مخلوط هم Markdown تمیز میشود.
همهچیز بهصورت محلی با موتوری متنباز اجرا میشود، همانطور که LensUp بقیهٔ عکسها را پردازش میکند: بدون آپلود، بدون حساب، بدون نسخهای از عکس یا متن شما روی هیچ سروری. فایلهای موتور و بستهها از lensup.ai میآیند و مرورگرتان نگهشان میدارد، پس تشخیص دوم به همان زبان فوراً شروع میشود. ابزارهای اسکنر همچنان OCR ندارند و PDF قابلجستوجو نمیسازند.
پرسشهای متداول
وقتی عکس را به Markdown تبدیل میکنم، عکس از دستگاهم بیرون میرود؟
در مسیر رایگان نه: موتور OCR و بستهٔ زبانی که انتخاب میکنید به مرورگرتان دانلود میشوند و تشخیص همانجا انجام میشود، پس نه عکس، نه متن تشخیصدادهشده و نه فایل .md به سرور LensUp نمیرسد. تنها استثنا صریح و به انتخاب خودتان است: وقتی کادر نتیجه «اصلاح با Pro» را پیشنهاد میکند (گزینهای پولی که با فعال بودن پرداخت ظاهر میشود)، با کلیک روی آن، کل عکس از طریق LensUp به Mathpix (تشخیصدهندهای تجاری برای فرمول و جدول) فرستاده میشود و Markdown آن برمیگردد؛ LensUp در مسیر چیزی ذخیره نمیکند (Mathpix عکس را طبق شرایط خودش پردازش میکند)، ورود با ایمیل و اجراهای پولی لازم دارد (۵۰ اجرا به ۴٫۹۹ دلار، پرداخت یکباره)، و نتیجهٔ محلی قابلبازگردانی است.
تبدیل عکس به Markdown از چه زبانهایی پشتیبانی میکند؟
بیستویک زبان چاپی: انگلیسی، فرانسوی، آلمانی، اسپانیایی، پرتغالی، ایتالیایی، لهستانی، ترکی، اندونزیایی، ویتنامی، چینی (ساده و سنتی)، ژاپنی، کرهای، روسی، عربی، فارسی، اردو، هندی، بنگالی و تایلندی. یک صفحه میتواند دو تا از اینها را داشته باشد: زبان اصلی را انتخاب کنید، برای صفحهٔ مخلوط زبان دوم را اضافه کنید، و انگلیسی خودبهخود کنار کرهای، روسی، عربی، فارسی، اردو، هندی، بنگالی و تایلندی خوانده میشود، چون بستهٔ این زبانها بهتنهایی کلمههای انگلیسی را به حروف شبیهشان تبدیل میکند. دستخط در هیچ زبانی پشتیبانی نمیشود.
چرا بخشی از متن غلط است یا جا افتاده؟
اول بستهٔ زبان را چک کنید: هشدار زیر Markdown «تشخیص زبان» را پیشنهاد میکند که برای هر نظام نوشتاری یک بستهٔ OCR امتحان میکند و بهترین را نگه میدارد. بعد خود عکس: تاری، انعکاس، سایه، کجی، حروف ریز، فونت تزئینی و پسزمینهٔ شلوغ همه کیفیت تشخیص را پایین میآورند، و جدولها یا صفحههای چندستونی ممکن است با ترتیب غلط بیرون بیایند. صفحه را صاف بگذارید و عکس واضحتری بگیرید یا اول در اسکنر تمیزش کنید، بعد Markdown را پیش از استفاده بررسی کنید.