OCR ฟรีในเครื่อง · 21 ภาษา · ปนหลายภาษา · ไม่ต้องอัปโหลด

แปลงรูปเป็น Markdown (OCR)

ตัวแปลงรูปเป็น Markdown นี้เปลี่ยนรูปถ่ายหรือภาพหน้าจอที่มีตัวพิมพ์ให้เป็น Markdown โดยไม่ส่งรูปไปที่ไหนทั้งสิ้น เอนจิน OCR ทำงานอยู่ในเบราว์เซอร์ของคุณ รองรับ 21 ภาษา และอ่านหน้าที่ปนหลายภาษาได้: คุณเลือกภาษาหลักของข้อความ เพิ่มภาษาที่สองถ้าจำเป็น และระบบจะโหลดแพ็กภาษาอังกฤษให้อัตโนมัติเมื่อแพ็กภาษาที่เลือกอ่านคำภาษาอังกฤษไม่ได้ รูปอยู่บนเครื่องของคุณตลอด และเมื่อเอนจินกับแพ็กภาษาที่ใช้ดาวน์โหลดแล้วครั้งหนึ่ง ตัวแปลงก็ทำงานได้แม้ไม่มีอินเทอร์เน็ต

รูป → Markdown

เลือกรูปที่มีข้อความพิมพ์ 1 รูป

ในเบราว์เซอร์ของคุณเท่านั้น
รูป

เลือกรูปถ่ายหรือภาพหน้าจอที่เบราว์เซอร์อ่านได้ วางที่นี่ หรือวางด้วย Ctrl+V / ⌘V LensUp ไม่อัปโหลดมัน

ภาษาของข้อความ
ระบบเลือกไว้ตามภาษาของหน้านี้แล้ว โปรดเลือกภาษาที่พิมพ์อยู่บนหน้า

ตัวพิมพ์เท่านั้น หน้าหนึ่งมีได้สองภาษา: เลือกภาษาหลัก เพิ่มภาษาที่สอง และระบบจะเพิ่มภาษาอังกฤษให้กับชุดอักษรที่จำเป็นต้องใช้ ตารางที่มีเส้นกลายเป็นตาราง Markdown ผลลัพธ์จากลายมือ ตารางไม่มีเส้น สูตร และเลย์เอาต์หลายคอลัมน์อาจคลาดเคลื่อน — ตรวจก่อนเชื่อ

แปลงรูปเป็น Markdown ทำอย่างไร?

เปิดตัวแปลงรูปเป็น Markdown เลือกรูปถ่ายหรือภาพหน้าจอที่มีตัวพิมพ์ ตรวจภาษาของข้อความ แล้วกด “อ่านข้อความ” LensUp จะรัน OCR บนเครื่องของคุณเอง — พร้อมภาษาที่สองถ้าหน้านั้นปนสองภาษา และแพ็กอังกฤษสำหรับชุดอักษรที่ต้องใช้ — แล้วเปลี่ยนย่อหน้า หัวข้อย่อย และรายการแบบมีลำดับเป็นบล็อก Markdown ผลลัพธ์แก้ไข คัดลอก หรือดาวน์โหลดเป็น .md ได้ รูปไม่ถูกอัปโหลดเลย

เครื่องมือนี้เหมาะกับข้อความที่คุณอยากเก็บเป็นโน้ต ไม่ใช่เก็บเป็นรูป: หน้าหนังสือหรือเอกสารแจก สไลด์บนโปรเจกเตอร์ สรุปบนไวต์บอร์ดที่เขียนตัวพิมพ์ใหญ่เรียบร้อย สูตรอาหารที่พิมพ์ไว้ ฉลากสินค้า แบบฟอร์ม หรือย่อหน้าบนโปสเตอร์ ข้อความที่อ่านได้จะมาเป็น Markdown ที่แก้ไขได้ พร้อมนำไปวางใน Obsidian, Notion, issue บน GitHub หรือแอปจดโน้ตแบบข้อความล้วนใดก็ได้

เครื่องมือนี้ตั้งใจจำกัดขอบเขตให้แคบ มันอ่านเฉพาะตัวพิมพ์ ในภาษาหลักที่คุณเลือกและภาษาที่สองซึ่งเลือกเพิ่มได้อีกหนึ่งภาษา รักษาโครงสร้างที่มองเห็น — ย่อหน้า รายการหัวข้อย่อย รายการแบบมีลำดับ หัวเรื่องตัวใหญ่ และตารางที่มีเส้น — ไว้ใน Markdown ส่วนคอลัมน์ ลายมือ และสูตรคณิตศาสตร์จะออกมาเป็นข้อความโดยประมาณที่คุณควรไล่ตรวจทีละบรรทัด แปลงรูปเป็น Markdown, รูปเป็น MD, ภาพถ่ายเป็น Markdown, ภาพหน้าจอเป็น Markdown, JPG เป็น Markdown, OCR รูปเป็นข้อความ: ชื่อเรียกต่างกัน แต่งานเดียวกัน และผลลัพธ์จะเป็น Markdown ที่คุณควรตรวจสอบก่อนนำไปใช้ทุกครั้ง

วิธีแปลงรูปเป็น Markdown

  1. เลือกรูปหนึ่งรูปเลือกรูปถ่ายหรือภาพหน้าจอที่มีตัวพิมพ์ ลากมาวางบนเครื่องมือ หรือวางจากคลิปบอร์ดด้วย Ctrl+V / ⌘V ไฟล์ JPG, PNG, WebP, HEIC จาก iPhone และ TIFF จะถูกอ่านบนเครื่อง หน้านี้เพียงแสดงรูปและขนาดไฟล์โดยไม่อัปโหลดอะไร
  2. ตรวจภาษาแล้วอ่านเลือกภาษาของตัวพิมพ์ (เมนูเลือกภาษาของหน้านี้ไว้ให้แล้ว) เพิ่มภาษาที่สองถ้าหน้านั้นปนสองภาษา แล้วกด “อ่านข้อความ” ครั้งแรกจะดาวน์โหลดเอนจิน OCR (ราว 1.5 MB) กับแพ็กภาษาที่ต้องใช้ (แพ็กละ 0.4–3 MB) แล้วเก็บไว้ในแคช การอ่านเกิดขึ้นบนเครื่องของคุณพร้อมแถบความคืบหน้า
  3. ตรวจ คัดลอก หรือดาวน์โหลดMarkdown จะขึ้นในกล่องที่แก้ไขได้ข้างรูป พร้อมจำนวนคำหรือตัวอักษรและความมั่นใจเฉลี่ย แก้จุดที่เอนจินอ่านผิด แล้วคัดลอกไปคลิปบอร์ดหรือดาวน์โหลดเป็นไฟล์ .md

อะไรแปลงเป็น Markdown ได้ และอะไรไม่ได้

ข้อความพิมพ์แต่ละย่อหน้าจะกลายเป็นย่อหน้า Markdown หนึ่งย่อหน้า: ระบบจะรวมบรรทัดที่ต่อเนื่องกัน และเชื่อมคำที่ตัดด้วยยัติภังค์ท้ายบรรทัดกลับเข้าด้วยกัน บรรทัดจีน ญี่ปุ่น และไทยต่อกันโดยไม่เว้นวรรค และนับเป็นตัวอักษรแทนคำ บรรทัดที่ขึ้นต้นด้วยเครื่องหมายหัวข้อกลายเป็นรายการ บรรทัดที่ขึ้นต้นด้วย 1., 2., 3. — หรือ 一、二、三 และ 1、2、3 ในข้อความเอเชียตะวันออก — กลายเป็นรายการแบบมีลำดับ ส่วนบรรทัดสั้นที่อยู่โดดๆ และมีตัวอักษรใหญ่กว่าเนื้อความอย่างชัดเจน หรือเป็นตัวพิมพ์ใหญ่ทั้งหมด จะกลายเป็นหัวเรื่องระดับสอง ที่เหลือคงเป็นข้อความธรรมดาตามลำดับการอ่าน

ตารางที่ตีเส้นกลายเป็นตาราง Markdown: เส้นตารางถูกลบก่อนอ่าน แต่ละบรรทัดที่พิมพ์กลายเป็นแถว และช่องว่างที่ทุกแถวมีร่วมกันกลายเป็นคอลัมน์ ดังนั้นเซลล์ที่ผสานกันและตารางไม่มีเส้นจะออกมาเป็นบรรทัดข้อความ สูตรคณิตศาสตร์ไม่ถูกอ่าน — เศษส่วน เลขยกกำลัง และสัญลักษณ์อาจอ่านเพี้ยน เลย์เอาต์สองคอลัมน์อาจสลับกัน ลายมือ ฟอนต์ประดิษฐ์ ตัวเล็กมาก และข้อความบนพื้นหลังรกอ่านได้แย่หรือหายไป ตัวเลข ชื่อ และรหัสควรดูซ้ำอีกรอบ: ข้อผิดพลาดเพียงตัวเดียวในข้อมูลเหล่านี้อาจส่งผลมากกว่าข้อผิดพลาดในเนื้อความทั่วไป ความมั่นใจเฉลี่ยใต้ผลลัพธ์คือการประเมินของเอนจินเอง ไม่ใช่คำรับประกัน

ถ่ายด้วยมือถืออย่างไรให้ OCR อ่านได้ชัด

การรู้จำตัวอักษรทำงานได้ดีที่สุดกับหน้ากระดาษที่วางราบ ตัวอักษรคมชัด แสงสม่ำเสมอ และถ่ายตรงจากด้านหน้า ด้วยความชัดราวสแกน 300 dpi ให้ข้อความเต็มเฟรม เลี่ยงเงาและแสงสะท้อน และถือนิ่งจนโฟกัสล็อก รูปที่ใหญ่มากจะถูกย่อให้ด้านยาว 2600 px ก่อนอ่าน ตัวพิมพ์ในหนังสือและเอกสารทั่วไปยังอ่านได้ครบ แต่ประหยัดหน่วยความจำและเวลา

ถ้าหน้ากระดาษเอียงหรือมีเงา ให้ผ่านสแกนเนอร์ LensUp ก่อน: การแก้มุมมองและการลบเงาจะได้หน้ากระดาษที่เรียบและมีคอนทราสต์สูง และ JPG หรือ PNG ที่ดาวน์โหลดจากสแกนเนอร์เหมาะสำหรับนำมาอ่านต่อในเครื่องมือนี้ ตัวอ่านรับภาพหน้าจอด้วย ซึ่งมักเป็นกรณีที่ง่ายที่สุด

เมื่อเอนจินในเครื่องไม่พอ: แก้ด้วย Pro

Tesseract เอนจินโอเพนซอร์สที่ใช้ในโหมดฟรี อ่านสัญลักษณ์คณิตศาสตร์ไม่ได้ และมีปัญหากับตารางไม่มีเส้นหรือเซลล์ผสาน สำหรับหน้าแบบนั้น กล่องผลลัพธ์อาจเสนอ “แก้ด้วย Pro” — ตัวเลือกแบบเสียเงินที่ปรากฏเมื่อเปิดรับชำระเงินบนเว็บ: รูปทั้งรูปถูกส่งครั้งเดียว ผ่านเซิร์ฟเวอร์ LensUp ไปยัง Mathpix — ระบบ OCR เชิงพาณิชย์ที่ออกแบบมาสำหรับสูตรและตาราง — และ Markdown ของมันแทนที่ผลลัพธ์ในเครื่อง โดยสูตรเป็น LaTeX ระหว่างเครื่องหมายดอลลาร์และตารางเป็นตาราง Markdown LensUp ไม่เก็บรูปไว้ระหว่างการส่งต่อ (Mathpix ประมวลผลตามเงื่อนไขของตนเอง) และคุณเรียกคืนผลลัพธ์ที่ประมวลผลในเครื่องได้ในคลิกเดียว

Pro คิดเงินเป็นรายครั้งก็เพื่อให้เส้นทางฟรียังฟรีและอยู่ในเครื่อง: ตราบที่ยังเปิดให้ใช้ คุณเข้าสู่ระบบด้วยลิงก์ทางอีเมล (ไม่มีรหัสผ่าน) ซื้อแพ็ก 50 เครดิตในราคา US$4.99 แบบจ่ายครั้งเดียว ไม่มีค่าสมัครสมาชิก และการแก้ด้วย Pro แต่ละครั้งใช้หนึ่งเครดิต หากผู้ให้บริการประมวลผลไม่สำเร็จ ระบบจะไม่หักเครดิต

รองรับหลายภาษาในหน้าเดียว โดยประมวลผลบนเครื่อง

หน้านี้ให้ 21 ภาษา: อังกฤษ ฝรั่งเศส เยอรมัน สเปน โปรตุเกส อิตาลี โปแลนด์ ตุรกี อินโดนีเซีย เวียดนาม จีนตัวย่อและจีนตัวเต็ม ญี่ปุ่น เกาหลี รัสเซีย อาหรับ เปอร์เซีย อูรดู ฮินดี เบงกอล และไทย — ซึ่งเป็นภาษาที่ LensUp รองรับ แต่ละภาษาเป็นแพ็กแยกที่ดาวน์โหลดเฉพาะเมื่อคุณเลือก: หน้าฝรั่งเศสใช้แพ็ก 0.7 MB หน้าจีนราว 1.7 MB ไม่มีทางโหลดทั้งชุด เลือกภาษาที่พิมพ์อยู่จริงและเพิ่มภาษาที่สองเมื่อหน้านั้นปนกัน อังกฤษโหลดให้เองพร้อมเกาหลี รัสเซีย อาหรับ เปอร์เซีย อูรดู ฮินดี เบงกอล และไทย เพราะแพ็กเหล่านั้นเมื่ออยู่ลำพังจะเปลี่ยนคำอังกฤษเป็นตัวอักษรที่หน้าตาคล้ายกัน หากเลือกแพ็กผิด ข้อความจะกระจัดกระจายและไม่เป็น Markdown ที่อ่านรู้เรื่อง บรรทัดสถานะจะบอก และ “ตรวจหาภาษา” จะหาแพ็กที่ถูกโดยลองชุดอักษรละหนึ่งแพ็ก — หน้าที่ปนหลายภาษาจึงยังกลายเป็น Markdown สะอาดๆ

ทั้งหมดรันในเครื่องด้วยเอนจินโอเพนซอร์ส เหมือนที่ LensUp ประมวลผลรูปอื่นๆ: ไม่อัปโหลด ไม่มีบัญชี ไม่มีสำเนารูปหรือข้อความของคุณบนเซิร์ฟเวอร์ใด ไฟล์เอนจินและแพ็กเสิร์ฟจาก lensup.ai และเบราว์เซอร์แคชไว้ การอ่านครั้งที่สองในภาษาเดิมจึงเริ่มทันที เครื่องมือสแกนเนอร์ยังคงไม่มี OCR และไม่สร้าง PDF ที่ค้นหาได้

คำถามที่พบบ่อย

ตอนแปลงรูปเป็น Markdown รูปออกจากเครื่องของฉันไหม?

สำหรับการใช้งานฟรี รูปจะไม่ออกจากเครื่องของคุณ: เอนจิน OCR และแพ็กภาษาที่คุณเลือกถูกดาวน์โหลดลงเบราว์เซอร์ และการอ่านเกิดขึ้นตรงนั้น รูป ข้อความที่อ่านได้ และไฟล์ .md จึงไม่เคยไปถึงเซิร์ฟเวอร์ LensUp มีข้อยกเว้นเพียงอย่างเดียว ซึ่งระบบจะแจ้งไว้อย่างชัดเจนและเป็นการเลือกของคุณเอง: เมื่อกล่องผลลัพธ์เสนอ “แก้ด้วย Pro” (ตัวเลือกเสียเงินที่ปรากฏเมื่อเปิดรับชำระเงิน) การคลิกนั้นส่งรูปทั้งรูปผ่าน LensUp ไปยัง Mathpix (ตัวรู้จำเชิงพาณิชย์สำหรับสูตรและตาราง) แล้วนำ Markdown ของมันกลับมา LensUp ไม่เก็บรูปไว้ระหว่างการส่งต่อ (Mathpix ประมวลผลตามเงื่อนไขของตนเอง) ต้องเข้าสู่ระบบด้วยอีเมลและมีเครดิตแบบเสียเงิน (50 เครดิต US$4.99 จ่ายครั้งเดียว) และผลลัพธ์ในเครื่องเรียกคืนได้

ตัวแปลงรูปเป็น Markdown รองรับภาษาอะไรบ้าง?

รองรับข้อความตัวพิมพ์ 21 ภาษา: อังกฤษ ฝรั่งเศส เยอรมัน สเปน โปรตุเกส อิตาลี โปแลนด์ ตุรกี อินโดนีเซีย เวียดนาม จีนตัวย่อและจีนตัวเต็ม ญี่ปุ่น เกาหลี รัสเซีย อาหรับ เปอร์เซีย อูรดู ฮินดี เบงกอล และไทย หน้าหนึ่งมีได้สองภาษา: เลือกภาษาหลัก เพิ่มภาษาที่สองสำหรับหน้าที่ปนกัน และอังกฤษถูกอ่านให้เองพร้อมเกาหลี รัสเซีย อาหรับ เปอร์เซีย อูรดู ฮินดี เบงกอล และไทย เพราะแพ็กเหล่านั้นเมื่ออยู่ลำพังจะเปลี่ยนคำอังกฤษเป็นตัวอักษรที่หน้าตาคล้ายกัน ไม่รองรับลายมือในภาษาใดเลย

ทำไมข้อความบางส่วนผิดหรือหายไป?

ตรวจแพ็กภาษาก่อน: คำเตือนใต้ Markdown เสนอ “ตรวจหาภาษา” ซึ่งลองแพ็ก OCR ชุดอักษรละหนึ่งแพ็กแล้วเก็บอันที่ดีที่สุด จากนั้นดูรูป: เบลอ แสงสะท้อน เงา เอียง ตัวเล็ก ฟอนต์ประดิษฐ์ และพื้นหลังรกล้วนลดคุณภาพ และตารางหรือหน้าหลายคอลัมน์อาจออกมาผิดลำดับ ถ่ายใหม่ให้แบนและคม หรือทำความสะอาดในสแกนเนอร์ก่อน แล้วตรวจ Markdown ก่อนใช้