ข้ามไปยังเนื้อหา
PDFToucan หน้าแรก PDF Toucan

แปลง PDF เป็น Word ไม่ให้เพี้ยน: ลดปัญหาฟอนต์ ตาราง และสแกน

PDF Toucan editorial team · อัปเดตล่าสุด 20 กันยายน 2569 · อ่าน 8 นาที

แปลง PDF เป็น Word ไม่ให้เพี้ยน: ลดปัญหาฟอนต์ ตาราง และสแกน

การแปลง PDF เป็น Word ไม่ให้เพี้ยนทั้งหมดทำได้ยาก เพราะ PDF เก็บตำแหน่งองค์ประกอบแบบตายตัว แต่ Word ต้องสร้างใหม่เป็นย่อหน้า ตาราง และวัตถุที่แก้ไขได้ วิธีลดความคลาดเคลื่อนคือเริ่มจาก PDF ที่เลือกข้อความได้ ทำ OCR สำหรับไฟล์สแกน แล้วตรวจฟอนต์ ตาราง และการแบ่งหน้าก่อนนำไฟล์ DOCX ไปใช้งานจริง

ทำไมแปลง PDF เป็น Word แล้วรูปแบบถึงเพี้ยน?

PDF ออกแบบมาเพื่อให้หน้าตาเอกสารคงที่ ไม่ว่าจะเปิดบนเครื่องใดก็ตาม ภายในไฟล์จึงอาจเก็บตำแหน่งของตัวอักษร เส้น รูปภาพ และกล่องข้อความไว้เป็นพิกัดบนหน้า กระบวนการแปลงเป็น DOCX ต้องตีความพิกัดเหล่านั้นกลับมาเป็นโครงสร้างของ Word ซึ่งปรับไหลตามหน้ากระดาษและฟอนต์ได้ จึงไม่มีวิธีใดรับประกันว่าหน้าตาจะเหมือนเดิมทุกจุด

สาเหตุที่พบบ่อยมีดังนี้

  • ฟอนต์ถูกแทนที่: หากเครื่องไม่มีฟอนต์เดิม หรือฟอนต์นั้นรองรับอักขระไทยไม่ครบ Word จะใช้ฟอนต์อื่นแทน ความกว้างตัวอักษร ระยะบรรทัด และจุดตัดคำจึงเปลี่ยนตาม
  • ระยะห่างและการแบ่งหน้า: ความต่างเพียงเล็กน้อยของขอบกระดาษ ระยะก่อน-หลังย่อหน้า หรือความสูงบรรทัด อาจดันข้อความไปหน้าถัดไปและส่งผลต่อเนื่องทั้งเอกสาร
  • ตารางซับซ้อน: ตารางที่มีเซลล์รวม เส้นขอบหลายชั้น ตารางซ้อนตาราง หรือจัดวางข้อความอย่างอิสระ อาจกลายเป็นข้อความคั่นด้วยแท็บแทนตารางจริง
  • หลายคอลัมน์และกล่องข้อความ: เอกสารแบบวารสาร โบรชัวร์ หรือแบบฟอร์ม อาจถูกแปลงเป็นกล่องข้อความหรือคอลัมน์ที่ต้องจัดใหม่
  • หน้าสแกนเป็นภาพ: ไฟล์สแกนไม่มีชั้นข้อความให้ดึงออกมา การแปลงโดยตรงจึงได้หน้าเอกสารเป็นรูปภาพ ไม่ใช่ข้อความที่คลิกแก้ไขได้
ลักษณะ PDF ต้นฉบับแนวโน้มผลลัพธ์ใน Wordสิ่งที่ควรตรวจ
ข้อความดิจิทัล คอลัมน์เดียวค่อนข้างดีฟอนต์ ขอบกระดาษ การแบ่งหน้า
รายงานที่มีตารางทั่วไปดีแต่ต้องเกลาความกว้างคอลัมน์ เซลล์รวม ตัวเลข
เอกสารหลายคอลัมน์ปานกลางลำดับข้อความ กล่องข้อความ
สแกนชัดเจนผ่าน OCRข้อความใช้ได้ แต่เลย์เอาต์อาจคลาดชื่อ วันที่ ยอดเงิน และตาราง
สแกนเบลอหรือเอียงมากต้องแก้มากความถูกต้องของข้อความและตัวเลข

ต้องตรวจไฟล์ PDF อย่างไรก่อนแปลง?

ก่อนเริ่ม ควรแยกให้ได้ว่า PDF เป็นเอกสารข้อความดิจิทัลหรือเป็นภาพสแกน เพราะลำดับงานต่างกัน และช่วยลดการเสียเวลาจัดไฟล์ Word ที่แก้ไขไม่ได้

  1. เปิด PDF แล้วลองลากเลือกข้อความหนึ่งประโยค หากเลือกเป็นตัวอักษรและคัดลอกได้ ไฟล์มักพร้อมแปลงเป็น Word มากกว่า
  2. หากลากแล้วเลือกได้ทั้งหน้าเป็นกรอบภาพ หรือคัดลอกออกมาไม่ได้ ให้ถือว่าเป็นไฟล์สแกน และควรทำ OCR ก่อน
  3. จดหรือทำเครื่องหมายหน้าที่มีตาราง แบบฟอร์ม โลโก้ กราฟ เชิงอรรถ ข้อความหลายคอลัมน์ หรือรูปที่มีคำบรรยาย หน้ากลุ่มนี้ควรได้รับการตรวจละเอียดหลังแปลง
  4. ตรวจขนาดกระดาษและแนวกระดาษของต้นฉบับ เช่น A4 แนวตั้งหรือแนวนอน เพื่อใช้เทียบกับไฟล์ Word ภายหลัง
  5. หากมีลายเซ็นดิจิทัล ให้เก็บ PDF ต้นฉบับแยกไว้เสมอ เพราะการทำ OCR เปลี่ยนเนื้อหาไฟล์และทำให้ลายเซ็นดิจิทัลใช้ไม่ได้

แปลง PDF เป็น Word ด้วย PDF Toucan ทีละขั้นตอนได้อย่างไร?

สำหรับ PDF ที่มีข้อความเลือกได้ ใช้เครื่องมือ PDF เป็น Wordเพื่อสร้างไฟล์ DOCX แล้วเปิดตรวจแก้ใน Microsoft Word ขั้นตอนมีดังนี้

  1. เปิดหน้าเครื่องมือ แล้วกด เลือกไฟล์ PDF จะลากไฟล์มาวางที่ใดก็ได้บนหน้า หรือวางไฟล์จากคลิปบอร์ดก็ได้
  2. เพิ่มไฟล์ได้มากกว่าหนึ่งไฟล์ตามต้องการ โดยตรวจรายชื่อไฟล์ก่อนเริ่มแปลง
  3. กด แปลงเป็น Word และรอให้การประมวลผลเสร็จ
  4. กดดาวน์โหลดเอกสาร Word ที่ได้ แล้วเปิดไฟล์ DOCX ใน Microsoft Word
  5. เปิด PDF ต้นฉบับคู่กับไฟล์ Word และเริ่มตรวจจากจำนวนหน้า หัวข้อ และย่อหน้าแรกของแต่ละหน้า ก่อนลงมือแก้เนื้อหา

PDF Toucan ใช้งานผ่านเบราว์เซอร์โดยไม่ต้องสมัครสมาชิก ไม่มีลายน้ำ และไม่มีขีดจำกัดรายวันสำหรับเครื่องมือบนเบราว์เซอร์ โดยมีโฆษณาเป็นแหล่งสนับสนุนบริการ ไฟล์ถูกส่งผ่าน HTTPS ไปประมวลผลบนเซิร์ฟเวอร์ในสหภาพยุโรปในหน่วยความจำ ไม่บันทึกลงดิสก์ และจะถูกลบหลังดาวน์โหลดผลลัพธ์ หรืออย่างช้าที่สุดภายใน 10 นาที

ข้อจำกัดสำคัญคือ หน้าสแกนจะถูกเพิ่มเข้าเอกสาร Word เป็นรูปภาพ ไม่ได้ถูกแปลงเป็นข้อความโดยอัตโนมัติ หากต้องการค้นหา คัดลอก หรือพยายามแก้ไขข้อความจากหน้าสแกน ให้ทำ OCR ก่อน

PDF สแกนต้องทำ OCR ก่อนแปลงเป็น Word อย่างไร?

OCR คือการรู้จำตัวอักษรจากภาพ เพื่อเพิ่มชั้นข้อความที่ค้นหาและคัดลอกได้ให้ PDF แม้ OCR จะช่วยเรื่องข้อความ แต่ไม่ได้รับประกันว่าจะสร้างตารางและเลย์เอาต์ใน Word ได้สมบูรณ์ โดยเฉพาะเอกสารภาษาไทยที่สแกนไม่ชัด

  1. เปิดเครื่องมือ OCR PDFแล้วกด เลือกไฟล์ PDF หรือจะลากวางหรือวางจากคลิปบอร์ดก็ได้
  2. ในส่วนภาษาเอกสาร เลือกภาษาไทย และเพิ่มภาษาอื่นเฉพาะที่ปรากฏจริงในเอกสาร เช่น อังกฤษ การเลือกหลายภาษาทำให้ใช้เวลานานขึ้น
  3. สำหรับกรณีทั่วไป เลือก สแกนหน้าที่ไม่มีข้อความ ซึ่งเป็นตัวเลือกที่แนะนำ เพราะหน้าที่มีข้อความอยู่แล้วจะไม่ถูกแตะต้อง
  4. ใช้ รู้จำข้อความเดิมอีกครั้ง เฉพาะเมื่อชั้นข้อความ OCR เดิมอ่านผิดมาก ตัวเลือกนี้จะลบข้อความเดิมที่รู้จำไม่ดีแล้วอ่านใหม่
  5. ใช้ ถือว่าทุกหน้าเป็นภาพ เป็นทางเลือกสุดท้ายเท่านั้น เพราะข้อความและลิงก์ที่เลือกได้เดิมจะหายไป
  6. หากหน้าสแกนเอียง ให้เปิด ทำให้หน้าที่เอียงตรง และหากมีหน้ากลับหัวหรือแนวนอน ให้เปิด แก้ทิศทางหน้าอัตโนมัติ โปรดทราบว่าการทำให้หน้าที่เอียงตรงใช้ไม่ได้เมื่อเลือกการรู้จำข้อความเดิมอีกครั้ง
  7. กด รู้จำข้อความ ไฟล์หลายหน้าอาจใช้เวลาหลายนาที เมื่อเสร็จแล้วให้ดาวน์โหลด searchable PDF
  8. ลองค้นหาและคัดลอกข้อความใน PDF ที่ผ่าน OCR จากนั้นจึงนำไฟล์นั้นเข้าเครื่องมือ PDF เป็น Word

ควรพิสูจน์อักษรข้อความ OCR ก่อนเชื่อถือ โดยเฉพาะชื่อบุคคล เลขบัตร วันที่ เลขอ้างอิง ยอดเงิน และรหัสสินค้า ตัวเลขที่คล้ายกันหรือสระวรรณยุกต์ในภาพไม่ชัดมีโอกาสอ่านผิดได้

หลังแปลงแล้วควรตรวจและแก้ Word ตรงไหนบ้าง?

อย่าเริ่มแก้คำทีละคำทันที ให้แก้โครงสร้างที่กระทบทั้งเอกสารก่อน แล้วค่อยเก็บรายละเอียดตามลำดับนี้

  1. ตั้งค่าหน้ากระดาษ: ตรวจขนาดกระดาษ แนวกระดาษ ขอบกระดาษ และการแบ่งส่วนเอกสาร ความคลาดเคลื่อนจุดนี้ทำให้ข้อความเลื่อนทั้งหน้าได้
  2. เปรียบเทียบการแบ่งหน้า: ตรวจจำนวนหน้า หัวข้อ เลขหน้า และย่อหน้าแรก-สุดท้ายของหน้า หากข้อความเริ่มเลื่อนตั้งแต่ต้น ให้แก้ฟอนต์หรือระยะขอบก่อน
  3. ตรวจฟอนต์ไทย: ดูสระ วรรณยุกต์ ตัวหนา ตัวเอียง และการตัดบรรทัด เลือกฟอนต์ที่มีในเครื่องของผู้ที่จะเปิดไฟล์ และใช้ให้สม่ำเสมอทั้งเอกสาร
  4. ตรวจตารางทีละตาราง: ดูจำนวนคอลัมน์ ความกว้าง แถวที่ตัดข้ามหน้า เซลล์รวม เส้นขอบ และตำแหน่งตัวเลข หากผิดหลายเซลล์ การสร้างตารางใหม่ใน Word มักเร็วกว่าแก้ของเดิม
  5. จัดหัวกระดาษและท้ายกระดาษใหม่: ส่วนเหล่านี้อาจแปลงเป็นกล่องข้อความลอย ควรสร้างด้วยเครื่องมือหัวกระดาษ ท้ายกระดาษ และเลขหน้าใน Word หากต้องการให้ใช้งานต่อได้ถูกต้อง
  6. ตรวจรูปภาพและคำบรรยาย: ตรวจการตัดข้อความรอบรูป ตำแหน่งโลโก้ กล่องข้อความ เชิงอรรถ และเอกสารสองคอลัมน์ เพราะมักเลื่อนจากต้นฉบับ
  7. บันทึกและส่งกลับเป็น PDF: เมื่อแก้เสร็จ ให้บันทึก DOCX ไว้เป็นไฟล์ทำงาน หากต้องส่งเอกสารแบบคงหน้าตา สามารถใช้เครื่องมือ word-to-PDF ได้

เมื่อไรที่ควรคาดหวังผลลัพธ์ไม่สมบูรณ์?

เอกสารบางประเภทควรตั้งความคาดหวังว่าต้องจัดหน้าใหม่มากกว่าปกติ ไม่ใช่เพราะแปลงผิดเสมอไป แต่เพราะต้นฉบับไม่ได้มีโครงสร้างที่ Word นำกลับมาใช้ได้โดยตรง

  • ภาพสแกนความละเอียดต่ำ ตัวอักษรเล็ก มีเงา รอยตราประทับ พื้นหลังสี หรือลายมือ ทำให้ OCR อ่านไทย ตัวเลข และสัญลักษณ์ผิดได้
  • ตารางแน่นมาก ตารางซ้อนกัน ฟอร์มที่ออกแบบเป็นภาพ หรือข้อความวางทับกราฟิก มักต้องสร้างโครงสร้างใหม่ใน Word
  • PDF ที่ใช้ฟอนต์เฉพาะองค์กร ฝังฟอนต์ หรือแปลงข้อความเป็นเส้นกราฟิก อาจคงรูปลักษณ์ได้ยากแม้จะมองเห็นข้อความชัด
  • โบรชัวร์ นิตยสาร และเอกสารหลายคอลัมน์ที่ออกแบบหนัก บางครั้งจัดใหม่ด้วยตนเองเพียงไม่กี่หน้าจะเร็วกว่าพยายามซ่อมไฟล์ที่แปลงแล้ว
  • สัญญา ใบเสนอราคา รายงานตรวจสอบ หรือเอกสารที่ต้องตรงตามต้นฉบับ ควรเทียบทุกหน้ากับ PDF และเก็บไฟล์ต้นฉบับเป็นเอกสารอ้างอิง

หากนโยบายองค์กรห้ามส่งเอกสารไปยังบริการภายนอก ไม่ควรอัปโหลดไฟล์ แม้บริการจะประมวลผลในหน่วยความจำและลบไฟล์ตามระยะเวลาที่ระบุไว้ก็ตาม

คำถามที่พบบ่อย

แปลง PDF เป็น Word แล้วตัวอักษรไทยเพี้ยน แก้อย่างไร?

ตรวจว่าฟอนต์เดิมมีอยู่ในเครื่องหรือไม่ แล้วเลือกฟอนต์ไทยที่รองรับอักขระครบและมีใช้งานร่วมกันในองค์กร จากนั้นตรวจการตัดบรรทัด ระยะบรรทัด และจำนวนหน้าใหม่ เพราะการเปลี่ยนฟอนต์เพียงจุดเดียวอาจทำให้ข้อความทั้งเอกสารเลื่อน

PDF ที่สแกนเป็นรูปภาพแปลงเป็น Word ให้แก้ไขข้อความได้ไหม?

แปลงโดยตรงแล้วหน้าสแกนจะถูกเพิ่มเป็นรูปภาพ จึงแก้ไขข้อความในย่อหน้าไม่ได้ ควรทำ OCR ก่อนเพื่อให้ PDF ค้นหาและคัดลอกข้อความได้ แล้วจึงแปลงเป็น Word อย่างไรก็ตาม ต้องตรวจผลอีกครั้ง เพราะข้อความและโครงสร้างตารางอาจไม่สมบูรณ์

ทำ OCR ภาษาไทยควรเลือกตัวเลือกใด?

เลือกภาษาไทยและเพิ่มเฉพาะภาษาอื่นที่มีจริงในเอกสาร สำหรับงานทั่วไปให้เลือก สแกนหน้าที่ไม่มีข้อความ เพื่อคงหน้าที่มีชั้นข้อความเดิมไว้ เปิดการปรับหน้าเอียงและทิศทางอัตโนมัติเมื่อจำเป็น และตรวจชื่อ วันที่ ตัวเลขทุกครั้งหลัง OCR

ทำไมตารางใน PDF กลายเป็นข้อความเมื่อเปิดใน Word?

PDF อาจเก็บตารางเป็นเพียงตำแหน่งของข้อความและเส้น ไม่ได้เก็บความสัมพันธ์ว่าเซลล์ใดอยู่แถวหรือคอลัมน์เดียวกัน โดยเฉพาะตารางที่มีเซลล์รวม ตารางซ้อน หรือการวางข้อมูลอิสระ จึงอาจถูกตีความเป็นข้อความคั่นด้วยแท็บแทนตารางจริง

การทำ OCR มีผลต่อลายเซ็นดิจิทัลใน PDF หรือไม่?

มีผล การรู้จำข้อความเปลี่ยนเนื้อหาภายใน PDF จึงทำให้ลายเซ็นดิจิทัลไม่สามารถใช้ยืนยันไฟล์ผลลัพธ์ได้ ควรเก็บ PDF ที่ลงลายเซ็นแล้วไว้เป็นต้นฉบับเสมอ และใช้ไฟล์ผ่าน OCR เป็นสำเนาสำหรับค้นหา คัดลอก หรือทำงานต่อเท่านั้น

วิธี แปลง PDF เป็น Word ออนไลน์
วิธี แปลง PDF เป็น Word ออนไลน์

คู่มือที่เกี่ยวข้อง