การแปลแบบออฟไลน์ทำงานบน iPhone ของคุณอย่างไร

Last updated: 2026-09-03

การแปลแบบออฟไลน์ทำงานบน iPhone ของคุณอย่างไร

ไปป์ไลน์การแปลของแอปทำงานบนอุปกรณ์ทั้งหมด ไม่มีรูปภาพ ไม่มีผลลัพธ์ OCR และไม่มีคำขอแปลใดๆ ออกจาก iPhone บทความนี้อธิบายว่า "บนอุปกรณ์" หมายถึงอะไรจริงๆ โมเดลอยู่ที่ไหน และการแลกเปลี่ยนใดที่มาพร้อมกับการเรียกใช้การแปลในเครื่อง

ชิ้นส่วนที่ทำงานบนอุปกรณ์

มีงานอิสระสามงานที่เกิดขึ้นบนโทรศัพท์สำหรับการแปลด้วยกล้อง:

  1. OCR แพ็กเกจ vision_text_recognition ที่ fork แล้วจะเรียกใช้การรู้จำข้อความในเครื่อง รองรับสคริปต์ละติน จีน (ตัวย่อและตัวเต็ม) ญี่ปุ่น และเกาหลี บล็อกข้อความที่รู้จำแต่ละบล็อกมี bounding box และข้อความที่ตรวจพบของตัวเอง
  2. การแปล เอนจินการแปลบนอุปกรณ์ของ Google ML Kit รับเอาต์พุต OCR และสร้างข้อความที่แปลแล้ว เอนจินถูกรวมเป็นโมเดลภาษาที่ดาวน์โหลดได้ต่อคู่ภาษา แอปจะดาวน์โหลดโมเดลตามความต้องการและแคชไว้ในดิสก์
  3. การเรนเดอร์ หน้าผลลัพธ์จะวาดแต่ละบล็อกที่แปลแล้วทับบนรูปถ่ายต้นฉบับ โดยใช้ bounding box ที่เอนจิน OCR ส่งคืน ไม่จำเป็นต้องมีการเดินทางไปกลับเซิร์ฟเวอร์เพื่อเรนเดอร์การซ้อนทับ — รูปภาพ บล็อกต้นทาง และการแปลอาศัยอยู่ในหน่วยความจำบนอุปกรณ์

ทำไมเรื่องนี้ถึงสำคัญ

โมเดลอยู่ที่ไหน

ML Kit เผยแพร่โมเดลการแปลบนอุปกรณ์สำหรับ 19 ภาษา แต่ละโมเดลมีขนาดประมาณ 10–50 MB เมื่อคุณเลือกภาษาต้นทางหรือเป้าหมาย แอปจะดาวน์โหลดโมเดลที่เกี่ยวข้องไปยังแซนด์บ็อกซ์ในเครื่องของแอปเมื่อใช้งานครั้งแรก โมเดลยังคงอยู่ตลอดการรีสตาร์ทแอป การลบจะเรียกคืนพื้นที่จัดเก็บทันที

รายการเต็มของภาษาที่รองรับ: อาหรับ จีน (ตัวย่อ) เช็ก ดัตช์ อังกฤษ ฝรั่งเศส เยอรมัน โครเอเชีย ฮังการี อิตาลี ญี่ปุ่น เกาหลี โปแลนด์ โปรตุเกส โรมาเนีย รัสเซีย สโลวัก สโลเวเนีย และสเปน

สิ่งที่อัปโหลด (และสิ่งที่ไม่)

ข้อแลกเปลี่ยนของการรันในเครื่อง

สิ่งนี้มีความหมายอย่างไรต่อคุณ

หากคุณเคยลังเลที่จะถ่ายรูปเอกสารที่ละเอียดอ่อนเพราะรูปจะไปอยู่บนเซิร์ฟเวอร์ของคนอื่น ความลังเลนั้นเป็นเหตุผลที่แอปนี้มีอยู่ ทุกส่วนของไปป์ไลน์ทำงานในเครื่อง และโมเดลข้อมูลของแอปได้รับการออกแบบโดยมีสมมติฐานว่าไม่มีอะไรออกจากอุปกรณ์เว้นแต่ผู้ใช้จะเลือกแชร์ผลลัพธ์อย่างชัดเจน