หลักฐานใหม่ในศาลแมนฮัตตัน: การรับรู้ของฝ่ายบริหารต่อข้อมูลละเมิดลิขสิทธิ์

เอกสารประกอบคำร้องขอให้ศาลมีคำพิพากษาโดยไม่ต้องไต่สวน (Summary Judgment) ในคดี Authors Guild et al. v. OpenAI Inc., Microsoft Corp. (หมายเลขคดี 1:23-cv-10211) ประจำศาลแขวงรัฐบาลกลางสหรัฐฯ ประจำเขตแมนฮัตตัน ได้รับการเปิดผนึกสู่สาธารณะเมื่อช่วงวันที่ 18–21 กันยายน 2026 โดยสมาคม Authors Guild ได้เผยแพร่ข้อมูลอย่างเป็นทางการเมื่อวันที่ 21 กันยายน 2026 เอกสารดังกล่าวเปิดเผยบันทึก บันทึกคำให้การ และอีเมลภายใน ซึ่งแสดงให้เห็นว่านักวิจัยและผู้บริหารระดับสูงของ OpenAI ทราบดีถึงการนำชุดข้อมูลหนังสือละเมิดลิขสิทธิ์มาใช้ในการฝึกฝนโมเดลปัญญาประดิษฐ์มาตั้งแต่ปี 2018

ตามบันทึกการไต่สวน ทีมนักวิจัยของ OpenAI ได้ดาวน์โหลดไฟล์หนังสือจากคลังข้อมูลผิดกฎหมาย Library Genesis (LibGen) เพื่อนำมาประกอบเป็นชุดข้อมูลฝึกสอนที่มีชื่อรหัสว่า 'Books1' และ 'Books2' ซึ่งต่อมาถูกนำไปใช้ฝึกฝนโมเดลพื้นฐานตระกูล GPT-3 และ GPT-3.5 โดยในเดือนเมษายน 2019 มีหลักฐานระบุว่า Sam Altman ประธานเจ้าหน้าที่บริหาร และ Dario Amodei ซึ่งดำรงตำแหน่งผู้อำนวยการฝ่ายวิจัยของ OpenAI ในขณะนั้น ได้นำเสนอโมเดล GPT-3 รุ่นต้นแบบแก่ Bill Gates และ Kevin Scott ประธานเจ้าหน้าที่ฝ่ายเทคโนโลยีของ Microsoft พร้อมระบุอย่างเปิดเผยถึงการพึ่งพาข้อมูลจาก LibGen

เอกสารคำฟ้องระบุว่า ผู้บริหารของบริษัทรับทราบข้อจำกัดทางกฎหมายและความเสี่ยงด้านภาพลักษณ์อย่างชัดเจน โดยมีบทสนทนาระหว่าง Dario Amodei และ Sam McCandlish อดีตนักวิจัยของ OpenAI ที่แสดงความวิตกกังวลว่าบริษัทอาจตกเป็นเป้าหมายของการวิพากษ์วิจารณ์ในประเด็นการนำข้อมูลที่มีลิขสิทธิ์จากเว็บไซต์สัญชาติรัสเซียมาใช้ในการพัฒนาเทคโนโลยีเชิงพาณิชย์

ปฏิบัติการ 'Project Clear' และการประเมินผลกระทบต่ออาชีพนักเขียน

เอกสารที่เปิดเผยยังระบุถึงขั้นตอนการกำจัดหลักฐานชุดข้อมูลดังกล่าว ในเดือนมิถุนายน 2022 Bob McGrew รองประธานฝ่ายวิจัยของ OpenAI ได้บันทึกข้อความภายในว่า การลบชุดข้อมูล LibGen ออกจากระบบจะมี 'มูลค่าสูงมากด้วยเหตุผลทางกฎหมาย' (very valuable for legal reasons) ซึ่งนำไปสู่การดำเนินโครงการภายในที่มีชื่อว่า 'Project Clear' โดยมีวัตถุประสงค์เพื่อลบไฟล์ที่ดาวน์โหลดมาจาก Library Genesis ออกจากโครงสร้างพื้นฐานของบริษัท

นอกจากประเด็นการละเมิดลิขสิทธิ์แล้ว เอกสารยังสะท้อนการตระหนักรู้ขององค์กรเกี่ยวกับการแทนที่แรงงานมนุษย์อย่างเป็นรูปธรรม ในเดือนพฤษภาคม 2020 Jack Clark ซึ่งดำรงตำแหน่งผู้อำนวยการฝ่ายนโยบายของ OpenAI ในขณะนั้น ได้เขียนบันทึกภายในระบุว่า งานวิจัยด้าน AI และความคิดสร้างสรรค์ของบริษัทจะนำไปสู่การสร้างระบบที่เข้ามา 'แทนที่แรงงานมนุษย์' โดยตรง พร้อมระบุเตือนว่า ยิ่งโมเดลตระกูล GPT พัฒนาได้ดีขึ้นเท่าใด นักเขียนนิยายแนวพาณิชย์จะยิ่งกังวลเกี่ยวกับการถูกแย่งชิงตำแหน่งบนแพลตฟอร์ม Amazon และงานของบริษัทจะทำให้ผู้คนต้องตกงาน

หลักฐานยังชี้ให้เห็นว่า ในปี 2022 Tarun Gogineni ได้รับการว่าจ้างให้เข้ามาดูแลด้านคุณภาพวรรณกรรม และได้ทดลองใช้โมเดลเขียนเนื้อหาภาคต่อของนิยายชื่อดังของ George R.R. Martin โดยได้ระบุในบันทึกภายในว่า เสียงคัดค้านและความไม่พอใจของกลุ่มผู้ประพันธ์ถือเป็น 'การหยุดชะงักทางเศรษฐกิจที่ยอมรับได้' (acceptable economic disruption)

ข้อโต้แย้งทางกฎหมาย: ความเปราะบางของหลักการ Fair Use และโทษปรับตามกฎหมาย

กลุ่มโจทก์ซึ่งนำโดยสมาคม Authors Guild ยื่นคำร้องต่อศาลว่า การกระทำของผู้บริหาร OpenAI แสดงถึงการละเมิดลิขสิทธิ์โดยเจตนา (Willful Infringement) อย่างแท้จริง ซึ่งหากศาลมีความเห็นพ้อง ข้อต่อสู้เรื่องหลักการใช้งานลิขสิทธิ์ที่เป็นธรรม (Fair Use) ที่บริษัทเทคโนโลยีมักนำมาอ้างจะถูกปัดตกไปทันที เนื่องจากการได้มาซึ่งข้อมูลมีลักษณะของการจัดซื้อหรือดาวน์โหลดจากแหล่งละเมิดลิขสิทธิ์เชิงพาณิชย์อย่างจงใจ

หากศาลวินิจฉัยว่าการละเมิดเกิดขึ้นโดยเจตนา บทลงโทษตามกฎหมายลิขสิทธิ์ของสหรัฐฯ อาจกำหนดค่าเสียหายตามกฎหมาย (Statutory Damages) สูงสุดถึง 150,000 ดอลลาร์สหรัฐ ต่อผลงานที่จดทะเบียนลิขสิทธิ์หนึ่งรายการ ซึ่งเมื่อคำนวณจากจำนวนหนังสือหลายแสนเล่มในคลัง LibGen ความรับผิดชอบทางการเงินอาจขยายตัวสู่หลักหมื่นล้านดอลลาร์สหรัฐ อย่างไรก็ตาม ศาลรัฐบาลกลางแมนฮัตตันยังไม่ได้มีคำตัดสินชี้ขาด และกระบวนการพิจารณาคำร้อง Summary Judgment จะดำเนินต่อไปจนถึงช่วงต้นปี 2027

สถานการณ์ดังกล่าวมีความคล้ายคลึงกับคำสั่งศาลในคดี Bartz v. Anthropic ซึ่งผู้พิพากษาเคยมีคำวินิจฉัยเบื้องต้นที่ส่งผลเสียต่อข้อต่อสู้ด้าน Fair Use อันเนื่องมาจากการใช้ข้อมูลจากแหล่งละเมิดลิขสิทธิ์ ก่อนที่คดีดังกล่าวจะจบลงด้วยการประนีประนอมยอมความที่มูลค่า 1.5 พันล้านดอลลาร์สหรัฐ ทำให้คดี Authors Guild v. OpenAI กลายเป็นหมุดหมายสำคัญที่จะกำหนดมาตรฐานการฝึกฝนปัญญาประดิษฐ์ระดับโลก

ปฏิกิริยาในหมู่นักพัฒนา: วิวัฒนาการทางเทคโนโลยีกับการตั้งคำถามด้านจริยธรรม

หลังจากการเปิดผนึกเอกสารคดี การตอบรับในกลุ่มนักพัฒนาซอฟต์แวร์และผู้เชี่ยวชาญด้านปัญญาประดิษฐ์ได้แบ่งออกเป็นสองแนวทางอย่างชัดเจน ฝ่ายหนึ่งมองว่าการที่เทคโนโลยีเข้ามาแทนที่แรงงานเดิมเป็นปรากฏการณ์ทางประวัติศาสตร์ที่หลีกเลี่ยงไม่ได้ โดยมีการเปรียบเทียบว่าการพัฒนาโมเดลภาษาไม่ต่างจากการประดิษฐ์เครื่องคิดเลขที่เข้ามาแทนที่นักคำนวณ หรือการผลิตรถยนต์ที่เข้ามาทดแทนอุตสาหกรรมรถม้า ซึ่งการเปลี่ยนแปลงเชิงประสิทธิภาพย่อมส่งผลกระทบต่อตำแหน่งงานเดิมเป็นธรรมดา

ในทางกลับกัน กลุ่มนักพัฒนาและนักวิจัยด้านความปลอดภัยจำนวนมากได้แสดงความกังขาและวิพากษ์วิจารณ์ฝ่ายบริหารอย่างหนักหน่วง โดยชี้ให้เห็นถึงความย้อนแย้งระหว่างวาทกรรมสาธารณะที่เน้นย้ำเรื่อง 'ความปลอดภัยของ AI' และ 'จริยธรรม' กับการกระทำภายในองค์กรที่มีการสั่งลบข้อมูลผ่าน Project Clear เพื่อทำลายพยานหลักฐานและหลบเลี่ยงการถูกตรวจสอบ

ชุมชนผู้ปฏิบัติงานด้านเทคโนโลยียังชี้ว่า การพยายามปกปิดการใช้ข้อมูลจากเว็บไซต์ผิดกฎหมายสะท้อนให้เห็นว่า องค์กรไม่ได้คำนึงถึงกรอบจริยธรรมตั้งแต่ต้น แต่เป็นการบริหารจัดการความเสี่ยงด้านการประชาสัมพันธ์ (PR Risk) และความเสี่ยงทางคดีความเท่านั้น ซึ่งส่งผลต่อความน่าเชื่อถือของห้องปฏิบัติการ AI ชั้นนำในภาพรวม

นัยสำคัญต่อภาคธุรกิจและองค์กรในประเทศไทย

สำหรับผู้นำองค์กรและฝ่ายเทคโนโลยีสารสนเทศในประเทศไทย คดีความนี้เป็นสัญญาณเตือนสำคัญเกี่ยวกับการพึ่งพาโมเดล AI เชิงพาณิชย์โดยปราศจากการตรวจสอบที่มาของข้อมูล (Supply Chain Due Diligence) แม้ว่าคดีจะเกิดขึ้นในเขตอำนาจศาลสหรัฐฯ แต่โมเดลพื้นฐานอย่าง GPT-3.5 และรุ่นถัดมาถูกนำมาผสานรวมในระบบบริการลูกค้า การสร้างเนื้อหา และการประมวลผลข้อมูลขององค์กรไทยอย่างกว้างขวาง

หากศาลมีคำวินิจฉัยลงโทษหรือบีบให้เกิดการระงับโมเดลที่ฝึกสอนจากข้อมูลผิดกฎหมาย บริษัทเทคโนโลยีอาจต้องผลักภาระต้นทุนค่าลิขสิทธิ์และค่าปรับทางกฎหมายมายังผู้บริโภคผ่านการขึ้นราคา API นอกจากนี้ องค์กรในไทยที่ดำเนินธุรกิจข้ามชาติอาจเผชิญกับการตรวจสอบตามกฎหมายคุ้มครองทรัพย์สินทางปัญญาและมาตรฐาน ESG สากล ซึ่งเรียกร้องให้ระบบอัตโนมัติต้องใช้โมเดลที่ผ่านการฝึกฝนจากข้อมูลที่ถูกกฎหมายและโปร่งใส

ฝ่ายกฎหมายและทีมไอทีของภาคธุรกิจไทยจึงควรเร่งทบทวนข้อตกลงระดับการให้บริการ (SLA) และข้อกำหนดเรื่องการชดใช้ค่าเสียหาย (Indemnification Clauses) จากผู้ให้บริการโมเดล AI ควบคู่ไปกับการกระจายความเสี่ยงด้วยการทดสอบโมเดลแบบเปิด (Open-Weight Models) ที่มีเอกสารกำกับชุดข้อมูลชัดเจน เพื่อป้องกันผลกระทบจากการหยุดชะงักทางกฎหมายที่อาจเกิดขึ้นในอนาคต

ทำไมเรื่องนี้สำคัญ

การเปิดเผยเอกสารเชิงประจักษ์ว่าบริษัทผู้พัฒนา AI ชั้นนำรับรู้เรื่องการละเมิดลิขสิทธิ์และการแทนที่อาชีพ อาจทำให้ข้อต่อสู้เรื่อง Fair Use สิ้นผลในชั้นศาล ส่งผลให้ต้นทุนลิขสิทธิ์ การจัดทำธรรมาภิบาลข้อมูล (Data Governance) และความเสี่ยงทางกฎหมายขององค์กรธุรกิจที่นำโมเดลพื้นฐานมาใช้งานปรับตัวสูงขึ้นอย่างมีนัยสำคัญ

ข้อมูลอ้างอิงหลัก