OpenAI และ Microsoft รู้ว่ากระบวนการฝึก AI ของพวกเขาเป็น 'วงจรหายนะ'—นี่คือสิ่งที่ต้องจ่าย
เอกสารศาลที่เปิดเผยจากคดีละเมิดลิขสิทธิ์ของ The New York Times ชี้ให้เห็นว่าผู้บริหารของ OpenAI และ Microsoft ยอมรับว่าการเก็บข้อมูลของพวกเขาสร้าง 'วงจรหายนะ' ที่คุกคามเว็บและถือเป็นการ 'ขโมยแรงงานครั้งใหญ่ที่สุดในประวัติศาสตร์มนุษย์' ทั้งๆ ที่มีคำกล่าวอ้างสาธารณะเกี่ยวกับนวัตกรรมและความปลอดภัย
สรุปสั้น: เอกสารศาลจากคดีของ New York Times เผยว่าผู้บริหาร OpenAI และ Microsoft ทราบว่าการเก็บข้อมูลสร้าง ‘วงจรหายนะ’ ที่ทำลายเว็บและถือเป็นการขโมยแรงงานครั้งใหญ่ที่สุดในประวัติศาสตร์มนุษย์ การยอมรับนี้ชี้ให้เห็นถึงความขัดแย้งระหว่างวาทกรรมสาธารณะเกี่ยวกับนวัตกรรมกับความรับผิดชอบทางจริยธรรมที่แท้จริง
ข้อเท็จจริงสำคัญ
- เอกสารศาลในคดีละเมิดลิขสิทธิ์ที่ The New York Times ยื่นฟ้อง OpenAI และ Microsoft ได้เปิดเผยว่าผู้บริหารทั้งสองบริษัทตระหนักดีว่าการเก็บข้อมูล (data scraping) ก่อให้เกิด ‘วงจรหายนะ’ (doom loop) ที่ทำลายคุณภาพเนื้อหาบนเว็บและส่งผลกระทบต่อการ
-
ฝึกโมเดลรุ่นต่อไป
- Brent Hecht ผู้อำนวยการฝ่ายวิทยาศาสตร์ประยุกต์ของ Microsoft ได้อธิบายในเอกสารภายในว่า การเก็บรวบรวมเนื้อหาออนไลน์โดยไม่ได้รับอนุญาตเป็น ‘การขโมยแรงงานครั้งใหญ่ที่สุดในประวัติศาสตร์มนุษยชาติ’ และเป็นการขโมยในสัดส่วนที่ไม่มีผู้สร้างสรรค์งานใด
- เอกสารภายในของ Microsoft ระบุว่าผลิตภัณฑ์ AI แบบสร้างได้ (generative AI) มีความสามารถในการฆ่า ‘เว็บทั้งหมด’ โดยคำกล่าวนี้ปรากฏในการยื่นคำร้องขอคำพิพากษาตามคำฟ้องโดยย่อ (summary judgment) ซึ่งลงนามรับรองโดยผู้บริหารหลายคน
- Kevin Scott ซีทีโอ ของ Microsoft ได้เตือน Satya Nadella และ Bill Gates ในปี 2019 ว่า Microsoft ตามหลัง Google อยู่หลายปีในแง่ของการผลิตแบบแมชชีนเลิร์นนิง โดยใช้เวลาหกเดือนในการจำลองแบบโมเดล BERT ของ Google เนื่องจากข้อจำกัดด้านโครงสร้าง
- แรงกดดันจากการแข่งขันทำให้ Microsoft ลงทุน 1 พันล้านดอลลาร์ใน OpenAI เพื่อลดช่องว่างกับ Google ซึ่ง Nadella ยอมรับว่าเป็น ‘คู่แข่ง AI รายใหญ่ที่สุด’ ของบริษัทก่อนการเป็นพันธมิตร โดยกลยุทธ์นี้เริ่มขึ้นตั้งแต่ปี 2019
- ในเดือนมกราคม 2024 คณะกรรมการการค้าแห่งสหพันธรัฐ (FTC) ได้ส่งจดหมายสอบสวนไปยัง Alphabet, Amazon, Anthropic, Microsoft และ OpenAI เพื่อสืบสวนว่าการลงทุนในสตาร์ทอัพ AI ส่งผลต่อการแข่งขันในพื้นที่เจเนอเรทีฟ AI อย่างไร
ความจริงที่เปิดเผยแล้วเกี่ยวกับวัฏจักรการทำลายเว็บของ AI
เอกสารภายในจากการฟ้องร้องเรื่องลิขสิทธิ์ของ The New York Times ต่อ OpenAI และ Microsoft ได้เปิดเผยว่าผู้บริหารของบริษัททั้งสองแห่งตระหนักดีว่าการเก็บรวบรวมข้อมูล (data scraping) ของพวกเขาก่อให้เกิดภัยคุกคามต่อระบบนิเวศของเนื้อหาออนไลน์อย่างเป็นระบบ [1][5] เอกสารเหล่านี้ ซึ่งยื่นเป็นส่วนหนึ่งของคำร้องขอคำพิพากษาตามคำฟ้องโดยย่อ (summary judgment) อธิบายว่าการฝึกฝนโมเดลภาษาขนาดใหญ่ (LLMs) ได้สร้างสิ่งที่เรียกว่า ‘วงจรหายนะ’ (doom loop)—ซึ่งเป็นวัฏจักรที่เสริมแรงตัวเอง โดยที่โมเดล AI ทำลายคุณภาพและคุณค่าของเนื้อหาบนเว็บ ซึ่งส่งผลกระทบต่อข้อมูลที่ใช้ในการฝึกโมเดลรุ่นต่อไป
คำว่า ‘วงจรหายนะ’ ปรากฏในเอกสารภายในของ Microsoft หลายฉบับ โดยมีเอกสารหนึ่งระบุว่าผลิตภัณฑ์ AI แบบสร้างได้ (generative AI) มีความสามารถในการฆ่า ‘เว็บทั้งหมด’ [1][5] การยอมรับนี้เกิดขึ้นท่ามกลางวาทกรรมสาธารณะจากทั้งสองบริษัทที่ส่งเสริมเทคโนโลยี AI ของตนว่าเป็นสิ่งที่มีผลกระทบเชิงบวกและเปลี่ยนแปลงโลก
การขโมยที่รู้กันดีว่าเกิดขึ้น
หนึ่งในข้อค้นพบที่น่าตกใจที่สุดคือการบรรยายของ Brent Hecht ผู้อำนวยการฝ่ายวิทยาศาสตร์ประยุกต์ของ Microsoft ซึ่งอธิบายว่าการเก็บรวบรวมเนื้อหาออนไลน์โดยไม่ได้รับอนุญาตว่าเป็น ‘การขโมยแรงงานครั้งใหญ่ที่สุดในประวัติศาสตร์มนุษยชาติ’ [1][5] เอกสารภายในอีกฉบับหนึ่งอ้างถึงการใช้อ้างอิงวัสดุที่ไม่ได้รับอนุญาตว่าเป็น ‘การขโมยที่น่าทึ่งในสัดส่วนที่ไม่มีมาก่อน’ โดยระบุว่าผู้สร้างสรรค์งานไม่ได้รับการชดเชยสำหรับผลงานของพวกเขา
แม้ว่า Microsoft จะ distancing ตัวเองจากคำกล่าวของ Hecht ในภายหลัง โดยอ้างว่าสิ่งเหล่านั้นสะท้อนมุมมองทางวิชาการส่วนบุคคลมากกว่านโยบายของบริษัท แต่ข้อความเหล่านี้ถูกกล่าวขึ้นในเอกสารทางกฎหมายอย่างเป็นทางการ และได้รับการลงนามรับรองโดยผู้บริหารหลายคน รวมถึงผู้นำของ OpenAI [1] ข้อเท็จจริงที่ว่าภาษาเช่นนี้ปรากฏในการยื่นคำร้องทางกฎหมายเน้นย้ำถึงความร้ายแรงของข้อกล่าวอ้างดังกล่าว
ความตื่นตระหนกจากการแข่งขันที่เร่งให้เกิดการเสี่ยงมากขึ้น
จุดเริ่มต้นของกลยุทธ์ที่มีความเสี่ยงนี้ย้อนกลับไปในปี 2019 เอกสารภายในของ Microsoft แสดงให้เห็นว่า Kevin Scott ซีทีโอ ได้เตือน Satya Nadella ประธานเจ้าหน้าที่บริหารและ Bill Gates ผู้ร่วมก่อตั้งว่า Microsoft ตามหลัง Google อยู่หลายปีในแง่ของขนาดการผลิตแบบแมชชีนเลิร์นนิง [2][3][4] ในอีเมลวันที่ 12 มิถุนายน 2019 Scott ระบุว่าใช้เวลาหกเดือนในการจำลองแบบภาษาโมเดล BERT ของ Google ได้ เนื่องจากข้อจำกัดด้านโครงสร้างพื้นฐาน
แรงกดดันจากการแข่งขันนี้ทำให้ Microsoft ลงทุน 1 พันล้านดอลลาร์ใน OpenAI ซึ่งเป็นก้าวที่มุ่งหมายจะลดช่องว่างกับ Google ซึ่ง Nadella ได้ยอมรับภายหลังว่าเป็น ‘คู่แข่ง AI รายใหญ่ที่สุด’ ของบริษัทก่อนการเป็นพันธมิตร [7] การลงทุนนี้ถูกนำเสนอเป็นการเดิมพันระยะยาวเพื่อความร่วมมือที่มั่นคง สอดคล้องกับค่านิยมของ Microsoft ในฐานะพันธมิตรแพลตฟอร์ม
การตรวจสอบจากหน่วยงานกำกับดูแลและความขัดแย้งภายในองค์กร
การเปิดเผยข้อมูลเหล่านี้เกิดขึ้นท่ามกลางการตรวจสอบที่เข้มงวดขึ้นของหน่วยงานกำกับดูแล ในเดือนมกราคม 2024 คณะกรรมการการค้าแห่งสหพันธรัฐ (FTC) ได้ส่งจดหมายสอบสวนไปยัง Alphabet, Amazon, Anthropic, Microsoft และ OpenAI เพื่อสืบสวนว่าการลงทุนในสตาร์ทอัพ AI ของบริษัทเหล่านี้ส่งผลต่อการแข่งขันในพื้นที่เจเนอเรทีฟ AI อย่างไร [6] แม้ว่าจะมีอีเมลภายในบางฉบับที่แสดงความกลัวของ Microsoft ต่อ Google ถูกเปิดเผยระหว่างกระบวนการดำเนินคดีด้านผูกขาดโดยกระทรวงยุติธรรมของสหรัฐฯ กับ Google แต่เอกสารเฉพาะเจาะจงที่อธิบายถึง ‘วงจรหายนะ’ (doom loop) และ ‘การขโมย’ นั้นมาจากคดีฟ้องร้องของ The New York Times ไม่ใช่จากกรณีเหล่านั้น [1][5]
Microsoft พยายามลดความสำคัญของคำกล่าวของ Hecht โดยโฆษก Alex Haurek ระบุว่าคำกล่าวนั้นสะท้อนมุมมองส่วนบุคคลและไม่แทนนโยบายของบริษัท [1] Jordan Usdan ผู้จัดการทั่วไปฝ่ายกลยุทธ์ข้อมูลและปฏิบัติการของ Microsoft AI ระบุว่า Hecht มีมุมมองที่ ‘แตกต่างและเป็นเชิงวิชาการ’ และเน้นย้ำว่าเขาไม่ได้พูดแทน Microsoft ในประเด็นผลกระทบในวงกว้างของ AI อย่างไรก็ตาม ข้อควรระวังเหล่านี้ไม่สามารถหักล้างข้อเท็จจริงที่ว่าภาษาเช่นนี้ได้ถูกบรรจุอยู่ในเอกสารที่ทีมกฎหมายของ Microsoft ยื่นต่อศาล
ต้นทุนของนวัตกรรมที่สร้างจากข้อมูลที่ไม่ได้รับอนุญาต
ความขัดแย้งระหว่างข้อความที่สื่อต่อสาธารณะและการยอมรับภายในได้เพิ่มความเข้มข้นของการวิพากษ์วิจารณ์ ในขณะที่บริษัทต่างๆ ส่งเสริมให้ AI เป็นพลังขับเคลื่อนนวัตกรรม เอกสารที่ถูกเปิดเผยชี้ให้เห็นว่าเทคโนโลยีนี้ถูกสร้างขึ้นจากแนวทางที่หลายคนในปัจจุบันเรียกว่าเป็นการเอาเปรียบ—โดยการใช้เนื้อหาที่มนุษย์สร้างขึ้นจำนวนมหาศาลโดยไม่ได้รับอนุญาตและไม่มีค่าตอบแทน [1][5]
ผู้วิจารณ์แย้งว่าการยอมรับภายในเหล่านี้พิสูจน์ว่าวาทกรรมของอุตสาหกรรมเกี่ยวกับการพัฒนาอย่างมีความรับผิดชอบนั้นขัดแย้งกับแนวทางปฏิบัติจริง เมื่อแบบจำลอง AI เข้ามาแทนที่เนื้อหาที่มนุษย์เป็นผู้สร้างสรรค์มากขึ้น ความยั่งยืนในระยะยาวของระบบนิเวศออนไลน์ก็ยังคงถูกตั้งคำถาม
การต่อสู้ทางกฎหมายยังคงดำเนินต่อไป แต่มีสิ่งหนึ่งชัดเจนคือ ผู้บริหารของ OpenAI และ Microsoft ไม่ได้เพิกเฉยต่อความเสี่ยงที่พวกเขาได้สร้างขึ้น คำถามในขณะนี้คือ จะมีการรับผิดชอบตามทันหรือไม่—หรือที่เรียกว่า ‘วงจรหายนะ’ จะยังคงดำเนินต่อไปโดยไม่มีผู้ควบคุม
แหล่งข้อมูล
- OpenAI และ Microsoft ทราบว่าพวกเขากำลังเริ่ม ‘วงจรหายนะ’ สำหรับเว็บ (www.theverge.com) — 2026-09-18
- ‘วงจรหายนะ’: OpenAI และ Microsoft ยอมรับว่า LLM กำลังทำลายเว็บและถูกสร้างขึ้นจากการขโมย (www.404media.co) — 2026-09-17
- การลงทุนของ Microsoft ใน OpenAI ถูกกระตุ้นจากความกลัวต่อ Google อีเมลเปิดเผย (theverge.com) — 2024-05-01
- การลงทุนของ Microsoft ใน OpenAI ถูกกระตุ้นจากความกลัวต่อ Google อีเมลเปิดเผย (www.theverge.com) — 2024-05-01
- การลงทุนของ Microsoft ใน OpenAI ถูกกระตุ้นจากความกลัวต่อ Google อีเมลเปิดเผย (www.theverge.com) — 2024-05-01
- นาเดลลาบอกเราว่าก่อนการร่วมมือกับ OpenAI Google เป็นคู่แข่ง AI รายใหญ่ที่สุดของเขา (www.theverge.com) — 2026-05-11
- FTC กำลังสอบสวนการลงทุนของ Microsoft, Amazon และ Google ใน OpenAI และ Anthropic (www.theverge.com) — 2024-01-25