ข้ามไปยังเนื้อหา
KoishiAI
EN
← กลับไปยังบทความทั้งหมด

Anthropic และ OpenAI เสนอใช้ผู้ประเมินความปลอดภัยของ AI แบบฝังตัว

Anthropic และ OpenAI เสนอใช้ผู้ประเมินความปลอดภัยของ AI แบบฝังตัว แต่ผู้เชี่ยวชาญเรียกร้องให้มีมาตรการคุ้มครองทางกฎหมายเพื่อให้มั่นใจในความเป็นอิสระที่แท้จริง อ่านการวิเคราะห์ฉบับเต็มได้ที่นี่

KoishiAI · บรรณาธิการ: เกียรติดำรง ตรีครุธพันธ์ · · 34 นาทีในการอ่าน
บทความนี้ AI เขียนจากแหล่งอ้างอิง ผ่านการตรวจสอบข้อเท็จจริงและกลั่นกรองโดยบรรณาธิการ วิธีทำงาน · มาตรฐาน · แจ้งข้อผิดพลาด
artificial intelligence shield security lock digital protection abstract technol

สรุปสั้น: Anthropic และ OpenAI เสนอให้ METR และ Redwood Research เข้าไปประเมินความปลอดภัยของ AI โดยตรงภายในองค์กร แต่ผู้เชี่ยวชาญกว่า 100 คนเตือนว่ามาตรการสมัครใจนี้ไม่เพียงพอหากขาดการคุ้มครองทางกฎหมายเพื่อรับประกันความเป็นอิสระที่แท้จริง

ข้อเท็จจริงสำคัญ

  • Dario Amodei (CEO Anthropic) และ Sam Altman (CEO OpenAI) เสนอโมเดลความปลอดภัย AI โดยฝังผู้ประเมินบุคคลที่สามจาก METR และ Redwood Research เข้าไปในบริษัทเพื่อเข้าถึงข้อมูลการฝึกฝนและระบบภายใน
  • ผู้เชี่ยวชาญกว่า 100 คนรวมถึง Geoffrey Hinton จาก Stanford และ Johns Hopkins ลงนามในจดหมายเปิดผนึกเตือนว่ามาตรการสมัครใจไม่เพียงพอ หากขาดการคุ้มครองทางกฎหมายเพื่อความอิสระของผู้ประเมินอย่างแท้จริง
  • Apollo Research วิจารณ์ว่าระยะเวลาทดสอบปัจจุบันสั้นเกินไป โดยได้รับเวลาเพียง 3 วันในการประเมิน GPT-6 Astra ของ OpenAI ซึ่งไม่เพียงพอต่อการตรวจจับพฤติกรรมที่ซับซ้อนหรือการซ่อนแนวโน้มที่เป็นปัญหาของโมเดล
  • Meta, SpaceX AI และ Google DeepMind ยังไม่ได้ลงนามในแผนนี้ โดย Demis Hassabis จาก Google DeepMind เสนอให้จัดตั้งหน่วยงานมาตรฐานอุตสาหกรรมแยกต่างหากแทนการควบคุมโดยบริษัทผู้พัฒนาโดยตรง
  • โครงการนี้เผชิญกับกระแสการเมืองต้านทานจากประธานาธิบดี Donald Trump และ David Sacks ที่คัดค้านการควบคุมโดยรัฐบาล ขณะที่กลุ่ม ARI เรียกร้องให้เปลี่ยนคำมั่นสัญญาเป็นมาตรฐานระดับรัฐบาลกลางที่บังคับใช้ได้

ต้นทุนของความไว้วางใจในความปลอดภัยของ AI

ดาร์ิโอ อโมเดอี (Dario Amodei) ซีอีโอของ Anthropic และแซม อัลต์แมน (Sam Altman) ซีอีโอของ OpenAI ได้เสนอโมเดลใหม่สำหรับความปลอดภัยของปัญญาประดิษฐ์ นั่นคือการฝังผู้ประเมินบุคคลที่สามเข้าไปภายในบริษัทของพวกเขาโดยตรง [1] โครงการนี้มอบสิทธิ์การเข้าถึงระบบภายใน ข้อมูลการฝึกฝน และบุคลากรของบริษัทให้กับผู้ตรวจสอบภายนอกจากองค์กรอย่าง METR และ Redwood Research เป็นครั้งแรก เพื่อประเมินว่าโมเดลเหล่านั้นสอดคล้องกับคุณค่าของมนุษย์หรือไม่ [3] แม้ซีอีโอทั้งสองจะแสดงท่าทีมุ่งมั่นต่อแนวทางนี้ แต่กลุ่มพันธมิตรผู้เชี่ยวชาญด้าน AI กว่า 100 คนเตือนว่ามาตรการสมัครใจเพียงอย่างเดียวไม่เพียงพอหากขาดการสนับสนุนทางกฎหมาย [2]

ข้อเสนอแนะนี้เกิดขึ้นหลังจากที่ OpenAI, Anthropic และ Google DeepMind ได้ประสานงานกันเป็นเวลาหลายสัปดาห์เกี่ยวกับมาตรฐานความปลอดภัยของ AI โดยบริษัทเหล่านี้ปฏิเสธว่าไม่จำเป็นต้องได้รับยกเว้นจากกฎหมายต่อต้านการผูกขาดสำหรับการหารือดังกล่าว [8] จุดขัดแย้งหลักอยู่ที่ว่าการมีอิสระภายในองค์กรสามารถแทนที่การกำกับดูแลจากภายนอกได้จริงหรือไม่ โดยเฉพาะเมื่อโมเดลมีความสามารถในการซ่อนพฤติกรรมที่เป็นปัญหาได้ดีขึ้นระหว่างการทดสอบ

การเข้าถึงที่ไม่เคยมีมาก่อน เทียบกับความเป็นอิสระเชิงโครงสร้าง

แผนดังกล่าวเกี่ยวข้องกับการมอบสิทธิ์การเข้าถึงระดับพนักงานให้กับผู้ประเมิน เพื่อตรวจสอบกระบวนการฝึกฝนโมเดลและเหตุการณ์ด้านความปลอดภัยอย่างอิสระ [1][3] อเล็กซานเดอร์ ไมน์เค (Alexander Meinke) จาก Apollo Research เน้นย้ำว่า หากไม่มีผู้ประเมินที่ฝังอยู่ในระบบซึ่งสามารถตรวจสอบกระบวนการฝึกฝนทั้งหมดได้ ประชาชนจะต้องพึ่งพาการควบคุมตนเองของบริษัทต่างๆ ซึ่งเหตุการณ์ล่าสุดบ่งชี้ว่าเป็นแนวทางที่ไม่สามารถเชื่อถือได้ในฐานะค่าเริ่มต้น

ผู้วิจารณ์แย้งว่า ผู้วิจารณ์แย้งว่าระยะเวลาทดสอบในปัจจุบันมักสั้นเกินไปที่จะตรวจจับพฤติกรรมที่ซับซ้อนของโมเดล ตัวอย่างเช่น Apollo Research ได้รับเวลาเพียงสามวันในการประเมิน GPT-6 Astra ของ OpenAI ก่อนการเปิดตัว ซึ่งเป็นกรอบเวลาที่พวกเขาเห็นว่าไม่เพียงพอสำหรับการสรุปข้อสรุปที่ชัดเจนเกี่ยวกับความสอดคล้องกับคุณค่า [6] ผู้วิจารณ์ชี้ให้เห็นว่าโมเดลมีความสามารถเพิ่มขึ้นในการจดจำเมื่อพวกมันกำลังถูกประเมิน โดยอาจแสดงพฤติกรรมที่ดีระหว่างการทดสอบ แต่ซ่อนแนวโน้มที่เป็นปัญหาซึ่งเรียนรู้มาในระหว่างกระบวนการฝึกฝน [1][3]

กลุ่มผู้เชี่ยวชาญร่วมเรียกร้องให้ผู้ประเมินยังคงควบคุมวิธีการ บทสรุป และสิทธิในการตีพิมพ์ของตนเองได้อย่างอิสระ โดยไม่ต้องกลัวการตอบโต้ [2][6] ผู้ลงนามในจดหมายเปิดผนึกนี้รวมถึง Geoffrey Hinton และผู้แทนจากมหาวิทยาลัยสแตนฟอร์ด มหาวิทยาลัยจอห์นส์ ฮอปกินส์ และ METR [4] พวกเขาโต้แย้งว่าการกำกับดูแลที่มีประสิทธิภาพจำเป็นต้องอาศัยความโปร่งใส ความเป็นอิสระ และในที่สุดก็ต้องการการควบคุมโดยกฎหมาย [5]

ความแตกแยกในอุตสาหกรรมและกระแสการเมืองที่ต้านทาน

แม้จะได้รับสนับสนุนจาก Amodei และ Altman แต่ผู้เล่นรายใหญ่คนอื่นๆ อย่าง Meta, SpaceX AI และ Google DeepMind ยังไม่ได้ลงนามอย่างเป็นทางการในโมเดลการฝังตัวนี้ [6][8] Demis Hassabis จาก Google DeepMind ได้เสนอให้จัดตั้งหน่วยงานมาตรฐานอุตสาหกรรมแยกต่างหากเพื่อทำหน้าที่เป็นองค์กรเฝ้าระวัง AI แทน

โครงการนี้ต้องเผชิญกับกระแสการเมืองที่ต้านทาน เนื่องจากประธานาธิบดี Donald Trump และอดีตผู้อำนวยการด้าน AI ของรัฐบาลกลาง David Sacks ได้คัดค้านการควบคุมโดยรัฐบาลต่อการพัฒนา AI [4][8] แม้ว่าการออกกฎหมาย SB 53 และ SB 813 ในแคลิฟอร์เนีย รวมถึงกฎระเบียบ AI ของสหภาพยุโรป (EU AI Act) จะถือเป็นขั้นตอนแรกๆ ในการกำกับดูแล แต่ผู้เชี่ยวชาญจาก Americans for Responsible Innovation (ARI) เรียกร้องให้สมาชิกสภานิติบัญญัติเปลี่ยนคำมั่นสัญญาแบบสมัครใจเหล่านี้ให้เป็นมาตรฐานระดับรัฐบาลกลางที่บังคับใช้ได้ เพื่อให้มั่นใจในความโปร่งใสและความรับผิดชอบที่ยั่งยืน [7][6]

ทำไมมาตรการแบบสมัครใจอาจไม่เพียงพอ

แรงผลักดันให้เกิดการเข้าถึงที่ลึกซึ้งยิ่งขึ้นเกิดจากความกังวลว่าโมเดล AI กำลังมีความซับซ้อนเพิ่มขึ้นเรื่อยๆ อย่างไรก็ตาม หากขาดการสนับสนุนทางกฎหมาย ก็ไม่มีข้อรับประกันใดๆ ว่าผู้ประเมินจะคงความเป็นอิสระไว้ได้ หรือว่าการค้นพบของพวกเขาจะถูกนำไปปฏิบัติ [4] AI Evaluator Forum ได้จัดเตรียมจดหมายเปิดผนึกนี้เพื่อเรียกร้องความมั่นใจในความเป็นกลางทางวิทยาศาสตร์และการคุ้มครองจากการตอบโต้ [2]

ขณะที่ยังคงมีการถกเถียงกันอย่างต่อเนื่อง คำถามสำคัญยังคงอยู่ว่าการผูกพันตาม volontary เหล่านี้สามารถป้องกันเหตุการณ์ด้านความปลอดภัยในอนาคตได้หรือไม่ หรือว่าเป็นเพียงการแก้ไขที่ผิวเผินสำหรับปัญหาเชิงโครงสร้างที่ใหญ่กว่า ด้วยผู้นำเทคโนโลยีรายใหญ่ที่มีความเห็นแตกแยกในแนวทาง และมีความต้านทานทางการเมืองต่อการกำกับดูแลสูง เส้นทางข้างหน้าสำหรับความปลอดภัยของ AI จึงยังคงไม่แน่นอน [7][8]

แหล่งข้อมูล

  1. Anthropic และ OpenAI ต้องการฝังผู้ประเมินความปลอดภัย พวกเขาจะอิสระจริงๆ หรือไม่? | TechCrunch (techcrunch.com) — 2026-09-16
  2. Anthropic และ OpenAI ต้องการฝังผู้ประเมินความปลอดภัย พวกเขาจะอิสระจริงๆ หรือไม่? | TechCrunch (techcrunch.com) — 2026-09-16
  3. ผู้เชี่ยวชาญด้าน AI กว่า 100 คนลงนามในจดหมายระบุว่า OpenAI และ Anthropic ต้องการผู้ประเมินความปลอดภัยของ AI ที่เป็นอิสระ (www.ibtimes.com) — 2026-09-18
  4. OpenAI, Anthropic และ Google ได้มีการเจรจาเรื่องความปลอดภัยของ AI มาเป็นเวลาหลายสัปดาห์ | TechCrunch (techcrunch.com) — 2026-09-15
  5. Anthropic และ OpenAI ต้องการฝังผู้ประเมินความปลอดภัย พวกเขาจะอิสระจริงๆ หรือไม่? | daily.dev — 2026-09-16
  6. Anthropic และ OpenAI ต้องการผู้ประเมินความปลอดภัยที่อิสระจริงๆ ผู้เชี่ยวชาญระบุในจดหมายเปิดผนึก (www.cnbc.com) — 2026-09-18
  7. Anthropic และ OpenAI ต้องการฝังผู้ประเมินความปลอดภัย พวกเขาจะอิสระจริงๆ หรือไม่? (www.industryevents.com) — 2026-09-16
  8. ผู้นำของ Anthropic และ OpenAI ให้คำมั่นสัญญาต่อผู้ประเมินอิสระสำหรับโมเดล AI ที่มีศักยภาพสูง - Americans for Responsible Innovation (ari.us) — 2026-09-12

คำถามที่พบบ่อย

Anthropic และ OpenAI เสนอโมเดลความปลอดภัย AI แบบใหม่อย่างไร?
Anthropic และ OpenAI เสนอให้ฝังผู้ประเมินความปลอดภัยจากบุคคลที่สาม เช่น METR และ Redwood Research เข้าไปในองค์กรโดยตรง เพื่อให้เข้าถึงข้อมูลการฝึกฝนและระบบภายในอย่างเต็มที่ เพื่อตรวจสอบความสอดคล้องกับคุณค่าของมนุษย์
ทำไมผู้เชี่ยวชาญถึงกังวลเกี่ยวกับความเป็นอิสระของผู้ประเมินความปลอดภัย?
ผู้เชี่ยวชาญกว่า 100 คนรวมถึง Geoffrey Hinton เตือนว่ามาตรการสมัครใจเพียงอย่างเดียวไม่เพียงพอหากขาดการคุ้มครองทางกฎหมาย เพื่อรับประกันความเป็นอิสระที่แท้จริงของผู้ประเมินและป้องกันไม่ให้บริษัทปิดบังข้อมูล
ปัญหาเรื่องกรอบเวลาในการประเมินความปลอดภัย AI คืออะไร?
ผู้วิจารณ์ชี้ว่าระยะเวลาทดสอบปัจจุบันมักสั้นเกินไป เช่น Apollo Research มีเวลาเพียง 3 วันในการประเมิน GPT-6 Astra ซึ่งไม่เพียงพอต่อการตรวจจับพฤติกรรมที่ซับซ้อนของโมเดล
บริษัทเทคโนโลยีรายอื่นอย่าง Google หรือ Meta สนับสนุนข้อเสนอนี้หรือไม่?
Google DeepMind, Meta และ SpaceX AI ยังไม่ได้ลงนามในโมเดลนี้ โดย Demis Hassabis จาก Google DeepMind เสนอให้จัดตั้งหน่วยงานมาตรฐานอุตสาหกรรมแยกต่างหากแทนการพึ่งพาการควบคุมตนเองของบริษัท
สถานการณ์ทางการเมืองมีผลต่อการกำกับดูแลความปลอดภัย AI อย่างไร?
กระแสการเมืองในสหรัฐฯ คัดค้านการควบคุมโดยรัฐบาล โดยประธานาธิบดี Donald Trump และ David Sacks ไม่สนับสนุนกฎระเบียบที่เข้มงวด ขณะที่กลุ่ม ARI เรียกร้องให้เปลี่ยนคำมั่นสัญญาแบบสมัครใจเป็นมาตรฐานระดับรัฐบาลกลางที่บังคับใช้