The New York Times รายงานว่า OpenAI ได้ตัดสินใจพับแผนเปิดตัวโมเดลปัญญาประดิษฐ์รุ่นใหม่ GPT-6.1 Astra ที่เดิมเตรียมปล่อยใช้งานในอีกไม่กี่สัปดาห์ข้างหน้าอย่างกะทันหัน หลังทีมทดสอบความปลอดภัยพบพฤติกรรมถดถอยและควบคุมได้ยากขึ้นอย่างเห็นได้ชัด
แม้ว่า GPT-6.1 Astra จะได้รับการพัฒนาให้เก่งขึ้นกว่ารุ่น GPT-6 ในแง่การทำงานที่ซับซ้อนแบบเบ็ดเสร็จตั้งแต่ต้นจนจบ (end-to-end) โดยไม่ต้องพึ่งพามนุษย์ รวมถึงทักษะด้านงานเขียน แต่ข้อมูลจาก Saachi Jain หัวหน้าฝ่ายระบบความปลอดภัยของ OpenAI ระบุว่า โมเดลกลับมีปัญหาถดถอยใน 2 มิติสำคัญ:
- การทำตามคำสั่งแย่ลง (Alignment Drop): โมเดลไม่ค่อยยอมทำตามเงื่อนไขหรือพรอมต์ของผู้ใช้อย่างเคร่งครัดเหมือนเดิม
- เริ่มมีพฤติกรรมหลอกลวง (Higher Levels of Deception): โมเดลไม่พูดความจริงเกี่ยวกับการกระทำของตนเองหลังจากได้รับคำสั่ง
- ทำงานเกินขอบเขตโดยพลการ: ตัวโมเดลแอบลุยงานต่อเองนอกเหนือจากขอบเขตที่สั่ง และเชื่อมต่อไปยังเครื่องมือหรือบริการภายนอกโดยไม่ขออนุญาตผู้ใช้งาน
เดิมที OpenAI ตั้งใจจะนำ GPT-6.1 Astra มาให้บริการทั้งบน ChatGPT และ Codex รวมถึงคาดว่าจะมีการพูดถึงในงาน DevDay แต่เมื่อเกิดปัญหาดังกล่าว ทำให้บริษัทต้องเปลี่ยนแผนไปมุ่งเน้นการปรับปรุงความปลอดภัยของโมเดลรุ่นถัดไปแทน
การสั่งเบรกครั้งนี้เกิดขึ้นในช่วงที่ค่าย AI ชั้นนำทั้ง OpenAI และ Anthropic ต่างเริ่มส่งสัญญาณให้ชะลอความเร็วในการพัฒนาลง หลังเจอปัญหาความปลอดภัยและช่องโหว่รุมเร้า ซึ่งสะท้อนให้เห็นว่ายิ่งโมเดลฉลาดจนเริ่มทำงานได้เองอย่างอิสระมากเท่าไร ความท้าทายเรื่องการควบคุม (AI Alignment) ก็ยิ่งเป็นโจทย์ใหญ่ที่ต้องระวังมากขึ้นเท่านั้น
ที่มา: 9to5Google
ความคิดเห็น
ร่วมแสดงความคิดเห็น
เข้าสู่ระบบด้วย Google ในคลิกเดียว เพื่อเริ่มแลกเปลี่ยนความคิดเห็น
ยังไม่มีความคิดเห็นในบทความนี้
เข้าสู่ระบบด้วย Google แล้วเริ่มการพูดคุยเป็นคนแรกได้เลย!