OpenAI และ Anthropic ใกล้บรรลุข้อตกลงการทดสอบความปลอดภัยโมเดล AI ข้ามองค์กร ขณะที่การสูญเสียการควบคุมของเอเจนต์ส่งสัญญาณเตือน
เมื่อวันที่ 21 กันยายน OpenAI และ Anthropic เตรียมบรรลุดข้อตกลงร่วมทดสอบภาวะวิกฤตความปลอดภัยของโมเดล AI ผ่านการแลกเปลี่ยนการเข้าถึง API ท่ามกลางความกังวลด้านการสูญเสียการควบคุมและการแข่งขันด้านผลิตภัณฑ์ที่รุนแรงกับผู้เล่นรายอื่น เช่น Meta และ SpaceX โดยข้อตกลงดังกล่าวอาจเผชิญการตรวจสอบจากหน่วยงานกำกับดูแลด้านการผูกขาด ขณะที่ผู้บริหารเทคโนโลยีบางส่วนมองว่าปัญหาดังกล่าวอาจมาจากความผิดพลาดทางวิศวกรรมของมนุษย์

TradingKey — เมื่อวันที่ 21 กันยายน รายงานจาก ดิ อินฟอร์เมชัน (The Information) สื่อเทคโนโลยีของสหรัฐฯ ระบุว่า OpenAI และ Anthropic ใกล้จะบรรลุข้อตกลงที่มีผลผูกพันทางกฎหมาย โดยบริษัท AI ชั้นนำทั้งสองแห่งจะร่วมกัน "ทดสอบภาวะวิกฤต" (stress-test) โมเดลเชิงพาณิชย์ของกันและกัน เพื่อระบุช่องโหว่ด้านความปลอดภัยล่วงหน้า
ภายใต้เงื่อนไขที่เสนอ ทั้งสองฝ่ายจะมอบสิทธิ์การเข้าถึง API ของโมเดลแก่กันและกันเพื่อตรวจหาช่องโหว่ พร้อมทั้งให้คำมั่นว่าจะไม่เก็บรักษาข้อมูลของอีกฝ่ายไว้ การร่วมมือโดยตรงระหว่างสองยักษ์ใหญ่ถูกมองเป็นการเปลี่ยนแปลงครั้งสำคัญในกลยุทธ์ความปลอดภัย AI อย่างไรก็ตาม หน่วยงานกำกับดูแลการต่อต้านการผูกขาดอาจตรวจสอบข้อตกลงนี้ในประเด็นการ "ผูกขาดโดยผู้ขายสองราย" (duopoly) ซึ่งสร้างความเสี่ยงด้านการกำกับดูแลให้กับนักลงทุนในระบบนิเวศของทั้งสองบริษัท
การเจรจาดังกล่าวเกิดขึ้นท่ามกลางเหตุการณ์ความไม่ปลอดภัยที่น่ากังวลหลายครั้งอย่างต่อเนื่อง โดยในเดือนกรกฎาคมปีนี้ เอเจนต์ AI ของ OpenAI ได้รุกล้ำระบบของ Hugging Face รวมถึงระบบของ OpenAI เอง พร้อมทั้งจงใจปกปิดร่องรอยการบุกรุกและปิดบังพนักงานไว้นานหลายวัน จากนั้นไม่ถึงสิบวันต่อมา Anthropic ยังได้เปิดเผยว่าโมเดล Claude ของตนได้เข้าถึงระบบที่ใช้งานจริงของบริษัทสามแห่งโดยไม่ได้รับอนุญาตในระหว่างการประเมินความปลอดภัย
สัญญาณการสูญเสียการควบคุมยังขยายวงกว้างขึ้นไปอีก โดย OpenAI ได้เปิดเผยกรณี "การแฮกเพื่อเอาการตอบสนองเชิงบวก" (reward hacking) หลายกรณี ได้แก่ เอเจนต์รายหนึ่งใช้รหัสที่รั่วไหลเพื่อดึงข้อมูลย้อนหลัง และสร้างข้อมูลขึ้นมาเองเมื่อดึงข้อมูลไม่สำเร็จ ขณะที่เอเจนต์อีกรายได้อัปโหลดไฟล์ขึ้นอินเทอร์เน็ตโดยไม่ได้รับอนุญาตเพียงเพื่อนำมาอ้างอิงในคำตอบของตน ยิ่งไปกว่านั้น การทดลองฝึกฝนโมเดลภายในองค์กรได้กลายเป็นระบบอัตโนมัติอย่างหนัก จนถึงขั้นที่บางครั้งเอเจนต์ได้ติดต่อไปยังเพื่อนร่วมงานทางแอปส่งข้อความในที่ทำงานเชิงรุกเพื่อแก้ไขช่องโหว่ด้วยตนเอง
เพื่ออุดช่องโหว่ด้านความปลอดภัยเหล่านี้ แซม อัลต์แมน (Sam Altman) ประธานเจ้าหน้าที่บริหารของ OpenAI ได้แสดงความสนับสนุนข้อเสนอของ ดาริโอ อาโมเดอี (Dario Amodei) ประธานเจ้าหน้าที่บริหารของ Anthropic ในการส่งผู้ประเมินความปลอดภัยที่เป็นบุคคลที่สามซึ่งเป็นอิสระและได้รับสิทธิ์การเข้าถึงระดับพนักงานเข้าไปประจำการภายในบริษัท AI นอกจากนี้ เขายังสนับสนุนการจัดตั้งองค์กรกำหนดมาตรฐานทั่วทั้งอุตสาหกรรมและกระบวนการเปิดเผยเหตุการณ์ต่อรัฐบาลอย่างเป็นทางการ
ในทางเทคนิค ความกังวลในรอบนี้เชื่อมโยงกับเทคโนโลยี "การใช้เหตุผลแบบย้อนวน" (recurrent reasoning) ซึ่งโมเดลจะไตร่ตรองซ้ำ ๆ ก่อนตอบ ซึ่งช่วยเพิ่มขีดความสามารถได้อย่างมาก แต่ทำให้กระบวนการใช้เหตุผลตรวจสอบได้ยากขึ้น ซึ่งนี่คือจุดบอดที่ข้อตกลงการทดสอบร่วมกันมุ่งหวังจะตรวจหานั่นเอง ขณะเดียวกัน ผู้บริหารจากไมโครซอฟท์และเอ็นวิเดียได้เสนอมุมมองที่แตกต่างออกไปในสัปดาห์นี้ โดยโต้แย้งว่าปัญหาบางประการเกิดจากความผิดพลาดของมนุษย์และวิศวกรรมที่ไม่ดีพอ ไม่ใช่เกิดจากตัว AI เอง
นอกจากความร่วมมือด้านความปลอดภัยแล้ว การแข่งขันในฝั่งผลิตภัณฑ์ก็ตึงเครียดไม่แพ้กัน โดย Muse ของเมตา (Meta) ขึ้นอันดับหนึ่งในชาร์ตแอปฟรีบน App Store ของสหรัฐฯ เพียงหนึ่งสัปดาห์หลังเปิดตัว ส่งผลให้ ChatGPT ตกไปอยู่อันดับสอง ด้าน OpenAI กำลังพัฒนาฟีเจอร์ใหม่ที่มุ่งเป้าไปที่ Grok Bot ของสเปซเอ็กซ์ (SpaceX) ที่เพิ่งเปิดตัวโดยตรง และกำลังหารือถึงการเปิดตัวผู้ช่วย AI ส่วนบุคคลเพื่อแข่งขันกับ Muse ซึ่งผลิตภัณฑ์ใหม่นี้จะรวมเทคโนโลยีเอเจนต์ที่มีอยู่จาก Codex และ ChatGPT เป็นหลัก โดยเชื่อมต่อกับแอปพลิเคชันต่าง ๆ เช่น อีเมลและปฏิทิน เพื่อทำภารกิจหลายขั้นตอนให้เสร็จสมบูรณ์โดยอัตโนมัติ เช่น การจัดตารางเวลาและการสื่อสารทางอีเมล ขณะเดียวกัน แอปอื่นที่มีลักษณะคล้ายกันอย่าง Instinct ก็มียูสเซอร์ทะลุ 100,000 รายแล้ว
เนื้อหานี้ได้รับการแปลโดยปัญญาประดิษฐ์ (AI) และผ่านตรวจสอบโดยมนุษย์ มีไว้เพื่อการอ้างอิงและข้อมูลทั่วไปเท่านั้น ไม่ใช่การแนะนำการลงทุนแต่อย่างใด
บทความแนะนำ













ความคิดเห็น (0)
คลิกปุ่ม $ ป้อนสัญลักษณ์ และเลือกเพื่อเชื่อมโยงหุ้น, กองทุน ETF หรือสัญลักษณ์หลักทรัพย์อื่น ๆ