ไมเคิล เดลล์ ผู้ก่อตั้งและประธานเจ้าหน้าที่บริหารของ Dell ระบุว่า ก่อนที่บริษัทจะมอบหมายงานให้ AI Agent ต้องตอบให้ได้ก่อนว่า มีสิ่งใดบ้างที่ระบบจะต้องไม่ทำโดยเด็ดขาด ไม่ว่าจะได้รับคำสั่งอย่างไร แนวคิดนี้เกิดขึ้นในช่วงที่ AI เริ่มเชื่อมต่อกับเครือข่ายภายใน ระบบไฟล์ และสภาพแวดล้อมสำหรับเขียนโค้ดขององค์กร ทำให้การกำหนดขอบเขตด้านความปลอดภัยกลายเป็นประเด็นสำคัญในการนำเทคโนโลยีไปใช้งานจริง
ไมเคิล เดลล์เรียกร้องให้กำหนดข้อห้ามก่อนใช้งาน
AI Agent แตกต่างจากแชตบอตที่ทำหน้าที่สร้างข้อความหรือตอบคำถามเพียงอย่างเดียว ระบบเหล่านี้สามารถเขียนโค้ด เปิดไฟล์ และดำเนินการต่อเนื่องหลายขั้นตอนภายในระบบองค์กรได้ โดยไม่จำเป็นต้องรอให้มนุษย์ยืนยันทุกครั้ง
เดลล์เปรียบเทียบ AI Agent กับพนักงานในองค์กร โดยระบุว่าไม่มีบริษัทใดเปิดให้พนักงานคนหนึ่งเดินเข้าออกทุกห้องในอาคารได้โดยไม่มีการควบคุมสิทธิ์ เช่นเดียวกันกับ AI Agent ที่ควรอยู่ภายใต้ข้อจำกัดที่ชัดเจน บริษัทจึงต้องกำหนดล่วงหน้าว่า Agent เข้าถึงข้อมูลใดได้บ้าง มีสิทธิ์ดำเนินการระดับใด และสามารถทำงานอะไรได้หรือไม่ได้
เดลล์ยังเตือนว่า การใช้คำสั่งป้อนเข้าไปในระบบหรือพึ่งพาความสามารถของโมเดลเพียงอย่างเดียวไม่เพียงพอที่จะสร้างขอบเขตความปลอดภัย ข้อจำกัดที่มีผลจริงควรถูกนำไปบังคับใช้ในระดับระบบและฮาร์ดแวร์ ไม่ใช่เพียงเขียนไว้ในพรอมป์ต์ที่ส่งให้โมเดล
Nvidia เปิดตัวโครงสร้างความปลอดภัยสองชั้น
Nvidia เปิดตัว Open Agent Safety Platform เพื่อสร้างชั้นควบคุมความปลอดภัยสำหรับ AI Agent โดยเจนเซน หวง ประธานเจ้าหน้าที่บริหารของ Nvidia อธิบายว่าแพลตฟอร์มนี้เป็นระบบนิเวศแบบเปิดที่ผู้พัฒนาสามารถนำไปสร้างโครงสร้างพื้นฐานสำหรับการใช้งาน Agent อย่างปลอดภัย ปัจจุบันมีพันธมิตรมากกว่า 100 ราย รวมถึง Anthropic, Microsoft และ CrowdStrike
แพลตฟอร์มดังกล่าวประกอบด้วยสองส่วน ได้แก่ OpenShell ซึ่งเป็นเครื่องมือซอฟต์แวร์สำหรับกำหนดว่า AI Agent จะเห็นข้อมูลใดและดำเนินการอะไรได้บ้าง และ Sentry ซึ่งทำงานบนชิปแยกต่างหากเพื่อเฝ้าติดตามพฤติกรรมของ Agent จากภายนอกเครื่องประมวลผลหลัก
ตามแนวคิดที่เดลล์อธิบายไว้ หาก Agent ฝ่าฝืนกฎที่กำหนด ระบบสามารถแยก Agent ออกจากระบบหรือจำกัดการทำงานได้ภายในระดับมิลลิวินาที Nvidia ระบุว่า OpenShell ใช้แนวทางโอเพนซอร์ส และไม่ได้จำกัดการใช้งานไว้เฉพาะฮาร์ดแวร์ของ Nvidia โดยรองรับชิป Arm และ Intel ด้วย ขณะนี้ซอฟต์แวร์ดังกล่าวเปิดให้ใช้งานบน GitHub แล้ว
อย่างไรก็ตาม แพลตฟอร์มไม่ได้กำหนดรายการข้อห้ามให้บริษัทต่าง ๆ ล่วงหน้า แต่ละองค์กรยังต้องเป็นผู้ระบุเองว่า AI Agent ห้ามดำเนินการใดบ้าง
AI Agent เริ่มเข้าถึงระบบจริงขององค์กร
ประเด็นเรื่องขอบเขตความปลอดภัยไม่ได้จำกัดอยู่ในห้องทดลอง โดยมีห้องปฏิบัติการ AI ชั้นนำ 4 แห่งยืนยันว่าโมเดลของตนเคยเข้าถึงระบบจริงของบริษัทหรือหน่วยงานต่าง ๆ
Google เคยยอมรับว่า Gemini เจาะผ่านระบบของบริษัท 3 แห่งในการทดสอบเมื่อเดือนพฤษภาคม ขณะที่เมื่อสัปดาห์ก่อน AI Agent ของ OpenAI ได้บุกรุกพอร์ทัล Medicare ของรัฐบาลออสเตรเลีย เหตุการณ์เหล่านี้แสดงให้เห็นว่า เมื่อ AI Agent ได้รับสิทธิ์เข้าถึงเครือข่าย ไฟล์ หรือระบบธุรกิจ ขอบเขตการทำงานอาจขยายเกินกว่าที่องค์กรคาดไว้ในตอนแรก ความสัมพันธ์ระหว่างความสามารถของโมเดลกับสิทธิ์การเข้าถึงจึงเป็นหัวใจของการควบคุมความปลอดภัย
ก่อนหน้านี้ หวงระบุว่า หากการทดลอง AI ไม่สามารถควบคุมได้อย่างมีประสิทธิภาพ ห้องปฏิบัติการที่เกี่ยวข้องควรหยุดการทำงาน โดยเขากล่าวถึง Open Agent Safety Platform ว่า “ศักยภาพมหาศาลของ AI ต่อสังคมจะเกิดขึ้นได้ก็ต่อเมื่อเราแก้ไขปัญหาความปลอดภัยของ AI ได้แล้ว”
สำหรับบริษัทและนักลงทุน ตัวแปรสำคัญที่ยังไม่มีมาตรฐานร่วมกันคือ แต่ละองค์กรจะนิยามสิ่งที่ AI Agent ห้ามทำอย่างไร และข้อจำกัดเหล่านั้นจะยังทำงานได้หรือไม่เมื่อพรอมป์ต์ล้มเหลว โมเดลแสดงพฤติกรรมผิดปกติ หรือมีการใช้สิทธิ์เกินขอบเขต Nvidia จัดหาเครื่องมือทั้งซอฟต์แวร์และฮาร์ดแวร์ให้แล้ว แต่กฎด้านสิทธิ์การเข้าถึงและความรับผิดชอบขั้นสุดท้ายยังอยู่ที่องค์กรผู้ติดตั้งระบบ