Về trang News AI

Model AI sổng chuồng thì làm gì — hầu hết lab lớn vẫn chưa có câu trả lời công khai

Cenix · 24.08.2026 · 2 phút đọc

Nghiên cứu mới chấm điểm 5 lab hàng đầu về kế hoạch kiểm soát mô hình mất kiểm soát. OpenAI đứng đầu, Anthropic và Meta xếp chót.

Model AI sổng chuồng thì làm gì — hầu hết lab lớn vẫn chưa có câu trả lời công khai

Một nghiên cứu mới của Guidelight AI Standards vừa chấm điểm 5 lab AI hàng đầu — Anthropic, Google, OpenAI, Meta và xAI — về mức độ sẵn sàng cho một tình huống rất cụ thể: mô hình bị bắt quả tang đang tìm cách qua mặt sự kiểm soát của con người thì làm gì tiếp.

Kết quả: OpenAI đứng đầu với 3 trên 5 điểm. Anthropic và Meta xếp thấp nhất.

Guidelight định nghĩa “kế hoạch kiểm soát” là kế hoạch được vạch sẵn, kích hoạt khi phát hiện AI tìm cách lật kèo — quy định thu hồi quyền nào, mô hình còn được phục vụ ai, trong điều kiện gì, và khi nào thì tắt hẳn.

”Tôi bất ngờ vì họ nói quá ít”

Steven Adler, chief scientist của Guidelight và cựu nhân sự an toàn tại OpenAI, nói với TechCrunch:

“Tôi bất ngờ vì các công ty AI đã nói quá ít về việc họ sẽ xử lý thế nào nếu xảy ra sự cố rất nghiêm trọng, khi mô hình của họ thoát khỏi tầm kiểm soát theo một nghĩa nào đó.”

Cần công bằng một điểm: bảng điểm chỉ dựa trên thông tin công khai, nên điểm thấp phản ánh việc thiếu công bố, không nhất thiết là thiếu biện pháp nội bộ. Google và OpenAI đều nói báo cáo không phản ánh hết quy trình bên trong họ. Meta từ chối xác nhận có kế hoạch kiểm soát hay không.

Luật sư Lily Li, sáng lập Metaverse Law, chỉ ra một lý do rất thực tế: công bố càng chi tiết mà làm không đúng cam kết thì càng dễ bị kiện về quảng cáo gian dối.

OpenAI được điểm cao nhất vì đã nhiều lần thực sự tạm dừng hoặc chấm dứt workload sau khi phát hiện sự cố an toàn. Adler lưu ý điểm số này mới cải thiện gần đây, sau vụ một mô hình OpenAI thoát khỏi sandbox kiểm thử và xâm nhập hệ thống của Hugging Face khi đang tìm cách gian lận một bài đánh giá an ninh mạng.

Áp lực pháp lý cũng đang siết lại: SB 53 của California đã có hiệu lực năm nay, RAISE Act của New York bắt đầu áp dụng từ tháng 1, và một dự luật liên bang lưỡng đảng mang tên AI Kill Switch Act vừa được đưa ra tháng trước.

Adler nhắc lại câu ngạn ngữ cũ: bản kế hoạch thì vô dụng, nhưng việc lập kế hoạch thì không thể thiếu.

Mấy fen nghĩ sao — công khai kế hoạch kiểm soát nên là bắt buộc, hay để các lab tự quản là đủ? Comment cho tui biết.

Nguồn tham khảo: TechCrunch

Nguồn: TechCrunch