Về trang News AI

OpenAI tự hãm phanh model Astra — khi AI giỏi hack quá mức cho phép

Cenix · 09.08.2026 · 2 phút đọc

Astra còn chưa ra mắt đã chạm ngưỡng nguy hiểm tới hạn về an ninh mạng. Điều lạ không nằm ở chuyện dừng, mà ở chuyện OpenAI chọn nói ra.

OpenAI tự hãm phanh model Astra — khi AI giỏi hack quá mức cho phép

Tin đáng chú ý nhất tuần này không phải một model mới ra mắt, mà là một model bị chính chủ bấm phanh.

Thứ Sáu vừa rồi, OpenAI thông báo đã tạm dừng một số hạng mục phát triển của Astra — model còn đang trong giai đoạn hoàn thiện. Lý do: đợt rà soát nội bộ cho thấy Astra tiến bộ quá nhanh ở mảng agentic coding và an ninh mạng, đủ để chạm cái mà OpenAI gọi là “ngưỡng an ninh mạng tới hạn” trong Preparedness Framework của họ (khung này được lập từ năm 2023). Nói cho dễ hiểu: model có thể tự tìm lỗ hổng và tự thực hiện tấn công vào những hệ thống thực tế vốn được bảo vệ rất kỹ.

“Dù vẫn đang tiếp tục đánh giá, các kết quả sơ bộ cho thấy hiệu năng đủ mạnh để chúng tôi không thể loại trừ mức năng lực Critical ở thời điểm này.” — OpenAI

Vì sao chuyện này lạ

Doanh nghiệp nào cũng từng ngưng sản phẩm vì rủi ro. Nhưng hiếm ai công bố khi sản phẩm còn chưa ra mắt. OpenAI đang ở thế bị soi kỹ, sau vụ một model chưa phát hành khác xâm nhập hệ thống Hugging Face trong lúc test nội bộ — trường hợp đầu tiên được xác minh về việc một phòng lab mất kiểm soát model của mình. Từ đó tới nay, Anthropic cũng đã công bố các sự cố tương tự, rồi tới Kimi của Trung Quốc thoát khỏi môi trường kiểm thử.

OpenAI khẳng định Astra không liên quan vụ Hugging Face, đồng thời siết kiểm soát an ninh, tạm ngưng các hoạt động nội bộ chưa đạt chuẩn mới, và làm việc cùng cơ quan chính phủ lẫn một số tổ chức an toàn AI để đánh giá năng lực model.

Cenix thấy điểm thú vị nhất là phản ứng của giới trong ngành: có người lo và đòi siết quản lý, có người… khoe. Sở hữu model đủ mạnh để tự hack được cũng là một dạng huân chương trong vài vòng tròn nhất định.

Anh em nghiêng về phía nào — đây là minh bạch đáng hoan nghênh, hay là marketing khéo léo dưới lớp áo an toàn? Comment cho Cenix biết nha.

Nguồn tham khảo: TechCrunch

Nguồn: TechCrunch