Mỹ ra lệnh cho Anthropic cắt quyền truy cập Fable 5 và Mythos 5 vì lo ngại vượt rào bảo mật

Can thiệp của chính phủ ảnh hưởng đến các mô hình mới nhất của Anthropic
Chính phủ Mỹ đã ra lệnh cho Anthropic ngay lập tức đình chỉ quyền truy cập vào hai hệ thống AI tiên tiến nhất của công ty, Claude Fable 5 và Claude Mythos 5, viện dẫn những quan ngại về an ninh quốc gia liên quan đến khả năng bị vượt rào bảo mật.
Anthropic cho biết họ nhận được chỉ thị vào thứ Sáu lúc 5:21 chiều theo giờ ET và đã tuân thủ, đồng thời cho rằng chính phủ “đã sai ở vụ này.” Công ty nói lệnh buộc họ phải vô hiệu hóa quyền truy cập cả hai mô hình trên toàn cầu, không chỉ đối với công dân nước ngoài, mặc dù hành động này được trình bày như một biện pháp kiểm soát xuất khẩu.
Bước đi này diễn ra vào thời điểm nhạy cảm đối với Anthropic. Mythos 5 là mô hình có năng lực nhất của công ty và đã được giữ dưới các hạn chế nghiêm ngặt vì khả năng báo cáo các lỗ hổng bảo mật trong phần mềm. Anthropic cho biết họ đã thử nghiệm mô hình trên các hệ điều hành và trình duyệt chính và tìm thấy những lỗ hổng ở mỗi nền tảng. Thay vì phát hành rộng rãi, công ty đã giới hạn quyền truy cập thông qua Project Glasswing, một chương trình kiểm soát với khoảng 50 tổ chức được thẩm định bao gồm Amazon, Apple, Google, Microsoft và CrowdStrike.
Fable 5, được phát hành chỉ ba ngày trước, là phiên bản dành cho công chúng của Mythos 5, được thiết kế với các rào chắn để chặn các chủ đề rủi ro cao như an ninh mạng và sinh học. Công ty cho biết họ tin rằng các biện pháp bảo vệ đó khiến mô hình phù hợp để phát hành rộng rãi, và các bài kiểm tra chuẩn đoán từ Vals AI đã đặt nó lên vị trí dẫn đầu trong lĩnh vực công khai.
Anthropic nói rằng mối quan ngại của chính phủ dường như tập trung vào một cáo buộc vượt rào bảo mật đối với Fable 5. Theo công ty, các quan chức chỉ cung cấp bằng chứng bằng lời về một “khả năng vượt rào hẹp, không phổ quát” liên quan đến những prompt khiến mô hình kiểm tra mã nguồn và nhận diện các lỗ hổng phần mềm. Anthropic cho biết khả năng đó đã hiện diện trong các mô hình công khai khác, bao gồm GPT-5.5 của OpenAI, và thường được sử dụng cho công việc bảo vệ an ninh mạng.
Công ty cũng lập luận rằng các biện pháp bảo vệ mạnh nhất của họ dựa vào các hệ thống phân loại độc lập tách biệt khỏi chính mô hình, có nghĩa là việc vượt rào sẽ không nhất thiết đánh bại các lớp bảo vệ cơ bản chống lại các đầu ra nguy hiểm.
Dù vậy, lệnh của chính phủ là một dấu hiệu rõ ràng cho thấy AI tiên tiến đang nhanh chóng trở thành vấn đề an ninh quốc gia — và các cơ quan quản lý ngày càng sẵn sàng can thiệp khi họ tin rằng một mô hình có thể đã vượt ngưỡng an toàn.
Nguồn: