BTC$64,016 0.40%ETH$1,870 0.20%BNB$593.03 0.60%XRP$1.08 0.30%SOL$73.87 0.40%ADA$0.19277 1.50%AVAX$6.71 3.30%DOT$0.83966 1.20%BTC$64,016 0.40%ETH$1,870 0.20%BNB$593.03 0.60%XRP$1.08 0.30%SOL$73.87 0.40%ADA$0.19277 1.50%AVAX$6.71 3.30%DOT$0.83966 1.20%

Thị trường · ✦ AI tổng hợp

Anthropic xác nhận Fable 5 không có rủi ro đặc biệt, Claude Mythos 5 trở lại toàn cầu

Anthropic công bố kết quả kiểm thử nội bộ cho thấy Claude Fable 5 không gây ra rủi ro an ninh mạng đặc thù so với các mô hình AI khác. Mô hình này sẽ được tái triển khai toàn cầu vào ngày 2/7, kết thúc 18 ngày tạm ngưng do lệnh kiểm soát xuất khẩu của Mỹ. Claude Mythos 5 cũng đã quay trở lại cho các đối tác được chính phủ phê duyệt từ ngày 26/6.

📅 01/07/20263 phút đọcNguồn: BeInCrypto

Anthropic xác nhận Fable 5 không có rủi ro đặc biệt, Claude Mythos 5 trở lại toàn cầu

Anthropic vừa công bố kết quả kiểm thử nội bộ cho thấy Claude Fable 5 không sở hữu năng lực an ninh mạng đặc thù so với các mô hình AI tiên tiến khác trên thị trường. Tuyên bố này được đưa ra cùng thời điểm Fable 5 chuẩn bị tái triển khai toàn cầu vào ngày 2/7/2026, khép lại 18 ngày tạm ngưng kể từ khi bị đình chỉ do lệnh kiểm soát xuất khẩu của Mỹ vào ngày 12/6.

Lý do Fable 5 bị tạm ngưng

Fable 5 và Mythos 5 ra mắt đồng thời ngày 9/6, cùng chia sẻ một nền tảng mô hình cốt lõi. Fable 5 được cung cấp rộng rãi cho công chúng, trong khi Mythos 5 chỉ giới hạn cho một số đối tác tin cậy trong khuôn khổ Project Glasswing phục vụ công tác an ninh mạng phòng thủ.

Vụ việc xảy ra sau khi các nhà nghiên cứu tại Amazon phát hiện một kỹ thuật có thể vượt qua các biện pháp bảo vệ của Fable 5. Kỹ thuật này có thể khiến mô hình xác định các lỗ hổng phần mềm và trong một trường hợp cụ thể, còn thực thi thành công một exploit. Phát hiện này dẫn đến quyết định tạm ngưng mô hình theo yêu cầu từ phía chính phủ Mỹ.

Kết quả kiểm thử so sánh

Để đánh giá mức độ rủi ro thực sự, Anthropic đã kiểm thử nhiều mô hình AI cạnh tranh trong cùng điều kiện. Kết quả cho thấy Claude Opus 4.8, GPT-5.5 và Kimi K2.7 đều có khả năng xác định các lỗ hổng tương tự mà Fable 5 bị cáo buộc trong báo cáo của Amazon. Đặc biệt, mọi mô hình được kiểm thử đều có thể tái hiện lại hành vi exploit duy nhất được ghi nhận.

Phát hiện này cho thấy lệnh hạn chế nhắm vào một khoảng trống bảo mật chung trên toàn ngành, chứ không phải một mối đe dọa riêng biệt của Fable 5.

Cơ chế bảo vệ mới

Mặc dù vậy, Anthropic vẫn tiến hành xây dựng một bộ classifier mạnh hơn để ngăn chặn kỹ thuật bypass được báo cáo. Theo Anthropic, bộ phân loại mới này có thể chặn kỹ thuật vượt rào trong hơn 99% trường hợp. Các yêu cầu bị chặn sẽ được tự động chuyển hướng sang Opus 4.8.

Fable 5 vốn đã được trang bị ngưỡng an toàn chặt chẽ nhất từ trước đến nay của Anthropic — các classifier của mô hình chặn cả những yêu cầu có vẻ rủi ro nhẹ, không chỉ những yêu cầu rõ ràng gây hại. Tuy nhiên, cơ chế này kéo theo một chi phí đáng kể: Anthropic thừa nhận bộ phân loại mới đang gắn cờ nhiều yêu cầu lập trình và gỡ lỗi thông thường vô hại, và cam kết tiếp tục tinh chỉnh để giảm tỷ lệ false positive.

Về phía Mythos 5, mô hình này — vốn mang ít ràng buộc hơn — đã được khôi phục từ ngày 26/6 nhưng chỉ dành cho các tổ chức được chính phủ phê duyệt.

Câu hỏi chính sách còn bỏ ngỏ

Dữ liệu kiểm thử của chính Anthropic đặt ra một câu hỏi khó cho giới quản lý: nếu các mô hình kém mạnh hơn đã có thể thực hiện những gì khiến Fable 5 bị cấm, thì tiêu chuẩn nào sẽ được áp dụng cho các mô hình frontier thế hệ tiếp theo? Đây là bài toán chính sách mà cả ngành AI lẫn các cơ quan quản lý vẫn chưa có câu trả lời thống nhất.

#Anthropic#AI an ninh mạng#kiểm soát xuất khẩu#quản lý AI#mô hình ngôn ngữ lớn#chính sách công nghệ
⚠️ Miễn trừ trách nhiệm: Bài viết này được tổng hợp và biên tập từ nhiều nguồn nhằm mục đích thông tin. Không phải lời khuyên đầu tư. Luôn tự nghiên cứu (DYOR) trước khi đưa ra quyết định.

/ Bài viết liên quan