Thị trường · ✦ AI tổng hợp
Người dùng phản ứng mạnh sau khi Anthropic 'nhốt cứng' Claude Fable 5
Claude Fable 5 vấp phải làn sóng chỉ trích sau lần tái ra mắt ngày 1/7, khi các bộ lọc an toàn mới khiến điểm benchmark sụt giảm nghiêm trọng ở các tác vụ lập trình và debug. Anthropic thừa nhận bộ phân loại mới chặn cả nhiều yêu cầu hợp lệ, song khẳng định model nền không thay đổi.
Claude Fable 5 tái ra mắt giữa làn sóng phản ứng từ cộng đồng
Anthropic đang đối mặt với làn sóng chỉ trích ngày càng lớn sau khi tái phát hành Claude Fable 5 vào ngày 1/7. Người dùng cho rằng các guardrail (bộ rào cản an toàn) được thắt chặt đã làm suy giảm đáng kể hiệu năng của model hàng đầu này trong các tác vụ lập trình, gỡ lỗi và hoạt động agentic.
Điểm benchmark sụt giảm mạnh
Nhóm đánh giá hiệu năng BridgeMind đã chạy lại bộ kiểm thử BridgeBench trên phiên bản Fable 5 ngày 1/7 và ghi nhận mức giảm đáng kể:
- Gỡ lỗi (Debugging): từ 86,2 xuống còn 25,9
- Tái cấu trúc mã (Refactoring): từ 73,6 xuống còn 38,4
- Xử lý ảo giác (Hallucination handling): từ 75,9 xuống còn 61,7
Đáng chú ý, chỉ 3 trong 12 tác vụ debug được hoàn thành mà không cần chuyển sang Claude Opus 4.8 — và mỗi lần chuyển tiếp như vậy đều bị tính điểm 0. Điều này cho thấy sự sụt giảm phản ánh các tác vụ bị chặn, chứ không phải do năng lực suy luận của model yếu đi.
BridgeMind kết luận: "Model không hề tệ hơn. Nó bị nhốt lại." Khi một tác vụ được thực thi trọn vẹn, Fable 5 vẫn đạt hiệu năng tương đương phiên bản tháng 6.
Bối cảnh: Tạm dừng, kiểm soát xuất khẩu và tái phát hành có điều kiện
Dòng thời gian sự kiện phần nào giải thích căng thẳng hiện tại. Anthropic ra mắt Fable 5 vào ngày 9/6, nhưng chỉ ba ngày sau, chính phủ Mỹ yêu cầu gỡ xuống. Lệnh kiểm soát xuất khẩu được dỡ bỏ vào ngày 30/6 — bốn ngày sau khi quyền truy cập Mythos 5 được khôi phục cho khoảng 100 tổ chức tại Mỹ.
Việc khôi phục quyền truy cập cũng đi kèm hạn chế: Fable 5 chỉ sử dụng 50% hạn ngạch hàng tuần đến ngày 7/7, sau đó chuyển sang tính phí theo tín dụng sử dụng.
Anthropic lý giải về lựa chọn an toàn rộng hơn
Trong tuyên bố ngày 30/6, Anthropic cho biết công ty chủ động mở rộng biên độ an toàn, tức là các bộ phân loại (classifier) hiện chặn cả những yêu cầu có khả năng vô hại. Theo báo cáo từ các nhà nghiên cứu Amazon, bộ lọc cải tiến ngăn chặn kỹ thuật vượt rào trong hơn 99% trường hợp thử nghiệm.
Các yêu cầu bị chặn sẽ được định tuyến sang Opus 4.8 và người dùng nhận thông báo. Tuy nhiên, Anthropic thừa nhận bộ lọc mới đang gắn cờ nhầm nhiều tác vụ lập trình và debug hợp lệ hơn so với trước. Các thử nghiệm nội bộ cũng cho thấy Fable 5 không đặt ra rủi ro đặc thù — các model cạnh tranh như GPT-5.5 và Kimi K2.7 cũng xác định được các lỗ hổng tương tự.
Bộ phận nghiên cứu của Cục Thương mại Mỹ được cho là đã kiểm tra cả hai phiên bản bảo vệ và đánh giá chúng đạt mức độ an toàn vượt trội.
Tác động rộng hơn
Sự việc có ý nghĩa vượt ra ngoài một chu kỳ sản phẩm đơn lẻ. Việc tạm dừng Fable 5 đã khiến châu Âu tích cực tiếp cận Anthropic, trong khi các model AI của Trung Quốc tiếp tục thu hẹp khoảng cách với các phòng lab AI hàng đầu của Mỹ.
Hiện Anthropic đang phối hợp cùng Amazon, Microsoft và Google xây dựng khung phân loại mức độ nghiêm trọng của các kỹ thuật jailbreak. Tốc độ mà các bộ phân loại có thể giảm tỷ lệ nhận diện sai (false positive) sẽ là yếu tố then chốt quyết định liệu nhóm người dùng chuyên sâu có tiếp tục gắn bó với nền tảng hay không.
/ Bài viết liên quan
[Wintermute] Market Update 28 September 2026
Wintermute — Cập nhật thị trường. Bấm để đọc bản gốc trên wintermute.com.
[Wintermute] Market Update 21 September 2026
Wintermute — Cập nhật thị trường. Bấm để đọc bản gốc trên wintermute.com.
[Wintermute] Market Update 14 September 2026
Wintermute — Cập nhật thị trường. Bấm để đọc bản gốc trên wintermute.com.
[Wintermute] Market Update 7 September 2026
Wintermute — Cập nhật thị trường. Bấm để đọc bản gốc trên wintermute.com.