Hook
Ngày 15 tháng 6 năm 2025, Anthropic chính thức công bố báo cáo rủi ro thứ hai trong khuôn khổ Chính sách Mở rộng Có trách nhiệm (RSP). Đây không chỉ là một tài liệu kỹ thuật nội bộ, mà là một tín hiệu vĩ mô cho toàn bộ hệ sinh thái công nghệ – bao gồm cả blockchain và tiền điện tử. Khi tôi đọc báo cáo này, mô hình của tôi ngay lập tức kích hoạt một cảnh báo: sự dịch chuyển từ “cạnh tranh năng lực” sang “cạnh tranh niềm tin” đang diễn ra nhanh hơn dự kiến. Đối với các nhà đầu tư crypto, đây là thời điểm để đánh giá lại mối tương quan giữa rủi ro AI và dòng vốn đầu cơ.
Context
Anthropic – công ty đứng sau mô hình Claude – đã phát hành RSP lần đầu vào tháng 5 năm 2023, trở thành tổ chức tiên phong trong việc xây dựng khung quản trị an toàn AI có hệ thống. Báo cáo thứ hai này xác nhận rằng khung RSP đã chuyển từ một tuyên bố chính sách tĩnh thành một cơ chế đánh giá động, liên tục. Trọng tâm của báo cáo là đánh giá các mô hình Claude 3/3.5 trên các chiều năng lực nguy hiểm như CBRN (hóa học, sinh học, phóng xạ, hạt nhân), tấn công mạng, tự sao chép và tự cải thiện – tất cả đều là các ngưỡng của ASL-3 (AI Safety Level 3).
Trong bối cảnh thị trường crypto đang suy giảm, báo cáo này mang một ý nghĩa kép. Một mặt, nó củng cố niềm tin vào các dự án AI phi tập trung (DeAI) – những nền tảng hứa hẹn kiểm soát minh bạch hơn. Mặt khác, nó phơi bày một thực tế khó chịu: các tổ chức truyền thống không cần public chain của bạn để xây dựng hệ thống an toàn AI. Họ có thể tự làm, với nguồn lực và uy tín vượt trội.
Core
Báo cáo RSP thứ hai không chỉ là một tài liệu an toàn; nó là một công cụ định vị thị trường. Hãy nhìn vào cấu trúc của nó: Anthropic đã mượn mô hình BSL (Biosafety Level) từ ngành sinh học, ánh xạ năng lực mô hình thành bốn cấp độ an toàn. Điều này tạo ra một ngôn ngữ chung cho các nhà đầu tư tổ chức – những người đang tìm kiếm các tiêu chí rõ ràng để đánh giá rủi ro khi đầu tư vào AI.
Mô hình của tôi nói rằng sự khác biệt chính giữa báo cáo này và các tuyên bố trước đây là tính liên tục. Anthropic không chỉ dừng lại ở việc công bố khung, họ đang vận hành nó. Điều này có ý nghĩa trực tiếp đến thị trường crypto: các token AI như Render Network (RNDR), Bittensor (TAO) hay Fetch.ai (FET) sẽ phải đối mặt với một tiêu chuẩn so sánh mới. Các quỹ đầu tư mạo hiểm, vốn đã đổ hàng tỷ USD vào AI, sẽ bắt đầu yêu cầu các dự án phi tập trung phải chứng minh khả năng quản lý rủi ro tương đương.
Mô hình của tôi nói rằng báo cáo này tiết lộ một sự thật ẩn: Anthropic đang thực hiện nghiên cứu ASL-4 – cấp độ rủi ro cực đoan gần AGI. Mặc dù con số cụ thể không được công bố, nhưng việc nhắc đến ASL-4 trong bối cảnh thảo luận ASL-3 cho thấy họ đã có những đánh giá nội bộ về khoảng cách giữa các mô hình hiện tại và ngưỡng nguy hiểm tuyệt đối. Đối với các nhà đầu tư crypto, tín hiệu này rất quan trọng: nếu các mô hình tiên tiến nhất đang tiến gần đến ngưỡng không thể kiểm soát, thì giá trị của các giải pháp AI phi tập trung (vốn được cho là minh bạch và dễ kiểm soát hơn) sẽ tăng vọt.

Tuy nhiên, có một điểm mù lớn: phương pháp đánh giá của RSP hoàn toàn dựa trên tự đánh giá nội bộ. Anthropic vừa là người thiết kế bài kiểm tra, vừa là người chấm điểm. Mô hình của tôi nói rằng điều này tạo ra một xung đột lợi ích cố hữu. Nếu một mô hình bị đánh giá là ASL-3, nó sẽ phải chịu các hạn chế triển khai nghiêm ngặt – điều này ảnh hưởng trực tiếp đến doanh thu. Vì vậy, có một động cơ để giữ ngưỡng đánh giá đủ cao nhằm tránh kích hoạt các hạn chế này. Đây là lý do tại sao các nhà đầu tư crypto cần đặt câu hỏi: liệu các dự án DeAI có thể cung cấp một cơ chế kiểm toán độc lập mà Anthropic không thể?
Contrarian
Hầu hết các bài phân tích đều ca ngợi RSP như một bước tiến vĩ đại. Nhưng tôi nhìn thấy một góc khuất: RSP đang tạo ra một tiêu chuẩn kép. Trong khi Anthropic khẳng định an toàn là ưu tiên hàng đầu, họ vẫn tiếp tục cung cấp API Claude cho các doanh nghiệp – miễn là các doanh nghiệp đó đáp ứng các yêu cầu KYC và kiểm soát truy cập. Điều này có nghĩa là RSP không phải là một cơ chế cấm đoán, mà là một cơ chế phân khúc thị trường. Các doanh nghiệp lớn, có khả năng đáp ứng yêu cầu, sẽ tiếp tục được phục vụ; các nhà phát triển nhỏ lẻ và cộng đồng mã nguồn mở sẽ bị loại khỏi vòng tròn.
Đối với crypto, điều này là một hồi chuông cảnh tỉnh. Các dự án AI phi tập trung thường quảng bá khả năng “mở” và “không cần cấp phép”. Nhưng nếu các mô hình AI mạnh nhất chỉ có thể được truy cập thông qua các cổng kiểm soát tập trung, thì lời hứa về một AI mở, dân chủ sẽ trở nên hão huyền. Mô hình của tôi nói rằng RSP thực chất đang củng cố xu hướng “đóng gói” các mô hình nguy hiểm – một động thái mà các tổ chức tài chính truyền thống sẽ hoan nghênh, nhưng lại đi ngược lại tinh thần của blockchain.
Một điểm mù khác: RSP chỉ tập trung vào các rủi ro thảm họa (CBRN, tấn công mạng, tự sao chép) mà bỏ qua các rủi ro xã hội hàng ngày như thiên vị, phân biệt đối xử, xâm phạm quyền riêng tư. Đây là một lỗ hổng chiến lược. Nếu Claude bị phát hiện có hành vi thiên vị nghiêm trọng hoặc rò rỉ dữ liệu, toàn bộ câu chuyện “an toàn” của Anthropic sẽ sụp đổ. Đối với các nhà đầu tư crypto, điều này có nghĩa là việc định giá các token AI cần phải tính đến một yếu tố rủi ro mà chưa ai lượng hóa được: rủi ro danh tiếng từ các sự cố AI thông thường.
Takeaway
Báo cáo RSP thứ hai là một tín hiệu vĩ mô quan trọng, nhưng không phải là một sự kiện định giá tức thì. Nó thiết lập một khuôn khổ mới cho cuộc chơi: nơi mà an toàn AI trở thành một tài sản có thể định lượng, và nơi mà các dự án phi tập trung phải chứng minh rằng họ có thể làm tốt hơn các tổ chức tập trung trong việc quản lý rủi ro. Câu hỏi đặt ra cho các nhà đầu tư crypto: liệu các token AI có đang được định giá dựa trên kỳ vọng về một tương lai mở, hay đang bị chiết khấu vì sự thiếu minh bạch hiện tại? Mô hình của tôi nói rằng câu trả lời sẽ phụ thuộc vào khả năng của các dự án DeAI trong việc xây dựng các cơ chế kiểm toán độc lập, minh bạch và có thể tương tác với các tiêu chuẩn như RSP. Nếu không, họ sẽ mãi mãi ở trong bóng tối của các gã khổng lồ công nghệ.