AI Safety Levels
AssessKỹ thuật
Hệ thống phân cấp an toàn dùng để xác định các biện pháp bảo vệ bắt buộc khi năng lực mô hình tăng lên.
Vì sao ở đây
Xếp vào Assess: 1 bài bằng chứng từ 1 nguồn, chủ yếu là cập nhật framework, 0 bài trong 30 ngày qua. Độ tin cậy 24%. Bằng chứng còn ít nên xếp thận trọng, chờ thêm tín hiệu.
Bằng chứng (1)
- 7Anthropic News·24/2/2026framework_updateAnthropic cập nhật Chính sách Phát triển Có Trách nhiệm lên phiên bản 3.0
Anthropic đã công bố phiên bản 3.0 của Chính sách Phát triển Có Trách nhiệm (RSP), khuôn khổ tự nguyện mà hãng dùng để giảm thiểu các rủi ro thảm họa từ AI. Bản cập nhật nhằm củng cố những điểm hiệu quả trước đây, khắc phục các hạn chế của chính sách cũ và tăng tính minh bạch, trách nhiệm giải trình trong các quyết định phát triển mô hình.