Trendora

AI Safety Levels

Assess

Kỹ thuật

Hệ thống phân cấp an toàn dùng để xác định các biện pháp bảo vệ bắt buộc khi năng lực mô hình tăng lên.

Vì sao ở đây

Xếp vào Assess: 1 bài bằng chứng từ 1 nguồn, chủ yếu là cập nhật framework, 0 bài trong 30 ngày qua. Độ tin cậy 24%. Bằng chứng còn ít nên xếp thận trọng, chờ thêm tín hiệu.

Bằng chứng (1)

  • 7Anthropic News·24/2/2026framework_update
    Anthropic cập nhật Chính sách Phát triển Có Trách nhiệm lên phiên bản 3.0

    Anthropic đã công bố phiên bản 3.0 của Chính sách Phát triển Có Trách nhiệm (RSP), khuôn khổ tự nguyện mà hãng dùng để giảm thiểu các rủi ro thảm họa từ AI. Bản cập nhật nhằm củng cố những điểm hiệu quả trước đây, khắc phục các hạn chế của chính sách cũ và tăng tính minh bạch, trách nhiệm giải trình trong các quyết định phát triển mô hình.