automated classifiers
AssessKỹ thuật
Các mô hình phát hiện dùng để gắn cờ nội dung hoặc hành vi có nguy cơ vi phạm chính sách.
Vì sao ở đây
Xếp vào Assess: 1 bài bằng chứng từ 1 nguồn, chủ yếu là cập nhật framework, 0 bài trong 30 ngày qua. Độ tin cậy 24%. Bằng chứng còn ít nên xếp thận trọng, chờ thêm tín hiệu.
Bằng chứng (1)
- 6Anthropic News·24/4/2026framework_updateAnthropic cập nhật các biện pháp bảo vệ bầu cử cho Claude
Anthropic cho biết đang tăng cường các biện pháp bảo vệ liên quan đến bầu cử cho Claude trước cuộc bầu cử giữa nhiệm kỳ tại Mỹ và các kỳ bầu cử lớn khác trong năm 2026. Công ty nêu bật các đánh giá về thiên lệch, thực thi chính sách, phát hiện tự động và các bài kiểm tra cho thấy mức tuân thủ cao với các quy tắc an toàn liên quan đến bầu cử.