Constitutional AI
AssessKỹ thuật
Phương pháp huấn luyện dùng các nguyên tắc định hướng để điều chỉnh hành vi và đầu ra của mô hình.
Vì sao ở đây
Xếp vào Assess: 2 bài bằng chứng từ 1 nguồn, chủ yếu là cập nhật framework, 0 bài trong 30 ngày qua. Độ tin cậy 38%.
Bằng chứng (2)
- 4Anthropic News·19/5/2026framework_updateAnthropic mở rộng đối thoại về AI biên
Anthropic cho biết hãng đã bắt đầu các phiên đối thoại với học giả, giáo sĩ, triết gia, nhà đạo đức học và nhiều nhóm khác để định hướng việc phát triển các hệ thống AI biên. Công ty kỳ vọng các cuộc trao đổi này sẽ góp phần định hình hiến chương của Claude, các giá trị huấn luyện và tiêu chí đánh giá, với trọng tâm là hình thành “tính cách” và triển khai có trách nhiệm.
- 7Anthropic News·22/1/2026framework_updateAnthropic công bố hiến pháp mới cho Claude
Anthropic đã công bố một hiến pháp mới cho Claude, tài liệu xác định các giá trị, hành vi và mục tiêu huấn luyện mà mô hình hướng tới. Công ty cho biết hiến pháp này hiện đóng vai trò trung tâm hơn trong quá trình huấn luyện và được phát hành theo giấy phép CC0 để bất kỳ ai cũng có thể tự do sử dụng.