AI safety
AssessKỹ thuật
Lĩnh vực tập trung vào việc giảm thiểu rủi ro và hành vi có hại từ các hệ thống AI.
Vì sao ở đây
Xếp vào Assess: 4 bài bằng chứng từ 1 nguồn, chủ yếu là tin gọi vốn, 0 bài trong 30 ngày qua. Độ tin cậy 45%.
Bằng chứng (4)
- 5OpenAI Blog·23/6/2026framework_updateOpenAI ủng hộ các tiêu chuẩn chung cho AI tiên tiến
OpenAI cho biết họ đang góp phần xây dựng các tiêu chuẩn chung cho AI tiên tiến, bao gồm khung đánh giá và các thực hành an toàn. Sáng kiến này được hỗ trợ thông qua Appia Foundation và nhằm thúc đẩy hợp tác toàn cầu về phát triển AI có trách nhiệm.
- 5OpenAI Blog·6/4/2026fundingOpenAI ra mắt chương trình thử nghiệm Safety Fellowship
OpenAI công bố chương trình thử nghiệm Safety Fellowship nhằm hỗ trợ nghiên cứu độc lập về an toàn và căn chỉnh AI. Chương trình cũng hướng tới việc phát triển thế hệ nhân tài tiếp theo trong lĩnh vực an toàn AI.
- 7OpenAI Blog·19/3/2026researchOpenAI giám sát các tác tử lập trình nội bộ để phát hiện lệch hướng
OpenAI cho biết họ sử dụng giám sát chuỗi suy nghĩ để nghiên cứu hiện tượng lệch hướng trong các tác tử lập trình nội bộ. Cách tiếp cận này phân tích hành vi thực tế của tác tử để phát hiện rủi ro và tăng cường các biện pháp an toàn AI.
- 7OpenAI Blog·19/2/2026fundingOpenAI tài trợ nghiên cứu độc lập về căn chỉnh AI
OpenAI cam kết tài trợ 7,5 triệu USD cho The Alignment Project nhằm hỗ trợ nghiên cứu độc lập về căn chỉnh AI. Khoản tài trợ này hướng tới việc tăng cường các nỗ lực toàn cầu về an toàn và an ninh trước rủi ro từ AGI.