Trendora

AI safety

Assess

Kỹ thuật

Lĩnh vực tập trung vào việc giảm thiểu rủi ro và hành vi có hại từ các hệ thống AI.

Vì sao ở đây

Xếp vào Assess: 4 bài bằng chứng từ 1 nguồn, chủ yếu là tin gọi vốn, 0 bài trong 30 ngày qua. Độ tin cậy 45%.

Bằng chứng (4)

  • 5OpenAI Blog·23/6/2026framework_update
    OpenAI ủng hộ các tiêu chuẩn chung cho AI tiên tiến

    OpenAI cho biết họ đang góp phần xây dựng các tiêu chuẩn chung cho AI tiên tiến, bao gồm khung đánh giá và các thực hành an toàn. Sáng kiến này được hỗ trợ thông qua Appia Foundation và nhằm thúc đẩy hợp tác toàn cầu về phát triển AI có trách nhiệm.

  • 5OpenAI Blog·6/4/2026funding
    OpenAI ra mắt chương trình thử nghiệm Safety Fellowship

    OpenAI công bố chương trình thử nghiệm Safety Fellowship nhằm hỗ trợ nghiên cứu độc lập về an toàn và căn chỉnh AI. Chương trình cũng hướng tới việc phát triển thế hệ nhân tài tiếp theo trong lĩnh vực an toàn AI.

  • 7OpenAI Blog·19/3/2026research
    OpenAI giám sát các tác tử lập trình nội bộ để phát hiện lệch hướng

    OpenAI cho biết họ sử dụng giám sát chuỗi suy nghĩ để nghiên cứu hiện tượng lệch hướng trong các tác tử lập trình nội bộ. Cách tiếp cận này phân tích hành vi thực tế của tác tử để phát hiện rủi ro và tăng cường các biện pháp an toàn AI.

  • 7OpenAI Blog·19/2/2026funding
    OpenAI tài trợ nghiên cứu độc lập về căn chỉnh AI

    OpenAI cam kết tài trợ 7,5 triệu USD cho The Alignment Project nhằm hỗ trợ nghiên cứu độc lập về căn chỉnh AI. Khoản tài trợ này hướng tới việc tăng cường các nỗ lực toàn cầu về an toàn và an ninh trước rủi ro từ AGI.