model safeguards
AssessKỹ thuật
Các cơ chế an toàn nhằm giảm hành vi nguy hại hoặc ngoài ý muốn của mô hình.
Vì sao ở đây
Xếp vào Assess: 1 bài bằng chứng từ 1 nguồn, chủ yếu là cập nhật framework, 0 bài trong 30 ngày qua. Độ tin cậy 24%. Bằng chứng còn ít nên xếp thận trọng, chờ thêm tín hiệu.
Bằng chứng (1)
- 3OpenAI Blog·28/4/2026framework_updateOpenAI công bố các biện pháp bảo đảm an toàn cho ChatGPT
OpenAI cho biết họ bảo vệ an toàn cộng đồng trong ChatGPT bằng các cơ chế an toàn của mô hình, phát hiện hành vi lạm dụng và thực thi chính sách. Công ty cũng nhấn mạnh việc phối hợp với các chuyên gia an toàn như một phần trong cách tiếp cận an toàn tổng thể.