Trendora

monitorability

Hold

Kỹ thuật

Khả năng quan sát và kiểm tra hành vi mô hình nhằm phục vụ an toàn và giám sát.

Vì sao ở đây

Xếp vào Hold: 1 bài bằng chứng từ 1 nguồn, chủ yếu là tin nghiên cứu, 0 bài trong 30 ngày qua. Độ tin cậy 24%. Bằng chứng còn ít nên xếp thận trọng, chờ thêm tín hiệu.

Bằng chứng (1)

  • 7OpenAI Blog·5/3/2026research
    OpenAI cho biết mô hình suy luận khó kiểm soát chuỗi tư duy

    OpenAI giới thiệu CoT-Control và cho biết các mô hình suy luận gặp khó khăn trong việc kiểm soát ổn định chuỗi tư duy của mình. Công ty xem hạn chế này là một tín hiệu hữu ích cho an toàn AI, vì khả năng giám sát có thể giúp phát hiện các diễn giải nội bộ đáng lo ngại.