Trendora

self-play

Hold

Kỹ thuật

Phương pháp huấn luyện và đánh giá trong đó hệ thống cải thiện bằng cách tự đối đầu với chính nó.

Vì sao ở đây

Xếp vào Hold: 1 bài bằng chứng từ 2 nguồn, chủ yếu là tin nghiên cứu, 1 bài trong 30 ngày qua. Độ tin cậy 32%.

Bằng chứng (1)

  • 7OpenAI Blog·15/7/2026research
    GPT-Red: Kiểm thử đối kháng tự động để tăng độ an toàn cho AI

    OpenAI giới thiệu GPT-Red, một hệ thống kiểm thử đối kháng tự động sử dụng cơ chế tự chơi để phát hiện điểm yếu trong các hệ thống AI. Cách tiếp cận này nhằm tăng khả năng chống prompt injection đồng thời hỗ trợ các nỗ lực an toàn và căn chỉnh AI.