Trendora

LifeSciBench

Hold

Công cụ

Một bộ benchmark do chuyên gia xây dựng để đánh giá AI trong các nhiệm vụ nghiên cứu khoa học sự sống.

Vì sao ở đây

Xếp vào Hold: 1 bài bằng chứng từ 1 nguồn, chủ yếu là tin nghiên cứu, 0 bài trong 30 ngày qua. Độ tin cậy 24%. Bằng chứng còn ít nên xếp thận trọng, chờ thêm tín hiệu.

Bằng chứng (1)

  • 6OpenAI Blog·17/6/2026research
    OpenAI giới thiệu LifeSciBench

    OpenAI đã giới thiệu LifeSciBench, một bộ benchmark do chuyên gia biên soạn và phản biện để đánh giá cách các hệ thống AI xử lý các nhiệm vụ và quyết định nghiên cứu khoa học sự sống trong thực tế. Bộ benchmark này nhằm đo lường mức độ hữu ích của mô hình trong quy trình khoa học thực tiễn, thay vì chỉ dựa trên điểm số trừu tượng.