Trendora

Post-training

Assess

Kỹ thuật

Giai đoạn huấn luyện sau tiền huấn luyện nhằm cải thiện hiệu năng hoặc hành vi của mô hình.

Vì sao ở đây

Xếp vào Assess: 1 bài bằng chứng từ 1 nguồn, chủ yếu là phát hành mô hình, 0 bài trong 30 ngày qua. Độ tin cậy 24%. Bằng chứng còn ít nên xếp thận trọng, chờ thêm tín hiệu.

Bằng chứng (1)

  • 8Hugging Face Blog·20/1/2026model_release
    Một năm kể từ “khoảnh khắc DeepSeek”

    Hugging Face nhìn lại cách việc DeepSeek phát hành R1 vào tháng 1/2025 đã thúc đẩy mạnh mẽ hệ sinh thái AI nguồn mở của Trung Quốc. Bài viết cho rằng R1 đã hạ thấp rào cản kỹ thuật và triển khai nhờ công bố phương pháp suy luận dưới giấy phép MIT, qua đó khuyến khích tái sử dụng, tinh chỉnh và đưa vào sản xuất. Bài viết cũng nhận định sự kiện này đã làm thay đổi cuộc cạnh tranh giữa các mô hình mở trên toàn cầu và tăng nhu cầu đối với các lựa chọn mở có thể triển khai thương mại.