Llama 3.1
AssessNgôn ngữ & Framework
Họ mô hình ngôn ngữ lớn mã nguồn mở từ Meta.
Vì sao ở đây
Xếp vào Assess: 2 bài bằng chứng từ 1 nguồn, chủ yếu là hoạt động mã nguồn mở, 2 bài trong 30 ngày qua. Độ tin cậy 32%.
Bằng chứng (2)
- 8Hacker News·6/8/2026fundingAMD mua lại Taalas để phát triển chip suy luận AI tích hợp mô hình vào silicon
AMD đã mua lại startup Taalas tại Toronto, đơn vị thiết kế các chip chuyên biệt cho từng mô hình bằng cách khắc trọng số mô hình trực tiếp lên silicon để tăng tốc suy luận AI. Các thử nghiệm ban đầu với chip HC1 được cho là đạt 16.960 token mỗi giây, và AMD có thể tích hợp công nghệ này vào hệ thống AI quy mô rack cùng với GPU Instinct.
- 7Hacker News·23/7/2026open_sourcePetals cho phép chạy mô hình ngôn ngữ lớn tại nhà
Petals là một hệ thống suy luận và tinh chỉnh phân tán, cho phép người dùng chạy một phần mô hình ngôn ngữ lớn trên GPU phổ thông rồi chia sẻ phần còn lại qua mạng ngang hàng theo kiểu BitTorrent. Hệ thống hỗ trợ các mô hình như Llama 3.1, Mixtral, Falcon và BLOOM, đồng thời cung cấp trải nghiệm gần giống API nhưng vẫn cho phép tùy biến sâu ở mức mô hình.