Trendora

Mamba

Assess

Kỹ thuật

Một hướng mô hình trạng thái được thiết kế để xử lý chuỗi rất dài hiệu quả.

Vì sao ở đây

Xếp vào Assess: 4 bài bằng chứng từ 4 nguồn, chủ yếu là phát hành mô hình, 2 bài trong 30 ngày qua. Độ tin cậy 68%.

Bằng chứng (4)

  • 8Simon Willison·27/7/2026model_release
    Moonshot công bố trọng số mở của Kimi K3, nhưng việc triển khai bị giới hạn

    Moonshot AI đã phát hành trọng số mở của Kimi K3 trên Hugging Face, đưa một trong những mô hình ngôn ngữ lớn nhất của hãng đến tay cộng đồng để tự triển khai. Mô hình hướng tới tác vụ lập trình dài hạn và xử lý tri thức đầu-cuối, nhưng kiến trúc MoE 2,8 nghìn tỷ tham số cùng yêu cầu phần cứng rất lớn khiến chỉ một số ít tổ chức có thể tự vận hành.

  • 7Hacker News·16/7/2026model_release
    Liên minh Đức phát hành Soofi S, mô hình mở 30 tỷ tham số

    Một liên minh nghiên cứu của Đức do KI Bundesverband điều phối đã phát hành Soofi S 30B-A3B, một mô hình ngôn ngữ mở được huấn luyện trên Industrial AI Cloud của Deutsche Telekom. Mô hình này dùng kiến trúc lai Mamba-Transformer kiểu mixture-of-experts và được báo cáo là vượt các mô hình mở hoàn toàn khác trên các benchmark tiếng Anh, tiếng Đức và lập trình, đồng thời duy trì thông lượng cao với ngữ cảnh dài.

  • 8Hugging Face Blog·28/4/2026model_release
    NVIDIA ra mắt Nemotron 3 Nano Omni cho AI đa phương thức ngữ cảnh dài

    NVIDIA giới thiệu Nemotron 3 Nano Omni, một mô hình đa phương thức toàn diện cho phân tích tài liệu, nhận dạng giọng nói, hiểu video-âm thanh dài và tác vụ sử dụng máy tính theo tác nhân. Mô hình cho thấy kết quả nổi bật trên các benchmark về tài liệu, video, âm thanh và thoại, đồng thời đạt thông lượng và hiệu quả cao hơn so với các mô hình đa phương thức mở tương đương.

  • 8Hugging Face Blog·5/1/2026model_release
    Hugging Face ra mắt Falcon-H1-Arabic

    Hugging Face công bố Falcon-H1-Arabic, một họ mô hình ngôn ngữ tiếng Ả Rập mới được xây dựng trên kiến trúc lai Mamba-Transformer. Bộ mô hình gồm các phiên bản 3B, 7B và 34B với ngữ cảnh mở rộng մինչև 256K token, hướng tới cải thiện khả năng hiểu ngữ cảnh dài, xử lý phương ngữ và suy luận trong NLP tiếng Ả Rập.