NVIDIA Nemotron 3 Embed
TrialCông cụ
Bộ mô hình embedding mở và thương mại cho truy xuất chất lượng cao.
Vì sao ở đây
Xếp vào Trial: 8 bài bằng chứng từ 4 nguồn, chủ yếu là phát hành mô hình, 5 bài trong 30 ngày qua. Độ tin cậy 76%.
Bằng chứng (8)
- 8The New Stack·11/8/2026model_releaseNVIDIA ra mắt Nemotron 3.5 Lightning và NeMo Switchyard
NVIDIA mở rộng dòng mô hình Nemotron với Nemotron 3.5 Lightning, một mô hình mở theo kiến trúc mixture-of-experts 30 tỷ tham số, được tối ưu cho các tác vụ tác tử có tần suất cao. Hãng cũng phát hành NeMo Switchyard, thư viện định tuyến mã nguồn mở giúp chuyển yêu cầu đến mô hình phù hợp nhất trong các hệ thống mở, độc quyền và của NVIDIA mà không cần sửa lại ứng dụng.
- 6The New Stack·23/7/2026researchNvidia cho rằng mô hình cục bộ và mô hình biên sẽ phối hợp với nhau
Lãnh đạo Nvidia Joey Conway cho biết các tổ chức sẽ ngày càng kết hợp mô hình cục bộ/mở với mô hình biên, trong đó hệ thống định tuyến sẽ chọn mô hình phù hợp cho từng tác vụ. Ông nhấn mạnh lợi ích về kiểm soát dữ liệu, độ trễ thấp và chi phí thấp hơn khi triển khai các mô hình mở đã được tinh chỉnh ngay gần nơi dữ liệu tồn tại, đồng thời nêu các phần cứng và phần mềm của Nvidia phục vụ việc suy luận và điều phối khối lượng công việc này.
- 7NVIDIA GenAI·17/7/2026researchNVIDIA Vera Rubin hướng tới hiệu quả trí tuệ trên mỗi đô la tốt hơn cho huấn luyện AI tác tử
NVIDIA cho rằng hậu huấn luyện đã trở thành khối công việc trung tâm trong kỷ nguyên AI tác tử, khi mô hình liên tục thích nghi thông qua học tăng cường, dùng công cụ và khôi phục sau lỗi. Hãng nhấn mạnh các thư viện NeMo và mô hình mở Nemotron 3 Ultra như ví dụ về hạ tầng và thiết kế mô hình nhằm nâng cao hiệu quả trí tuệ trên mỗi đô la, đồng thời giảm chi phí trên mỗi token trong suy luận.
- 7Hacker News·16/7/2026model_releaseLiên minh Đức phát hành Soofi S, mô hình mở 30 tỷ tham số
Một liên minh nghiên cứu của Đức do KI Bundesverband điều phối đã phát hành Soofi S 30B-A3B, một mô hình ngôn ngữ mở được huấn luyện trên Industrial AI Cloud của Deutsche Telekom. Mô hình này dùng kiến trúc lai Mamba-Transformer kiểu mixture-of-experts và được báo cáo là vượt các mô hình mở hoàn toàn khác trên các benchmark tiếng Anh, tiếng Đức và lập trình, đồng thời duy trì thông lượng cao với ngữ cảnh dài.
- 8Hugging Face Blog·16/7/2026model_releaseNVIDIA Nemotron 3 Embed đứng đầu RTEB
NVIDIA ra mắt Nemotron 3 Embed, bộ mô hình embedding mở nhằm nâng cao chất lượng truy xuất cho RAG doanh nghiệp, quy trình tác nhân, truy xuất mã và bộ nhớ tác nhân. Bản 8B BF16 đứng số 1 trên bảng xếp hạng RTEB, trong khi các biến thể 1B hướng tới triển khai उत्पादन với chi phí thấp hơn và thông lượng cao hơn.
- 8NVIDIA GenAI·21/5/2026model_releaseNVIDIA ra mắt Nemotron 3 Ultra cho các tác tử AI chạy dài
Tại NVIDIA GTC Taipei ở COMPUTEX, NVIDIA công bố Nemotron 3 Ultra, một mô hình mở 550 tỷ tham số theo kiến trúc mixture-of-experts, được thiết kế cho các tác tử AI chạy dài. NVIDIA cho biết mô hình này có thể suy luận nhanh hơn tới 5 lần và giảm chi phí cho các tác vụ tác tử phức tạp tới 30%, với các đơn vị sử dụng sớm gồm Perplexity, Palantir và ServiceNow.
- 8Hugging Face Blog·28/4/2026model_releaseNVIDIA ra mắt Nemotron 3 Nano Omni cho AI đa phương thức ngữ cảnh dài
NVIDIA giới thiệu Nemotron 3 Nano Omni, một mô hình đa phương thức toàn diện cho phân tích tài liệu, nhận dạng giọng nói, hiểu video-âm thanh dài và tác vụ sử dụng máy tính theo tác nhân. Mô hình cho thấy kết quả nổi bật trên các benchmark về tài liệu, video, âm thanh và thoại, đồng thời đạt thông lượng và hiệu quả cao hơn so với các mô hình đa phương thức mở tương đương.
- 7Hugging Face Blog·5/1/2026product_launchNVIDIA trình diễn tác nhân AI với DGX Spark và Reachy Mini
Tại CES 2026, NVIDIA đã trình diễn một tác nhân AI chạy cục bộ trên DGX Spark và tương tác thông qua robot Reachy Mini. Bài viết trên Hugging Face hướng dẫn cách tái tạo hệ thống này bằng các mô hình mở của NVIDIA, bộ công cụ agent và các lựa chọn triển khai cục bộ, trên đám mây hoặc serverless.