CUDA
TrialNgôn ngữ & Framework
Nền tảng và mô hình lập trình song song cho GPU của NVIDIA.
Vì sao ở đây
Xếp vào Trial: 9 bài bằng chứng từ 4 nguồn, chủ yếu là hoạt động mã nguồn mở, 3 bài trong 30 ngày qua. Độ tin cậy 77%.
Bằng chứng (9)
- 8The New Stack·10/8/2026breakthroughEKS rút ngắn thời gian kéo image container dung lượng lớn
Bài viết cho biết các image container phục vụ suy luận ML dung lượng lớn trên Amazon EKS từng mất vài phút để kéo về, làm chậm việc sẵn sàng của pod và khiến GPU nhàn rỗi. Bằng cách thiết kế lại quy trình pull để tận dụng tốt hơn băng thông mạng, thông lượng lưu trữ và năng lực tính toán sẵn có, nhóm đã rút thời gian kéo image nhiều GB xuống còn vài giây; các cải tiến này hiện có mặc định trong EKS Auto Mode và đã được đóng góp ngược dòng cho containerd và SOCI snapshotter.
- 8NVIDIA GenAI·22/7/2026open_sourceNVIDIA mở mã nguồn framework mô phỏng vật lý y khoa tăng tốc bằng GPU
NVIDIA đã mở mã nguồn Medical Physics Simulation, một framework tăng tốc bằng GPU trong Isaac for Healthcare để mô phỏng tương tác giữa giải phẫu và thiết bị, dữ liệu cảm biến và các tình huống biên khó thu thập. Công cụ này giúp các nhóm robot y tế huấn luyện, kiểm thử và đánh giá chính sách trong môi trường mô phỏng trước khi chuyển sang giai đoạn thử nghiệm tốn nhiều phần cứng.
- 7Hacker News·14/7/2026product_launchSpectral Compute hướng tới lộ trình thay thế CUDA cho phần cứng không phải NVIDIA
Bài viết đề cập đến nỗ lực của Spectral Compute nhằm đưa lập trình GPU kiểu CUDA lên phần cứng không phải NVIDIA, qua đó có thể giảm phụ thuộc vào hệ sinh thái phần mềm của NVIDIA. Phần thảo luận trên Hacker News cho thấy sự quan tâm liệu có thể xuất hiện một lựa chọn thay thế đủ tin cậy cho nhà phát triển và người dùng HPC muốn tương thích phần cứng rộng hơn hay không.
- 7Hacker News·30/6/2026open_sourceZLUDA 6 bổ sung PhysX, hỗ trợ texture cho Blender và cải thiện tương thích Windows
ZLUDA đã phát hành phiên bản 6, một bản cập nhật lớn cho dự án cho phép các ứng dụng CUDA chạy nguyên bản trên GPU không phải NVIDIA. Bản phát hành này bổ sung hỗ trợ PhysX 32-bit ở mức pre-alpha, hỗ trợ texture cơ bản giúp Blender hoạt động, cùng với cải thiện khả năng xử lý trên Windows cho các thư viện hiệu năng và bộ nạp.
- 4Hacker News·29/6/2026researchGiải thích chi tiết điều gì xảy ra khi một CUDA kernel được chạy
Bài viết lần theo một chương trình cộng vector CUDA đơn giản từ mã nguồn đến biên dịch và thực thi trên GPU, giải thích vai trò của nvcc, PTX và SASS trong toàn bộ quy trình. Bài cũng mô tả các chi tiết vận hành cấp thấp như warp, truy cập bộ nhớ thiết bị và cơ chế khởi chạy cũng như hoàn tất kernel trên RTX 4090.
- 8NVIDIA GenAI·2/6/2026product_launchNVIDIA bổ sung hỗ trợ AI tác tử cho nền tảng Jetson edge
Tại COMPUTEX, NVIDIA công bố JetPack 7.2 và hỗ trợ NemoClaw cho Jetson, đưa năng lực AI tác tử lên các thiết bị biên. Bản cập nhật bổ sung hỗ trợ Yocto, CUDA 13 trên Jetson Orin, MIG trên Jetson Thor và cải thiện hiệu năng cho Jetson AGX Orin 32GB, đồng thời cho phép triển khai các quy trình AI tác tử cho robot, kiểm tra và tự động hóa công nghiệp.
- 4Hugging Face Blog·29/5/2026framework_updateHướng dẫn nhập môn torch.profiler trong PyTorch
Hugging Face Blog giới thiệu phần đầu của loạt bài về profiling trong PyTorch, nhằm giúp người mới học cách đọc trace của profiler và hiểu mối liên hệ giữa lời gọi Python với hoạt động trên CPU và CUDA. Bài viết hướng dẫn cách dùng torch.profiler, đọc bảng và trace, đồng thời quan sát những thay đổi khi áp dụng torch.compile.
- 7Hugging Face Blog·13/2/2026open_sourceClaude và Codex có thêm kỹ năng viết CUDA kernel
Hugging Face giới thiệu một agent skill giúp các tác nhân lập trình viết CUDA kernel cho môi trường sản xuất và tích hợp với các dự án dựa trên PyTorch. Bài viết cho biết Claude và Codex đã được dùng để tạo kernel hoạt động cho một pipeline diffusers và một mô hình transformers, bao gồm cả binding và benchmark hoàn chỉnh.
- 6Hugging Face Blog·28/1/2026researchHugging Face trình bày cách Claude dạy mô hình nhỏ viết kernel CUDA
Hugging Face mô tả quy trình dùng Claude Opus 4.5 và công cụ mới tên upskill để chuyển một trace của agent thành kỹ năng tái sử dụng cho các tác vụ chuyên biệt như viết CUDA kernel. Bài viết cho rằng cách này có thể chuyển tri thức chuyên sâu từ mô hình mạnh sang mô hình nhỏ hoặc rẻ hơn, đồng thời đo lường liệu kỹ năng đó có thực sự cải thiện hiệu năng hay không.