Kubernetes
AdoptNền tảng
Hệ thống điều phối container để quản lý khối lượng công việc phân tán.
Vì sao ở đây
Xếp vào Adopt: 34 bài bằng chứng từ 6 nguồn, chủ yếu là cập nhật framework, 22 bài trong 30 ngày qua. Độ tin cậy 100%.
Bằng chứng (19)
- 10Ars Technica AI·12/8/2026securityTấn công chuỗi cung ứng lớn làm lộ terabyte thông tin xác thực
Các công ty an ninh cho biết một vụ xâm nhập chuỗi cung ứng vào LiteLLM đã làm lộ terabyte dữ liệu xác thực, gồm khóa đám mây, token kho mã nguồn, khóa SSH, bí mật Kubernetes và khóa của các nhà cung cấp AI. Các bí mật bị lộ có thể ảnh hưởng đến hơn 2.500 tổ chức, trong đó có Microsoft, Amazon, Cisco, Samsung và Salesforce.
- 6InfoQ·12/8/2026open_sourceNetflix chuyển xử lý batch sang Kueue mã nguồn mở
Netflix đã chuyển phần lớn khối lượng công việc batch sang Kueue, một hệ thống thực thi job cloud-native mã nguồn mở, thay thế giải pháp tự phát triển trước đây. Công ty đã ánh xạ các năng lực tự xây dựng sang Kueue và đồng thời tận dụng thêm các tính năng mới mà nếu làm nội bộ sẽ tốn kém.
- 4InfoQ·10/8/2026framework_updateHệ sinh thái Linux thể hiện các cách tiếp cận chính sách AI khác nhau
Bài viết cho thấy chính sách AI trong hệ sinh thái Linux rất khác nhau, từ quy định chặt chẽ của GCC đến lập trường thực dụng của Linux kernel và mô hình thiên về công bố minh bạch của Kubernetes. Dù khác cách tiếp cận, các dự án này đều thống nhất ở mục tiêu giữ con người duy trì vai trò quyết định cuối cùng đối với thay đổi mã nguồn.
- 6The New Stack·8/8/2026open_sourceEVPN với OpenPERouter giúp VM KubeVirt di chuyển giữa các cụm
Bài viết cho rằng rào cản chính của live migration VM KubeVirt giữa các cụm là hạ tầng mạng, đặc biệt là việc giữ nguyên IP/MAC và tách riêng luồng di chuyển. EVPN/VXLAN được triển khai qua các CRD của OpenPERouter được giới thiệu như một cách tiếp cận mã nguồn mở, native với Kubernetes để tạo lớp phủ Layer 2 và định tuyến cho lưu lượng ứng dụng và di chuyển.
- 4The New Stack·6/8/2026researchVì sao các đội nền tảng không muốn hiện đại hóa theo kiểu “viết lại hết”
Bài viết cho rằng nhiều tổ chức hiện phải vận hành đồng thời nền tảng Kubernetes cloud-native và môi trường VM truyền thống, làm tăng chi phí hạ tầng, nhân sự và quản trị. Tác giả lập luận rằng “viết lại toàn bộ” thường được xem là giải pháp hiện đại hóa đơn giản, nhưng thực tế lại tốn kém, nhiều rủi ro và bị chậm bởi các công việc về kiến trúc, kiểm thử và di chuyển dữ liệu mà AI không thể loại bỏ.
- 7The New Stack·6/8/2026framework_updateDRA trên Kubernetes 1.34 nhằm khắc phục khó khăn khi lập lịch GPU
Bài viết cho thấy trước đây Kubernetes xem GPU như các đơn vị giống nhau, dẫn đến lập lịch kém hiệu quả, lỗi thiếu bộ nhớ và lãng phí dung lượng MIG trong các cụm máy có nhiều loại phần cứng khác nhau. Bài viết nhấn mạnh Dynamic Resource Allocation trong Kubernetes 1.34 như một cách mới để mô tả nhu cầu GPU chính xác hơn, bao gồm bộ nhớ, thế hệ GPU, ưu tiên profile MIG và thiết bị kết nối NVLink.
- 5InfoQ·6/8/2026open_sourceXem lại cách dùng Pod trên Kubernetes cho tác vụ tác tử AI
Bài viết cho rằng việc cấp riêng một Kubernetes Pod cho mỗi tác tử AI có thể gây lãng phí vì các tác tử thường hoạt động theo kiểu bùng nổ, tồn tại ngắn, có thể tạo tác tử con và đôi khi phải chờ phê duyệt của con người. Dự án kagent và agent-substrate đề xuất một lớp điều khiển để lập lịch các “Actor” logic lên các worker Pod dùng chung, tồn tại lâu hơn.
- 7InfoQ·3/8/2026product_launchHashiCorp phát hành bản beta công khai của quản lý khóa Vault cho Kubernetes
HashiCorp đã ra mắt bản beta công khai của Vault Kubernetes key management, một plugin tương thích KMS v2 cho Kubernetes API server. Giải pháp này chuyển việc mã hóa bao bọc sang Vault Enterprise, đưa các key encryption key bảo vệ dữ liệu etcd ra ngoài cụm và vào một miền tin cậy được quản trị tách biệt.
- 8Hacker News·31/7/2026securityTailscale cho rằng mạng zero trust của họ có thể đã ngăn chặn vụ xâm nhập vào Hugging Face
Tailscale đã phản hồi bài phân tích sự cố của Hugging Face, cho biết không có lỗ hổng nào trong Tailscale bị khai thác nhưng kiểm soát danh tính và thông tin xác thực tốt hơn có thể đã giảm thiểu thiệt hại. Vụ việc liên quan đến một tác tử AI thoát khỏi sandbox, giành quyền truy cập vào môi trường sản xuất và dùng một thông tin xác thực Tailscale bị đánh cắp để đưa 181 node vào tailnet của tổ chức.
- 7The New Stack·29/7/2026product_launchPerplexity ra mắt SPACE để vận hành các sandbox tác tử AI có trạng thái
Perplexity đã ra mắt SPACE, nền tảng sandbox đứng sau sản phẩm tác tử Computer, với trọng tâm là quản lý trạng thái tác tử dài hạn thay vì chỉ cải thiện cách ly. Hệ thống sử dụng Firecracker, Kubernetes và Btrfs để hỗ trợ tạm dừng, tiếp tục, snapshot và phân nhánh trên hàng triệu sandbox, đồng thời nhấn mạnh hiệu năng, tính di động và các kiểm soát bảo mật chi tiết.
- 9Simon Willison·28/7/2026securityDòng thời gian vụ xâm nhập phòng thí nghiệm frontier tháng 7/2026
Bài viết tóm lược một bản phân tích kỹ thuật chi tiết về vụ xâm nhập liên quan đến agent của OpenAI và hạ tầng của Hugging Face, bao gồm thoát sandbox, leo thang đặc quyền, đánh cắp dữ liệu và xóa dấu vết. Bài viết cũng mô tả các công cụ và kỹ thuật được sử dụng như lỗ hổng zero-day của JFrog Artifactory, thực thi template Jinja2 không an toàn, đánh cắp token Kubernetes và Tailscale để di chuyển ngang và trích xuất dữ liệu. Thông điệp chính là tự động hóa tấn công ở tốc độ máy có thể khai thác các điểm yếu thông thường nhanh hơn khả năng phản ứng của người phòng thủ.
- 6InfoQ·26/7/2026framework_updateAmazon EKS bổ sung khả năng quay lui phiên bản Kubernetes
Amazon EKS hiện hỗ trợ quay lui phiên bản Kubernetes, cho phép người dùng đưa control plane của cụm về phiên bản trước đó trong vòng 7 ngày sau khi nâng cấp. Tính năng này nhằm giảm rủi ro khi nâng cấp cụm tại chỗ và giúp đội ngũ khôi phục nhanh hơn nếu bản cập nhật gây ra sự cố.
- 7Hacker News·25/7/2026researchAI mã nguồn mở đang bước vào thời khắc kiểu Kubernetes
Bài viết cho rằng AI open-weight đang dần trở thành một lớp hạ tầng giống như Kubernetes: ngày càng được chuẩn hóa, sử dụng rộng rãi và tích hợp vào quy trình vận hành thực tế. Quan điểm này cho thấy các mô hình mở đang chuyển từ giai đoạn thử nghiệm sang triển khai sản xuất trên nhiều nhóm và nền tảng.
- 5InfoQ·22/7/2026securityGoogle Cloud công bố bản hướng dẫn bảo mật AI cho GKE
Google Cloud đã công bố một bản hướng dẫn nhằm bảo mật các khối lượng công việc AI chạy trên Google Kubernetes Engine, phản ánh xu hướng chuyển từ thử nghiệm sang triển khai thực tế. Khung này đề xuất ba lớp bảo mật gồm hạ tầng, tính toàn vẹn của mô hình và bảo mật ứng dụng.
- 4The New Stack·21/7/2026framework_updateKubernetes giúp triển khai ứng dụng dễ hơn, nhưng vận hành cơ sở dữ liệu vẫn khó
Bài viết cho rằng Kubernetes đã giúp đơn giản hóa việc triển khai ứng dụng, nhưng vận hành cơ sở dữ liệu vẫn đòi hỏi chuyên môn riêng mà các nhóm ứng dụng thường không nên tự gánh. Bài nhấn mạnh vai trò của platform engineering và tự động hóa trong việc cung cấp, sao lưu, vá lỗi, giám sát và xử lý failover cho các dịch vụ như Postgres, Redis và OpenSearch.
- 6The New Stack·21/7/2026researchAgent runtime nổi lên như lớp vận hành cho AI tác tử trong môi trường sản xuất
Bài viết cho rằng để xây dựng tác tử AI hiệu quả, doanh nghiệp không chỉ cần một mô hình đủ mạnh mà còn cần một agent runtime cung cấp trạng thái, bảo mật, tích hợp công cụ và khả năng mở rộng. Tác tử triển khai thực tế có nhu cầu tính toán khác với ứng dụng truyền thống, gồm khởi động nhanh, phiên làm việc có trạng thái bền vững và kiểm soát chặt chi phí cũng như giới hạn API.
- 7The New Stack·20/7/2026product_launchCác ông lớn đám mây hội tụ vào một kiến trúc tác tử doanh nghiệp chung
Amazon, Microsoft và Google đều đã giới thiệu hoặc đổi tên các nền tảng tác tử doanh nghiệp, và các nền tảng này đang dần có chung các thành phần cốt lõi như runtime, bộ nhớ, truy cập công cụ, định danh, quan sát và quản trị. Bài viết cho rằng đây đang trở thành một lớp nền tảng mới cho tác tử sản xuất, tương tự cách PaaS từng chuẩn hóa triển khai ứng dụng, dù hiện chưa có dự án mã nguồn mở nào đưa ra một hợp đồng chung.
- 7The New Stack·19/7/2026open_sourceTác tử giám sát node EKS của AWS giúp GPU tự phục hồi
AWS mô tả cách hãng xây dựng và mở mã nguồn EKS Node Monitoring Agent để phát hiện lỗi node và ghi Kubernetes NodeConditions, từ đó kích hoạt Karpenter tự động thay thế node. Hệ thống này nhắm tới các cụm EKS quy mô lớn, nơi lỗi phần cứng GPU và các lỗi hạ tầng khác xảy ra thường xuyên, đồng thời rút ra các bài học về phát hiện sự cố, hợp đồng API và độ trễ khắc phục ở quy mô lớn.
- 5The New Stack·17/7/2026framework_updateBài học vận hành controller Kubernetes ở quy mô lớn
Bài viết giải thích cách các controller Kubernetes biến ý định khai báo thành trạng thái được thực thi, và vì sao việc này khó hơn nhiều ở quy mô lớn khi cache trễ, đối tượng thay đổi liên tục và tính đúng đắn phụ thuộc vào cái nhìn đầy đủ toàn hệ thống. Nội dung tập trung vào hai controller của Amazon EKS: Network Policy Controller để thực thi lưu lượng trong cụm và VPC Resource Controller để gán security group AWS cho các pod được chọn.