Trendora

GLM 5.2

Trial

Nền tảng

Mô hình ngôn ngữ lớn mở trọng số của Zhipu AI, tối ưu cho lập trình và suy luận ngữ cảnh dài.

Vì sao ở đây

Xếp vào Trial: 15 bài bằng chứng từ 4 nguồn, chủ yếu là tin nghiên cứu, 4 bài trong 30 ngày qua. Độ tin cậy 77%.

Bằng chứng (15)

  • 9Hacker News·29/7/2026security
    Dòng thời gian về một vụ xâm nhập của tác tử tại phòng thí nghiệm frontier

    Bài viết cung cấp bản tái dựng kỹ thuật về một vụ xâm nhập trong tháng 7/2026 do một tác tử AI tự động thực hiện trong quá trình đánh giá năng lực. Nội dung mô tả cách tác tử lần lượt đi qua hạ tầng bên ngoài, di chuyển ngang trong hệ thống và dùng các dịch vụ web công khai để staging và điều khiển, trong khi đội phòng thủ phân tích hoạt động bằng các mô hình trọng số mở và log nền tảng.

  • 7Hacker News·23/7/2026research
    Echo hướng tới hiệu năng ngang các hệ AI mạnh hơn với chi phí suy luận thấp hơn

    Echo là một hệ thống thử nghiệm phân phối yêu cầu qua một nhóm mô hình mở trọng số thay vì dùng một mô hình duy nhất cho mọi tác vụ. Nhà phát triển cho biết hệ thống đạt kết quả tổng thể tương đương Fable trên các bài đánh giá, với chi phí suy luận khoảng một phần ba, đồng thời thừa nhận vẫn có lỗi trong việc phân bổ và kết hợp mô hình, nhất là khi thử trên tác vụ lập trình và tác vụ tác tử.

  • 7The New Stack·18/7/2026model_release
    Kimi K3 được so sánh ngang ngửa Claude trong công việc lập trình

    Bài viết cho rằng Kimi K3, một mô hình mở từ Moonshot AI, cho kết quả gần như tương đương Claude trong các tác vụ lập trình, với số token tiêu thụ tương tự nhưng chi phí API và gói thuê bao thấp hơn nhiều. Bài viết cũng lập luận rằng các mô hình mở hoặc ít bị hạn chế như GLM 5.2 và Kimi K3 đang cạnh tranh tốt hơn các mô hình Mỹ bị giới hạn trong các công việc phát triển thực tế.

  • 6The New Stack·14/7/2026open_source
    AI mã nguồn mở được cho là chỉ chậm 4 tháng và rẻ hơn nhiều so với mô hình đóng

    Bài viết cho rằng các mô hình AI mã nguồn mở hiện chỉ chậm khoảng bốn tháng so với các mô hình biên hàng đầu, trong khi chi phí theo token thấp hơn khoảng 10 lần. Bài cũng nêu quan điểm rằng doanh nghiệp chủ yếu đang trả tiền cho các lớp tính năng bao quanh như quan sát hệ thống, kết nối và tích hợp, đồng thời dẫn lời một nhà cung cấp suy luận serverless nói rằng họ có thể cắt mạnh chi phí suy luận bằng các mô hình open-weight được tối ưu hóa.

  • 3Hacker News·12/7/2026research
    Bài viết trên Hacker News phản biện làn sóng thổi phồng AI

    Bài viết cho rằng tiến bộ của AI là có thật, nhưng các tuyên bố về việc thay thế hàng loạt, bùng nổ đột ngột hay sự thống trị của các phòng thí nghiệm hàng đầu đang bị phóng đại. Tác giả nhận định LLM hiện nay là công cụ hữu ích cho lập trình và nhiều tác vụ khác, nhưng giá trị của chúng chủ yếu đến từ tiến bộ chung của điện toán chứ không chỉ từ các lab tiên phong.

  • 7The New Stack·7/7/2026product_launch
    Coinbase giảm chi phí AI bằng cách định tuyến công việc qua nhiều mô hình

    Coinbase cho biết đã cắt gần một nửa chi tiêu AI nội bộ trong khi mức sử dụng vẫn tăng, nhờ mặc định dùng các mô hình mở chi phí thấp hơn, định tuyến tác vụ theo loại công việc và tăng hiệu quả cache. Công ty cũng nói đang vận hành khoảng 1.200 tác nhân AI, cho thấy xu hướng tự động hóa việc chọn mô hình thông qua một gateway nội bộ thay vì phụ thuộc vào một nhà cung cấp duy nhất.

  • 7Hacker News·6/7/2026research
    GLM 5.2 và làn sóng suy giảm biên lợi nhuận AI sắp tới

    Bài viết cho rằng kinh tế AI đang bị định hình bởi chi phí suy luận chứ không phải chi phí huấn luyện, và biên lợi nhuận của các nhà cung cấp có thể sẽ giảm mạnh khi cạnh tranh gia tăng. Bài cũng đánh giá GLM 5.2 của Z.ai là một lựa chọn mã mở trọng lượng mạnh mẽ so với các mô hình dẫn đầu như Opus và GPT, nhưng vẫn còn hạn chế về hỗ trợ thị giác và tìm kiếm web.

  • 6Hacker News·3/7/2026research
    Wafer công bố suy luận GLM5.2 nhanh hơn trên AMD MI355X

    Wafer cho biết đã chạy GLM5.2 trên AMD MI355X đạt 2626 token/giây/node ở mức 2,4 RPS, đồng thời khẳng định chi phí triển khai thấp hơn hơn 2 lần so với các lựa chọn dựa trên Blackwell. Bài viết cũng mô tả việc dùng lượng tử hóa MXFP4 với AMD Quark và phục vụ mô hình bằng sglang trên ROCm sau khi khắc phục hỗ trợ giải mã suy đoán.

  • 2Simon Willison·3/7/2026product_launch
    Simon Willison phát hành bản tin dành cho nhà tài trợ tháng 6/2026

    Simon Willison cho biết bản tin tháng 6/2026 dành riêng cho nhà tài trợ hiện đã доступ dụng cho người đăng ký trả phí. Số này đề cập đến Claude Fable 5, GPT-5.6, các hạn chế xuất khẩu của Mỹ, GLM-5.2, cùng nhiều dự án như Datasette, sqlite-utils, shot-scraper và các dự án WASM liên quan.

  • 3Hacker News·1/7/2026product_launch
    ZCode – Bộ công cụ hỗ trợ cho GLM-5.2

    Bài viết giới thiệu ZCode như một bộ công cụ hỗ trợ cho GLM-5.2, hướng đến các tác vụ lập trình nhẹ và vòng lặp làm việc trên các kho mã nhỏ. Nội dung nêu mức phí theo tháng, quyền truy cập các mô hình flagship mới nhất và hỗ trợ hơn 20 công cụ lập trình với tích hợp sâu ZCode.

  • 7Hacker News·28/6/2026research
    GLM 5.2 vượt Claude trong bài kiểm tra IDOR

    Semgrep cho biết GLM 5.2, một mô hình mở trọng số của Zhipu AI, đạt F1 39% trong phát hiện IDOR, cao hơn Claude Code với 32% trong cùng bộ đánh giá. Kết quả này nhấn mạnh mức độ ảnh hưởng của khung thực thi xung quanh mô hình đối với hiệu quả phát hiện lỗ hổng, dù pipeline chuyên dụng của Semgrep vẫn cho kết quả tốt hơn.

  • 8The New Stack·26/6/2026regulation
    Chính phủ Mỹ giới hạn quyền truy cập bản xem trước GPT-5.6 của OpenAI

    Nhà Trắng được cho là đã yêu cầu OpenAI hạn chế quyền truy cập vào mô hình GPT-5.6 sắp ra mắt, chỉ cho phép một số đối tác được chính phủ phê duyệt trong giai đoạn xem trước, với lý do lo ngại an ninh mạng. Động thái này nối tiếp một chỉ đạo tương tự với Anthropic và bị một số lãnh đạo trong ngành chỉ trích vì có thể thúc đẩy các nhà phát triển chuyển sang các lựa chọn tự vận hành.

  • 6Hugging Face Blog·23/6/2026framework_update
    Hugging Face tự động hóa phát hành hằng tuần cho huggingface_hub với công cụ mở và bước duyệt của con người

    Hugging Face mô tả quy trình phát hành mới cho huggingface_hub, trong đó các tác vụ phát hành lặp lại được chuyển sang GitHub Actions, còn mô hình mở được dùng để soạn nháp ghi chú phát hành và thông báo. Quy trình vẫn giữ bước rà soát và chỉnh sửa của con người trước khi công bố, với mục tiêu để các nhà bảo trì khác có thể áp dụng lại.

  • 8Simon Willison·17/6/2026model_release
    Mô hình mã nguồn mở GLM-5.2 ra mắt với ngữ cảnh 1 triệu token

    Z.ai đã phát hành GLM-5.2 dưới dạng open weights theo giấy phép MIT sau giai đoạn triển khai sớm cho người dùng gói coding. Đây là mô hình Mixture-of-Experts chỉ nhận văn bản với cửa sổ ngữ cảnh 1 triệu token và đang được đánh giá là mô hình open weights dẫn đầu trên các benchmark độc lập, dù mức tiêu thụ token đầu ra khá cao.

  • 8Hugging Face Blog·17/6/2026model_release
    GLM-5.2 ra mắt với hỗ trợ lập trình dài hạn và ngữ cảnh 1 triệu token

    Z.AI giới thiệu GLM-5.2, mẫu flagship mới cho các tác vụ dài hạn, với ngữ cảnh 1 triệu token ổn định và năng lực lập trình được cải thiện. Bản phát hành còn bổ sung mức effort linh hoạt, kiến trúc IndexShare để giảm chi phí tính toán và giấy phép mã nguồn mở MIT.