Fireworks
AssessNền tảng
Một nền tảng suy luận AI được nhắc đến trong so sánh chi phí phục vụ mô hình.
Vì sao ở đây
Xếp vào Assess: 2 bài bằng chứng từ 1 nguồn, chủ yếu là tin nghiên cứu, 1 bài trong 30 ngày qua. Độ tin cậy 32%.
Bằng chứng (2)
- 7Hacker News·21/7/2026researchKimi K3 ngang Fable trên tác vụ agent, kết hợp định tuyến cho kết quả tốt hơn
Một nghiên cứu benchmark trên khoảng 1.030 tác vụ agent thực tế cho thấy Kimi K3 và Fable 5 có chất lượng tổng thể tương đương, nhưng mỗi mô hình mạnh ở các nhóm tác vụ khác nhau. Bài viết cho biết việc định tuyến giữa hai mô hình đạt độ chính xác 93% và có thể giảm chi phí tới 50 lần so với chỉ dùng Fable trong các vòng lặp agent dài.
- 7Hacker News·9/7/2026researchGLM 5.2 gần như ngang độ chính xác của kế toán viên người trong khai báo VAT
Một bài blog cho biết GLM 5.2, một mô hình AI mở trọng số, đã hoàn thành tờ khai VAT quý cho một doanh nghiệp nhỏ ở Anh với độ chính xác gần như tuyệt đối, chỉ lệch 7 pence ở số VAT cuối cùng. Bài kiểm tra diễn ra trong môi trường cô lập với quy trình kế toán trên phần mềm đám mây và đánh giá khả năng nhập giao dịch qua công cụ CLI.