GPT-5 Pro
AdoptCông cụ
Một biến thể mô hình của OpenAI có năng lực cao, dùng cho suy luận và phân tích nâng cao.
Vì sao ở đây
Xếp vào Adopt: 40 bài bằng chứng từ 4 nguồn, chủ yếu là tin nghiên cứu, 13 bài trong 30 ngày qua. Độ tin cậy 96%.
Bằng chứng (17)
- 4Simon Willison·7/8/2026product_launchCodex tạo game Raccoon Heist tốt hơn với GPT-5.6 Sol Ultra
Simon Willison so sánh cùng một prompt tạo game trên các tác nhân lập trình khác nhau và nhận thấy Codex Desktop chạy GPT-5.6 Sol Ultra tạo ra phiên bản Raccoon Heist hấp dẫn hơn so với lần thử trước bằng Claude Fable 5. Bài viết cũng ghi nhận một lỗi hiển thị trong game được sinh ra, sau đó đã được sửa bằng prompt tiếp theo, đồng thời công bố đầy đủ transcript Codex và các tài nguyên trong repository.
- 6Hacker News·24/7/2026researchOpus 5 đứng đầu bảng xếp hạng Artificial Analysis Intelligence
Artificial Analysis cho biết Claude Opus 5 là mô hình có điểm cao nhất trên bảng xếp hạng Intelligence, với các biến thể Opus 5 đứng trên các hệ thống dẫn đầu khác như Claude Fable 5 và GPT-5.6 Sol. Trang này so sánh các mô hình theo trí tuệ, tốc độ, độ trễ, chi phí và cửa sổ ngữ cảnh dựa trên bộ phương pháp đánh giá nhiều tiêu chí của hãng.
- 8Hacker News·20/7/2026researchNhà nghiên cứu tìm thấy lỗ hổng RCE WordPress bằng GPT-5.6 với 25 USD
Một nhà nghiên cứu an ninh cho biết họ đã phát hiện lỗ hổng thực thi mã từ xa (RCE) trên WordPress và báo cáo tới các bên môi giới khai thác, vốn được cho là trả tới 500.000 USD cho các phát hiện như vậy. Kết quả được thực hiện với sự hỗ trợ của GPT-5.6 và khoảng 25 USD chi phí API, cho thấy vai trò của công cụ AI trong nghiên cứu lỗ hổng.
- 7The New Stack·18/7/2026model_releaseKimi K3 được so sánh ngang ngửa Claude trong công việc lập trình
Bài viết cho rằng Kimi K3, một mô hình mở từ Moonshot AI, cho kết quả gần như tương đương Claude trong các tác vụ lập trình, với số token tiêu thụ tương tự nhưng chi phí API và gói thuê bao thấp hơn nhiều. Bài viết cũng lập luận rằng các mô hình mở hoặc ít bị hạn chế như GLM 5.2 và Kimi K3 đang cạnh tranh tốt hơn các mô hình Mỹ bị giới hạn trong các công việc phát triển thực tế.
- 8Hacker News·18/7/2026researchGPT-5.6 được cho là giúp lấp đầy khoảng trống 30 năm trong tối ưu hóa lồi
Một thảo luận được đăng trên Hacker News nêu một kết quả được cho là GPT-5.6 đã được dùng cùng prompt để hỗ trợ giải quyết một bài toán mở lâu năm trong tối ưu hóa lồi. Nội dung này dường như liên quan đến chứng minh hoặc suy luận toán học có hỗ trợ bởi AI, chứ không phải một bản phát hành sản phẩm.
- 5Hacker News·18/7/2026researchFable 5 vượt GPT-5.6 Sol trên một bài toán tối ưu NP-hard
Một bài đánh giá trên bài toán tối ưu mạng cáp quang chưa công bố cho thấy Claude Fable 5 là mô hình mạnh nhất tổng thể và ổn định hơn GPT-5.6 Sol. Bài viết cũng cho thấy chế độ /goal gốc không phải là một nút tăng hiệu năng chung: đôi khi nó giúp, nhưng cũng có lúc làm đổi hướng tìm kiếm theo cách bất lợi.
- 7The New Stack·18/7/2026model_releaseClaude Fable 5 được bổ sung vĩnh viễn vào các gói thuê bao
Anthropic cho biết từ ngày 20/7, Claude Fable 5 sẽ được đưa vào tất cả các gói Max và Team Premium, với mức sử dụng bằng 50% giới hạn. Người dùng Pro và Team Standard vẫn có thể truy cập thông qua tín dụng sử dụng và sẽ nhận khoản tín dụng một lần trị giá 100 USD. Quyết định này đảo ngược kế hoạch trước đó là loại mô hình khỏi gói thuê bao, nhiều khả năng do áp lực cạnh tranh và nhu cầu từ người dùng.
- 5Hacker News·16/7/2026researchClaude Fable 5 và GPT-5.6 Sol tạo video âm nhạc AI theo ngân sách
Một bài đăng trên Hacker News mô tả một harness mã nguồn mở cho phép các mô hình tiên tiến tự nghiên cứu, tạo clip, xem lại footage và biên tập thành một video âm nhạc hoàn chỉnh trong ngân sách cố định. Thử nghiệm so sánh Claude Fable 5 và GPT-5.6 Sol ở mức ngân sách 25 USD và 100 USD, ghi lại việc dùng công cụ, chi phí và chất lượng đầu ra; cả bốn lượt chạy đều hoàn tất thành công.
- 7Simon Willison·16/7/2026securityLỗi Codex có thể xóa tệp khi chạy ở chế độ toàn quyền
Simon Willison trích dẫn Thibault Sottiaux về một lỗi của Codex có thể xóa tệp ngoài ý muốn. Sự cố này thường xảy ra khi bật chế độ toàn quyền mà không có cơ chế sandbox hay auto review, và khi mô hình nhầm lẫn xóa nhầm thư mục $HOME sau khi cố gắng ghi đè biến này để tạo thư mục tạm.
- 8Hacker News·15/7/2026researchStar Fleet tuyên bố giải được 20 bài toán Erdős song song
Star Fleet, một hệ thống AI giải toán dựa trên Lean 4, cho biết đã giải được 20 bài toán Erdős bằng cách chạy song song tới 20 bộ tác vụ tác nhân, mỗi bộ sử dụng một phiên bản GPT-5.6 riêng. Hệ thống kết hợp tính toán quy mô lớn, tìm kiếm định lý, xác minh chứng minh và theo dõi phụ thuộc dài hạn để xử lý các bài toán toán học mở.
- 3Simon Willison·14/7/2026open_sourceThú cưng tùy biến Pedalican trong Codex Desktop của Simon Willison
Simon Willison chia sẻ việc tạo một thú cưng tùy biến cho Codex Desktop: một chú bồ nông đi xe đạp xuất hiện trên màn hình và cập nhật trạng thái các tác vụ Codex. Ông cũng mô tả cách GPT-5.6 Sol cùng nhiều vòng dùng gpt-image-2 tạo bộ ảnh sprite, đồng thời cho biết phần triển khai dựa trên các kỹ năng mã nguồn mở của OpenAI.
- 8The New Stack·14/7/2026product_launchCodex của OpenAI đạt 8 triệu người dùng sau khi tích hợp vào ChatGPT
OpenAI cho biết lượng người dùng kết hợp của Codex và ChatGPT Work có thể đã đạt 8 triệu sau khi GPT-5.6 ra mắt và Codex được hợp nhất vào ứng dụng ChatGPT trên desktop. Đợt triển khai này bộc lộ các vấn đề về khả năng mở rộng và tính cước, khiến công ty phải điều chỉnh giới hạn ngữ cảnh, thiết lập suy luận và hạn mức sử dụng, trong khi các đối thủ cũng thay đổi giá và giới hạn.
- 2Simon Willison·13/7/2026open_sourceBiểu đồ tần suất thay đổi mã của Datasette trên GitHub
Simon Willison chia sẻ biểu đồ tần suất thay đổi mã trên GitHub cho dự án mã nguồn mở Datasette của ông để minh họa sự thay đổi trong đầu ra lập trình theo thời gian. Ông lưu ý rằng đợt tăng mạnh gần đây dường như trùng với việc sử dụng các mô hình và tác nhân lập trình AI mới hơn như Opus 4.8, GPT-5.5, Fable 5 và GPT-5.6 Sol.
- 7Hacker News·12/7/2026model_releasePloy chuyển tác tử AI sản xuất sang GPT-5.6 Sol
Ploy cho biết GPT-5.6 Sol đã thay thế Claude Opus làm mô hình mặc định cho tác tử sản xuất sau các bài thử trực tiếp trên tác vụ xây dựng website thực tế. Công ty cho hay mô hình mới nhanh hơn 2,2 lần, rẻ hơn 27% và cho chất lượng tương đương hoặc tốt hơn trên các tác vụ hoàn thành, dù quá trình chuyển đổi phải sửa các giả định về đánh giá, lược đồ công cụ, bộ nhớ đệm và phát lại suy luận.
- 8The New Stack·11/7/2026model_releaseOpenAI, SpaceXAI và Meta châm ngòi cuộc chiến giá trong AI
OpenAI, SpaceXAI và Meta đồng loạt ra mắt hoặc mở rộng các mô hình AI mới trong vòng 24 giờ, nhưng điểm chung nổi bật là giá cả hơn là năng lực. Bài viết cho rằng AI tiên tiến đang ngày càng cạnh tranh bằng chi phí token thấp hơn và hiệu suất cao hơn, cho thấy áp lực biên lợi nhuận đang tăng lên ở các nhà cung cấp mô hình hàng đầu.
- 9Hacker News·10/7/2026breakthroughGPT-5.6 Sol Ultra được cho là đã chứng minh Giả thuyết Cycle Double Cover
Một bài đăng trên Hacker News nêu thông tin rằng GPT-5.6 Sol Ultra đã tạo ra một chứng minh cho Giả thuyết Cycle Double Cover, một bài toán lâu đời trong lý thuyết đồ thị. Bài viết dẫn tới một PDF prompt và thảo luận trên mạng xã hội về kết quả này, thu hút nhiều chú ý từ cộng đồng HN.
- 8The New Stack·10/7/2026product_launchOpenAI, Microsoft và Anthropic bất đồng về quyền kiểm soát tác tử
OpenAI ra mắt ChatGPT Work trên GPT-5.6, cho phép tác tử xử lý tệp cục bộ và tài liệu Google Workspace, Microsoft 365 cho người dùng Pro, Enterprise và Edu. Bài viết đặt sản phẩm này cạnh các giải pháp của Microsoft, Anthropic, Perplexity và Amazon theo bốn mô hình triển khai, nhấn mạnh ai kiểm soát runtime, bộ nhớ, thông tin xác thực và chính sách.