OpenAI nâng cấp Codex với GPT-5-Codex: Mô hình AI biết “suy nghĩ” lâu tới 7 giờ

OpenAI ra mắt GPT-5-Codex, phiên bản mới với cơ chế "dynamic thinking", cho phép điều chỉnh thời gian xử lý linh hoạt, nâng cao hiệu suất lập trình vượt trội.

OpenAI nâng cấp Codex với GPT-5-Codex: Mô hình AI biết “suy nghĩ” lâu tới 7 giờ

OpenAI vừa công bố phiên bản mới của Codex mang tên GPT-5-Codex. Đây là bản nâng cấp đáng chú ý vì lần đầu tiên mô hình có thể phân bổ thời gian xử lý linh hoạt, từ vài giây cho tới bảy giờ cho một tác vụ lập trình. Nhờ vậy, GPT-5-Codex đạt hiệu suất tốt hơn hẳn trên các bộ đánh giá về khả năng lập trình tự động.

GPT-5-Codex: Cơ chế “dynamic thinking” và hiệu suất vượt GPT-5

Thay vì hoạt động theo cơ chế router như GPT-5 trong ChatGPT, vốn phải quyết định ngay từ đầu lượng tài nguyên cần cho một tác vụ, GPT-5-Codex có thể điều chỉnh thời gian suy nghĩ trong quá trình làm việc. Ví dụ, mô hình có thể bắt đầu với vài phút xử lý, rồi tự động mở rộng lên hàng giờ nếu thấy cần thiết. Theo OpenAI, có trường hợp GPT-5-Codex đã dành tới 7 tiếng để giải quyết một bài toán phức tạp.

OpenAI nâng cấp Codex với GPT-5-Codex: Mô hình AI biết “suy nghĩ” lâu tới 7 giờ

Nhờ cơ chế này, GPT-5-Codex vượt trội hơn GPT-5 trên benchmark SWE-bench Verified, vốn được thiết kế để đo năng lực lập trình tác vụ thực tế. Mô hình cũng cho kết quả tốt hơn ở bài kiểm tra refactoring code từ các kho nguồn lớn. Ngoài ra, trong thử nghiệm đánh giá khả năng review code, lập trình viên cho biết GPT-5-Codex đưa ra ít nhận xét sai hơn và nhiều gợi ý “có tác động lớn” hơn.

GPT-5-Codex hiện đã được triển khai cho toàn bộ người dùng ChatGPT Plus, Pro, Business, Edu và Enterprise. Người dùng có thể truy cập qua terminal, IDE, GitHub hoặc trực tiếp trong ChatGPT. OpenAI cho biết sẽ sớm cung cấp mô hình này cho khách hàng API.

Codex cạnh tranh với Copilot, Cursor và các AI coding agent khác

Bản cập nhật mới được xem là động thái để OpenAI tăng sức cạnh tranh cho Codex trong thị trường AI coding ngày càng sôi động. Hiện các sản phẩm như Claude Code, Cursor của Anysphere hay GitHub Copilot của Microsoft đều đang phát triển nhanh chóng. Đáng chú ý, Cursor đã vượt mốc doanh thu thường niên 500 triệu USD hồi đầu 2025, còn Windsurf vừa trải qua thương vụ mua lại đầy biến động liên quan đến Google và Cognition.

Trong bối cảnh đó, GPT-5-Codex nổi bật nhờ cách tiếp cận “dynamic thinking”, giúp mô hình xử lý đa dạng tác vụ lập trình từ đơn giản tới phức tạp với độ chính xác cao hơn. Đây có thể là lợi thế để Codex duy trì vị thế trong cuộc đua giữa các công cụ AI lập trình.