立即與 GPT-5.3-Codex 聊天
GPT-5.3-Codex:軟體工程領域的頂尖智能代理模型
GPT-5.3-Codex在 2026 年 2 月發布,是GPT-5.2和GPT-5.2-Codex 的後繼產品。
作為 Codex 系列的一員, GPT-5.3-Codex被設計為一個通用的工作agent,將編碼、推理和電腦使用整合到一個模型中,而不是將「編碼模型」和「聊天模型」分開。
GPT-5.3-Codex的主要功能與效能亮點
GPT-5.3-Codex在處理複雜的推理和編碼任務方面表現出色。它在以下幾個方面脫穎而出:
- 在編碼和軟體工程基準測試(例如SWE-Bench Pro)上展現了最先進的效能,並在測試終端機使用和完整電腦互動的Terminal-Bench和OSWorld上取得了優異的成績。
- 負責軟體開發的整個生命週期任務:撰寫和重構程式碼、除錯、編寫測試、更新文件,以及與終端機、瀏覽器和圖形使用者介面等工具互動。
- 擅長一般「知識型工作」:撰寫文件、製作簡報、試算表、分析報告以及其他專業成果,並以GDPval基準衡量。
- 比之前的 Codex 模型快了大概 25%,而且在許多任務中使用的 token 數更少,讓冗長、多步驟的工作流程更有效率。
GPT-5.3-Codex與其他領先模型的比較
| 對比項 | GPT-5.3-Codex | GPT-5.2 (Pro/Thinking) | Claude Opus 4.6 | Gemini 3.1 Pro |
| 主要優勢 | 代理執行 | 深度邏輯/推理 | 大規模重構 | 多模態/長上下文 |
| Terminal-Bench 2.0 | 77.3% | 64.9% | 74.7% | 74.8% |
| SWE-Bench Pro | 57% | 54.2% | 64.6% | 77.1% |
| 上下文視窗 | 40萬個token | 40萬個token | 100萬個token | 100萬個token |
| 輸出速度 | 每秒約100個token | 每秒約85個token | 每秒約65個token | 每秒約120個token |
| 最適合... | 執行與測試程式碼 | 策略與邏輯設計 | 簡潔、優雅的架構 | 影音資料分析 |



