GPT-5.4:OpenAI推理模型
OpenAI GPT-5系列的主力。和Claude Sonnet 4.6一樣處在×1積分基準線上,是多數Codex框架智能體合適的預設選擇。
400K tokens · Text / Vision / Code · Prompt cache
Okou已不再執行GPT-5.4。本頁作為它的規格、價格和基準測試參考保留。要做同類工作,請用GPT 5.6 Luna。
檢視GPT 5.6 LunaGPT-5.4是OpenAI GPT-5系列的主力——預設鋪開來一直跑的那個模型。廠商公佈的SWE-bench Verified成績為74.9%,在編碼上與Claude Sonnet 4.6處在同一區間,而它的工具使用準確度,正是多數生產環境Codex框架智能體調校時對標的基準。
GPT-5.4是什麼?
2026年4月 · GPT-5系列的主力。多數Codex框架智能體推薦的預設選擇。
GPT-5.4是OpenAI GPT-5這一代的主力,2026年4月與旗艦GPT-5.5和成本最佳化的GPT-5.4 Mini一同發布。OpenAI把它定位為Codex框架上智能體的通用預設值——除非某個環節確實值得升級到5.5,否則每一步都用它。
架構上,GPT-5.4與GPT-5系列其餘成員共享40萬token的上下文視窗、reasoning_effort參數、提示詞快取和Responses API介面。與GPT-5.5的分野在於每個token投入的算力:5.4更快更便宜,5.5在推理深度上投入更多。與GPT-5.4 Mini的分野正好相反——在真正決定一次智能體執行成敗的環節上,5.4的質量更高。
GPT-5.4有什麼特別之處
架構與能力上的主要亮點。
GPT-5.4與GPT-5系列其餘成員架構相同:40萬token上下文視窗,reasoning_effort參數分四檔(minimal、low、medium、high),提示詞快取讓快取輸入只按輸入價的十分之一計費,以及codex CLI預設使用的Responses API介面。支援工具呼叫、結構化輸出和computer-use。輸入為文字、視覺和程式碼的多模態。
規格速覽
GPT-5.4基準測試
分數來自OpenAI GPT-5發布材料,並以上一代OpenAI模型為對照給出差值。獨立評測把GPT-5.4放在與Claude Sonnet 4.6相同的編碼質量區間。絕對百分比只當作方向性參考。
GPT-5.4價格
服務商標價,按每100萬token計。
GPT-5.4實際用起來怎麼樣
來自生產環境智能體執行的實際觀察。
工具路由
在標準的Codex框架工具目錄上,準確度是紮實的基準水平。5.5領先的地方在難的邊緣情況(條件式工具選擇、深層巢狀參數)——常規情況下5.4路由同樣正確,延遲卻低得多。
程式碼修改
在常規重構和修bug的工作負載上,補丁質量與Claude Sonnet 4.6相當。5.5開始拉開差距的地方,是那些要求補丁一次就能幹淨應用的跨檔案改動。
速度
比5.5明顯更快——據Artificial Analysis,medium強度下約110 token/秒。這也是5.4在互動式對話回覆和短智能體流程這類使用者能直接感知延遲的場景裡保持預設地位的原因之一。
成本效率
×1積分,輸出表現落在Sonnet 4.6那一檔的質量區間。對已經在用Codex框架的團隊來說,這就是成本與質量的甜點——只在明顯需要的環節升級到5.5。
幻覺表現
它繼承了OpenAI在GPT-5這一代做的校準改進。比GPT-4系列更少給出自信的錯誤答案,在超出訓練時間範圍的問題上尤其明顯。
GPT-5.4最適合的智能體任務
Codex框架上預設的智能體環節
如果你的智能體已經建在codex CLI或任何Codex框架整合之上,GPT-5.4就是自然的通用預設值。×1積分,快到足以互動使用,準到足以應付佔據大部分執行時間的常規工具呼叫。
什麼時候不該用GPT-5.4
最難的推理、computer-use,以及跨檔案程式碼修改這些5.5明顯領先的環節,別用GPT-5.4;高頻的批次分類和前置篩選也別用,服務商層面5.4 Mini便宜四倍。
GPT-5.4與其他模型對比
GPT-5.4對比GPT-5.5
同一個系列,定位不同。5.5(×2)給你最強的推理、computer-use和一次成型的程式碼質量;5.4(×1)用一半的積分成本給你同樣的上下文視窗和功能集,速度還明顯更快。預設用5.4,只在明顯需要的環節升級到5.5。
GPT-5.4對比Claude Sonnet 4.6
兩個生態各自的×1基準線。Sonnet 4.6跑在Claude Code框架上,GPT-5.4跑在Codex上。按你現有的智能體和工具定義面向哪個框架來選。純看輸出質量兩者足夠接近,正確做法是在你自己的工作負載上做A/B測試。
GPT-5.4對比GPT-5.4 Mini
同一個系列,定位不同。5.4(×1)每個token承載的推理質量更高;5.4 Mini(×0.3)給你一個便宜得多的選擇,用於批次和前置篩選。扇出式分類交給5.4 Mini,決定一次智能體執行走向的環節交給5.4。
常見問題
GPT-5.4的上下文視窗有多大?
40萬token,單次回覆最高輸出128K token。整個視窗都按標準價計費。
GPT-5.4能處理圖片嗎?
能。GPT-5.4是多模態的,原生接受圖片與文字、程式碼一起輸入。
什麼時候該選GPT-5.4而不是Claude Sonnet 4.6?
當你的智能體已經建在Codex框架上,或者你需要OpenAI生態(工具目錄、結構化輸出、Responses API)的時候。兩者都在×1積分檔,成本一樣,選擇取決於框架契合度和實際表現。
GPT-5.4支援提示詞快取嗎?
支援。快取輸入按每100萬token $0.25計費——快取的那部分成本降到十分之一。
替代選擇
GPT-5.4在Okou上的可用情況
GPT-5.4已從Okou陣容中移除,因此在聊天和工作流裡都無法再選用,也不能用你自己的API金鑰接入。GPT 5.6 Luna覆蓋同一個省錢檔位。

