OpenAI旗艦模型Astra發佈不到三週,再度出手推出GPT-6 Sol與Luna,API價格直接腰斬。其中Luna輸入價低至每百萬Token 0.10美元,約合0.67元人民幣,輸出價格0.50美元,相比之下,DeepSeek V4.1 Flash閒時輸入價爲每百萬Token 1元,輸出價爲 4 元,高峰時段則升至2元和8元。按照普通新請求計算,Luna 已經更便宜,也沒有峰谷定價帶來的成本波動。
OpenAI在旗艦模型發佈不到三週後再度出手,將兩款新模型的API價格直接砍半,劍指DeepSeek的低價護城河,大模型競爭從"比能力"全面轉向"比成本"。
美東時間9月22日,OpenAI正式推出GPT-6 Sol和GPT-6 Luna兩款新模型,宣佈其API價格較GPT-5.6促銷定價再降50%。其中GPT-6 Luna的輸入價格低至每百萬Token 0.10美元,輸出價格0.50美元,已直接切入此前被DeepSeek視爲價格優勢的區間,向中國競爭對手的核心陣地發起正面衝擊。
此次降價並非單純商業讓利。OpenAI表示,價格下降源於緩存和推理效率的提升,公司將節省的成本直接傳導至用戶。與此同時,Anthropic同日推出Claude Opus 5.5並強調更低運行成本。兩大頭部AI公司在同一天以更具競爭力的價格入場,標誌着AI行業競爭已進入性能、速度與成本"三線並進"的新階段。
Astra發佈不到三週,OpenAI火速補齊產品線
9月3日,OpenAI推出GPT-6旗艦模型Astra,稱其在計算機操作、軟件工程、網絡安全及專業工作等領域達到新的能力前沿。彼時Astra需求之旺盛一度迫使OpenAI暫停新的Pro訂閱註冊。
僅僅不到三週,OpenAI已在Astra之下推出Sol和Luna,迅速向不同性能、成本和使用場景鋪開產品線。OpenAI官方表示,Sol和Luna"建立在GPT-6 Astra背後的技術進展之上",將Astra的諸多優勢帶入"更快速、更實惠的模型",以支持規模化工作。

這一節奏與AI行業愈發明顯的產品策略相呼應:旗艦模型負責突破能力上限,更快、更便宜的版本則負責進入更多高頻工作流。
API價格直接腰斬,Luna已進入DeepSeek價格腹地
價格是此次發佈最明確的商業信號。
根據OpenAI公佈的價格表,GPT-6 Sol輸入價格從GPT-5.6 Sol促銷價的4美元降至2美元/百萬Token,輸出價格從20美元降至10美元;GPT-6 Luna輸入價格從0.20美元降至0.10美元,輸出價格從1.20美元降至0.50美元。兩款模型API成本均直接打五折。

OpenAI解釋稱,降價主要來自緩存和推理效率的提升,而非單純的商業補貼。公司同時進一步優化了提示詞緩存機制,使智能體和長對話能夠更多複用已處理的上下文,從而攤薄單次調用成本。
其中Luna的定價尤爲激進,已切入此前被DeepSeek系列模型主打的超低價區間,令外界將此次發佈視爲OpenAI對DeepSeek價格護城河的正面挑戰。
作爲對照,DeepSeek V4.1 Flash 閒時的緩存未命中輸入價爲每百萬 Token 1 元,輸出價爲 4 元,高峰時段則升至 2 元和 8 元。按照普通新請求計算,Luna 已經更便宜,也沒有峰谷定價帶來的成本波動。
但DeepSeek仍有自己的價格優勢。它的閒時緩存命中輸入只要每百萬 Token 0.02 元,遠低於 Luna。V4.1 Flash 的綜合能力也明顯更高,擁有 100 萬 Token 上下文,並支持圖文理解、工具調用和思考模式。

Sol主攻複雜工作,Luna瞄準高頻低成本場景
兩款模型定位有所區分,並非"同一模型不同價格"。
Sol面向更高能力需求的任務,包括複雜專業工作、編碼和智能體場景。在AutomationBench企業跨應用工作流測試中,GPT-6 Sol在xhigh effort下得分33.2%,高於GPT-6 Astra在low effort下的30.3%,也高於Claude Opus 5 max effort下的26.9%;OpenAI稱,Sol完成每項任務的成本僅爲0.27美元。
Luna則更突出成本效率。OpenAI稱,在AutomationBench高強度測試中,GPT-6 Luna較前代提升5.4個百分點,同時單項任務成本降低58%;在DeepSWE v1.1中,Luna最高得分66.6%,與Claude Opus 5和Fable 5中等強度表現相當,但每項任務成本分別低93%和96%。
在事實準確性方面,OpenAI內部測試顯示GPT-6 Sol的錯誤數量約爲前代一半;Luna在更高推理強度下可達到GPT-5.6 Sol的水平,成本約爲後者的百分之一。OpenAI提示,該測試基於用戶此前標記爲事實錯誤的匿名ChatGPT對話,不代表所有真實使用場景。
先進Work和Codex,免費用戶可體驗Luna
在產品覆蓋上,OpenAI此次未立即將Sol和Luna推入ChatGPT普通聊天界面。
根據安排,Plus、Pro、Business、Enterprise及Edu用戶可在ChatGPT Work和Codex中使用兩款模型,並開放API調用;免費版和Go版用戶則可在桌面端應用中體驗GPT-6 Luna。
這一安排使首發場景明顯偏向工作和開發,而非面向大衆消費者。Sol和Luna的低成本、高使用效率,也更適合需要頻繁調用模型的編碼任務、智能體工作流及企業內部自動化。與此同時,將部分高頻需求導向成本更低的模型,或有助於OpenAI在擴大使用規模的同時緩解基礎設施壓力。
行業競爭從"拼旗艦"全面轉向"拼規模與成本"
值得關注的是,OpenAI推出Sol和Luna之際,行業內部正同時討論"AI開發是否應當放慢"。
本月早些時候,Anthropic CEO Dario Amodei公開呼籲放慢前沿AI發展速度,並警告快速推進可能帶來風險;OpenAI CEO Sam Altman隨後表示認同行業需要放慢前沿模型發展步伐、加強安全措施;OpenAI首席科學家Jakub Pachocki也提出,通過協調放慢未來AI開發是確保自我改進型AI安全的重要路徑。
然而與此同時,OpenAI自身的產品迭代並未放慢:Astra發佈不到三週即再推兩款新模型,並將API價格直接下調50%。同日,Anthropic也推出Claude Opus 5.5,同樣以更低運行成本爲賣點。
一邊討論如何放慢AI發展速度,一邊加快模型迭代、壓低調用成本,AI行業正在進入能力與成本同時加速下探的新階段。
編輯/Deng