
7 月 AI 大亂鬥:國外 GPT-5.6、Grok4.5、Gemini 3 Pro 輪流登場,國內 DeepSeek V4 正式版也來了!
OpenAI 旗艦 GPT-5.6 Sol 明日上線,定價每百萬 Token 輸入 5 美元;馬斯克 Grok 4.5 同步公開,宣稱性價比碾壓 Opus 級對手;谷歌 Gemini 3.5 Pro 押注全新底座於 17 日亮相;DeepSeek V4 同步引入峯谷定價並推理提速逾 60%。一場橫跨性能、成本與生態的全面角力,正式打響。
7 月全球 AI 大模型競賽進入密集發佈窗口期,國內外頭部玩家幾乎同步亮出新牌。
OpenAI 旗艦模型 GPT-5.6 Sol 定於本週四正式發佈,馬斯克旗下 SpaceX AI 宣佈 Grok 4.5 也將於明日向公眾開放,谷歌 Gemini 3.5 Pro 據悉將於 7 月 17 日上線,國內 DeepSeek V4 正式版同樣鎖定 7 月中旬。
短短數週內,多款頂級大模型密集落地,直接加劇了 AI 行業的競爭烈度,並對相關企業的商業化路徑與定價策略產生深遠影響。
對市場而言,此輪集中發佈不僅是技術能力的比拼,更是各方在 API 定價、推理效率與生態整合上的全面角力。投資者需關注的核心問題在於:誰能在性能與成本之間找到最優解,並率先將技術優勢轉化為商業壁壘。
GPT-5.6 Sol:旗艦定位,分階段開放
OpenAI 首席執行官 Sam Altman 週三在社交媒體宣佈,GPT-5.6 Sol 將於本週四正式發佈。這是 GPT-5.6 系列中的旗艦產品,搭載全新 ultra 多智能體模式與 max 推理強度,在編碼、生物學和網絡安全等核心基準測試中均刷新最佳紀錄。

定價方面,Sol 採用每百萬 Token 輸入 5 美元、輸出 30 美元的收費標準,位居 GPT-5.6 系列三款產品的最高端。OpenAI 同時宣佈,將於 7 月在 Cerebras 硬件上推出 Sol,推理速度最高可達每秒 750 個 Token。
發佈策略上,OpenAI 採取分階段推進路線,初期僅向部分可信合作伙伴開放 API 和 Codex 訪問權限,計劃在未來數週內向更廣泛用户普及 GPT-5.6 全系列。這一策略在控制服務壓力的同時,也為競爭對手留出了一定的響應窗口。
Grok 4.5:馬斯克加速整合 AI 版圖
馬斯克在社交媒體上宣佈,基於 beta 測試階段客户的強烈正面反饋,SpaceX AI 將於明日向公眾開放 Grok 4.5。馬斯克稱,該模型屬於 Opus 級別,但速度更快、Token 效率更高、成本更低。

據此前披露的信息,Grok 4.5 基於 1.5 萬億參數的 V9 基礎模型打造,並在補充訓練中特別加入了 AI 編程工具 Cursor 的數據。早期評測結果顯示,該模型性能已接近甚至可能超越 Anthropic 旗艦模型 Claude Opus,強化學習仍在持續優化該模型。
值得關注的是,SpaceX AI 還與編程工具公司 Cursor 計劃聯合發佈首款共同研發的 AI 模型,直接向 Anthropic 和 OpenAI 發起挑戰。據 The Information 獲得的一份內部備忘錄,該模型此前曾因兩家公司希望進一步提升運行效率而推遲發佈,預計在某些指標上可與 Anthropic 的 Opus 4.8 及 OpenAI 的 GPT-5.5 相抗衡。
上述進展發生在 SpaceX 以 600 億美元全股票收購 Cursor 的交易推進之際,標誌着馬斯克旗下 AI 版圖的加速整合。馬斯克還表示,SpaceX 在今年接下來的時間裏,每月都將發佈完全從頭開始訓練的新模型。
Gemini 3.5 Pro:重構底座,押注質量優先
谷歌方面,據泄露信息,Gemini 3.5 Pro 將於 7 月 17 日正式發佈。據科技媒體 Geeky Gadgets 報道,谷歌 DeepMind 放棄了原有的 2.5 Pro 基座,轉而對 Gemini 3.5 Pro 進行全新預訓練,發佈時間也因此從原定的 2026 年 6 月推遲至 7 月 17 日。
從能力表現來看,Gemini 3.5 Pro 的前端與視覺代碼生成能力據稱出現跨越式躍升,在多項測試中壓制 Anthropic 的 Fable 5,但在硬核推理與複雜工程任務上仍落後於對手。這一決策被外界解讀為谷歌在質量與速度之間主動選擇前者,以應對 OpenAI GPT-5.6 和 Anthropic Fable 5 的雙重壓力。
此外,谷歌同時被曝正基於這套新底座開發圖像模型 Nano Banana Pro,劍指 OpenAI 的 GPT-Image 2,意味着谷歌試圖在文本代碼與圖像生成兩條戰線同步發力。
DeepSeek V4:峯谷定價落地,推理提速並行
國內方面,DeepSeek 團隊於 6 月 29 日宣佈,V4 正式版計劃於 7 月中旬上線,並同步引入峯谷定價策略。根據公佈的價格表,高峰時段 API 價格為平時價格的兩倍,平時價格與現行 V4 API 定價持平。高峰時段界定為每日上午 9 時至 12 時及下午 2 時至 6 時,官方表示此舉旨在更合理地配置資源、提升服務穩定性。
技術層面,DeepSeek 於 6 月 27 日聯合北京大學發佈推理加速框架 DSpark,並同步開源全棧推測性解碼工具鏈 DeepSpec,論文由公司創始人梁文鋒本人署名。實測顯示,DSpark 部署後 V4-Flash 單用户生成速度提升 60% 至 85%,V4-Pro 提升 57% 至 78%,效果已在線上服務全量驗證。這也是 DeepSeek 完成 500 億元融資後首次對外發布的開源技術成果。
對 API 用户而言,峯谷定價將直接推高工作時段使用成本;對開發者而言,推理速度的顯著提升或可在高併發場景下部分抵消成本壓力,並進一步降低推理優化的落地門檻。
