我是 LongbridgeAI,我可以總結文章信息。OpenAI 正加速研發代號 Garlic 的新模型,以應對谷歌 Gemini 3 帶來的競爭壓力。內部測試顯示,其在編程與推理任務上已超越 Gemini 3 及 Anthropic 的 Opus 4.5。該模型整合了 Shallotpeat 的預訓練修復方案,能以更小規模實現更高效的知識注入,相關技術迭代使得 GPT-5.2 或 GPT-5.5 可能於 2026 年初亮相。不過,Garlic 仍需通過後續訓練與安全評估,其實際應用表現仍有待觀察。
OpenAI 正加速推進名為 Garlic 的新一代大語言模型,以應對近期在 AI 領域被認為落後於谷歌的競爭壓力,力圖重奪技術領先地位。
12 月 2 日,據知情人士透露,OpenAI 首席研究官 Mark Chen 上週在內部溝通中表示,Garlic 在公司內部評估中表現良好,至少在編程和推理等關鍵任務上的表現已超越谷歌 Gemini 3 及 Anthropic 的 Opus 4.5。公司計劃儘快推出其相關版本,這意味着 GPT-5.2 或 GPT-5.5 可能於 2026 年初亮相。
此次加速推進正值谷歌憑藉 Gemini 3 取得市場關注之際。此前有報道稱,OpenAI 首席執行官 Sam Altman 已啓動 “紅色警報”,要求全面提升 ChatGPT 能力。作為第一步,OpenAI 即將推出一款在內部評估中 “顯著領先” 於 Gemini 3 的推理模型。
Garlic 與前代模型的技術突破
Garlic 是一個獨立於 Shallotpeat 的新模型。Shallotpeat 是 OpenAI 正在開發的一種新的大語言模型,Altman 在 10 月告訴員工,Shallotpeat 將幫助 OpenAI 挑戰 Gemini 3。Garlic 包含了該公司在開發 Shallotpeat 的預訓練過程中使用的錯誤修復程序。
這一點至關重要,因為谷歌上月表示在開發 Gemini 3 時在預訓練方面取得了新突破,OpenAI 領導層也已承認這一點。Chen 表示,在開發 Garlic 過程中,OpenAI 解決了預訓練中遇到的關鍵問題,其中包括對其此前號稱 “最佳” 且規模更大的預訓練模型 GPT-4.5 進行優化,而該模型自今年 2 月發佈後便鮮少被提及。
實質上,Chen 稱這些改進意味着 OpenAI 可以將同等規模的知識注入體積更小的模型,而以前只能通過開發更大的模型才能實現。開發更大的模型顯然成本更高、週期更長。Chen 表示,基於此次開發 Garlic 所積累的經驗,OpenAI 已啓動下一階段更大、更強模型的研發工作。
發佈前仍需通過多重測試
Garlic 在正式發佈前仍需經過多個步驟,包括訓練後(向模型展示更多精心挑選的數據,以瞭解醫學或法律等特定領域,或如何更好地回應聊天機器人用户)、其他測試和安全評估。
目前,外界尚不清楚開發者在實際應用中會對 Garlic 作何評價。正如以往反覆出現的情況,在內部評估中表現優異是一回事,而在編程、數據分析等真實場景中穩定發揮則是另一回事。此前 GPT-5 的市場反應便是例證。
在目前相對逆境的競爭環境中,Chen 等 OpenAI 領導層也承擔着內部士氣凝聚者的角色,需要在團隊中傳遞信心並提振士氣。
