7 月 AI 大乱斗:国外 GPT-5.6、Grok4.5、Gemini 3.5Pro 轮流登场,国内 DeepSeek V4 正式版也来了!
Complete. Here is the key summaryOpenAI 旗舰 GPT-5.6 Sol 明日上线,定价每百万 Token 输入 5 美元;马斯克 Grok 4.5 同步公开,宣称性价比碾压 Opus 级对手;谷歌 Gemini 3.5 Pro 押注全新底座于 17 日亮相;DeepSeek V4 同步引入峰谷定价并推理提速逾 60%。一场横跨性能、成本与生态的全面角力,正式打响。
7 月全球 AI 大模型竞赛进入密集发布窗口期,国内外头部玩家几乎同步亮出新牌。
OpenAI 旗舰模型 GPT-5.6 Sol 定于本周四正式发布,马斯克旗下 SpaceX AI 宣布 Grok 4.5 也将于明日向公众开放,谷歌 Gemini 3.5 Pro 据悉将于 7 月 17 日上线,国内 DeepSeek V4 正式版同样锁定 7 月中旬。
短短数周内,多款顶级大模型密集落地,直接加剧了 AI 行业的竞争烈度,并对相关企业的商业化路径与定价策略产生深远影响。
对市场而言,此轮集中发布不仅是技术能力的比拼,更是各方在 API 定价、推理效率与生态整合上的全面角力。投资者需关注的核心问题在于:谁能在性能与成本之间找到最优解,并率先将技术优势转化为商业壁垒。
GPT-5.6 Sol:旗舰定位,分阶段开放
OpenAI 首席执行官 Sam Altman 周三在社交媒体宣布,GPT-5.6 Sol 将于本周四正式发布。这是 GPT-5.6 系列中的旗舰产品,搭载全新 ultra 多智能体模式与 max 推理强度,在编码、生物学和网络安全等核心基准测试中均刷新最佳纪录。

定价方面,Sol 采用每百万 Token 输入 5 美元、输出 30 美元的收费标准,位居 GPT-5.6 系列三款产品的最高端。OpenAI 同时宣布,将于 7 月在 Cerebras 硬件上推出 Sol,推理速度最高可达每秒 750 个 Token。
发布策略上,OpenAI 采取分阶段推进路线,初期仅向部分可信合作伙伴开放 API 和 Codex 访问权限,计划在未来数周内向更广泛用户普及 GPT-5.6 全系列。这一策略在控制服务压力的同时,也为竞争对手留出了一定的响应窗口。
Grok 4.5:马斯克加速整合 AI 版图
马斯克在社交媒体上宣布,基于 beta 测试阶段客户的强烈正面反馈,SpaceX AI 将于明日向公众开放 Grok 4.5。马斯克称,该模型属于 Opus 级别,但速度更快、Token 效率更高、成本更低。

据此前披露的信息,Grok 4.5 基于 1.5 万亿参数的 V9 基础模型打造,并在补充训练中特别加入了 AI 编程工具 Cursor 的数据。早期评测结果显示,该模型性能已接近甚至可能超越 Anthropic 旗舰模型 Claude Opus,强化学习仍在持续优化该模型。
值得关注的是,SpaceX AI 还与编程工具公司 Cursor 计划联合发布首款共同研发的 AI 模型,直接向 Anthropic 和 OpenAI 发起挑战。据 The Information 获得的一份内部备忘录,该模型此前曾因两家公司希望进一步提升运行效率而推迟发布,预计在某些指标上可与 Anthropic 的 Opus 4.8 及 OpenAI 的 GPT-5.5 相抗衡。
上述进展发生在 SpaceX 以 600 亿美元全股票收购 Cursor 的交易推进之际,标志着马斯克旗下 AI 版图的加速整合。马斯克还表示,SpaceX 在今年接下来的时间里,每月都将发布完全从头开始训练的新模型。
Gemini 3.5 Pro:重构底座,押注质量优先
谷歌方面,据泄露信息,Gemini 3.5 Pro 将于 7 月 17 日正式发布。据科技媒体 Geeky Gadgets 报道,谷歌 DeepMind 放弃了原有的 2.5 Pro 基座,转而对 Gemini 3.5 Pro 进行全新预训练,发布时间也因此从原定的 2026 年 6 月推迟至 7 月 17 日。
从能力表现来看,Gemini 3.5 Pro 的前端与视觉代码生成能力据称出现跨越式跃升,在多项测试中压制 Anthropic 的 Fable 5,但在硬核推理与复杂工程任务上仍落后于对手。这一决策被外界解读为谷歌在质量与速度之间主动选择前者,以应对 OpenAI GPT-5.6 和 Anthropic Fable 5 的双重压力。
此外,谷歌同时被曝正基于这套新底座开发图像模型 Nano Banana Pro,剑指 OpenAI 的 GPT-Image 2,意味着谷歌试图在文本代码与图像生成两条战线同步发力。
DeepSeek V4:峰谷定价落地,推理提速并行
国内方面,DeepSeek 团队于 6 月 29 日宣布,V4 正式版计划于 7 月中旬上线,并同步引入峰谷定价策略。根据公布的价格表,高峰时段 API 价格为平时价格的两倍,平时价格与现行 V4 API 定价持平。高峰时段界定为每日上午 9 时至 12 时及下午 2 时至 6 时,官方表示此举旨在更合理地配置资源、提升服务稳定性。
技术层面,DeepSeek 于 6 月 27 日联合北京大学发布推理加速框架 DSpark,并同步开源全栈推测性解码工具链 DeepSpec,论文由公司创始人梁文锋本人署名。实测显示,DSpark 部署后 V4-Flash 单用户生成速度提升 60% 至 85%,V4-Pro 提升 57% 至 78%,效果已在线上服务全量验证。这也是 DeepSeek 完成 500 亿元融资后首次对外发布的开源技术成果。
对 API 用户而言,峰谷定价将直接推高工作时段使用成本;对开发者而言,推理速度的显著提升或可在高并发场景下部分抵消成本压力,并进一步降低推理优化的落地门槛。
