Equity research
2026.07.30 13:26

美银:AI 大语言模型

前沿领导力与基准测试

> 封闭模型仍占主导:专有(封闭)模型目前在最具挑战性的 AI 评估和基准测试中仍占据领先地位,包括 HLE、GPQA Diamond 和 SWE-bench。

> 性能差距:封闭模型与开放模型之间的性能差距在关键的企业价值池中最为显著,具体体现在代理工具使用、编码和复杂推理方面。

> 基准示例:顶级封闭模型如 Claude Opus 5、GPT-5.6 Sol 和 Gemini 3.1 Pro 在主要指标上优于 GLM-52、DeepSeek V4 和 Kimi K3 等开放替代方案。

采用曲线与标准

> 行业标准:封闭模型 API 作为行业的参考实现(定义聊天/补全形状、函数调用模式和评估规范),开放提供商经常模仿这些标准。

> 企业偏好:封闭模型在企业采用中占据主导地位,因为它们提供零基础设施负担、托管合规性、可预测的 SLA 以及单一供应商的责任。相反,自托管的开放模型将 GPU 配置和合规风险直接置于买方身上。

开放模型的性质

> 蒸馏担忧:与通过洁净室开发构建的 Linux 不同,领先的开放模型被广泛认为是通过蒸馏从封闭模型衍生而来的。例如,美国官员和实验室指控某些海外开放模型与美国前沿封闭模型存在联系。

> 风险:开放权重模型——其中许多源自中国——携带持续的知识产权 (IP) 和国家安全风险,可能会受到政府或封闭实验室开发者的严格监管或修改。

共存与市场展望

> 共存而非取代:预计长期市场结果将是类似 Windows 和 Linux 的共存模式,而不是开放权重完全取代封闭系统。

> 成本与能力:开放模型通常在成本和效率方面胜出(每令吉运行成本低 5–10 倍),而封闭模型在技术领导力、采用和企业信任方面胜出。

> 对半导体的影响:无论谁获胜,半导体需求都能受益:

如果封闭模型领先,前沿规模的训练和运行可能仍将高度资本密集。

如果开放模型普及,更低的令牌成本将推动更广泛的使用并激增整体推理量(杰文斯悖论)。

本文版权归属原作者/机构所有。

当前内容仅代表作者观点,与本平台立场无关。内容仅供投资者参考,亦不构成任何投资建议。如对本平台提供的内容服务有任何疑问或建议,请联系我们。