StepFun 推出紧凑型 AI 模型,向中国的重量级竞争对手发起挑战
我是 LongbridgeAI,我可以总结文章信息。中国人工智能初创公司 StepFun 推出了其紧凑型 AI 模型 Step 3.5 Flash,声称该模型可以与国内竞争对手的大型模型相抗衡。该模型强调效率而非规模,在推理和基于代理的任务中表现优异,尽管其参数数量少于 Kimi K2.5 和 DeepSeek V3.2 等竞争对手。StepFun 对实际应用的关注得到了半导体公司的支持,而此次发布恰逢该行业产品发布的增加。最近,StepFun 获得了 50 亿元人民币的融资,反映出中国对小型 AI 模型日益增长的信心
中国人工智能初创公司 StepFun 推出了一款紧凑型 AI 模型 Step 3.5 Flash,称其能够与国内竞争对手的更大系统相抗衡,进一步加剧了中国快速发展的 AI 行业的竞争。
这家总部位于上海的公司将新发布的产品定位为证明效率而非单纯规模可以推动高级推理和基于代理的任务性能的证据。
StepFun 的模型以推理性能打破尺寸限制
StepFun 公司的 Step 3.5 Flash AI 的参数数量远少于一些竞争对手的产品,如 Kimi K2.5(1 万亿参数)和 DeepSeek V3.2(1 万亿参数)。
然而,Step 3.5 Flash 在多个基准测试中证明比那些更大的 AI 模型更有用,特别是在推理、计算机编码和创建智能代理(能够以不同智力水平执行任务的代理)的能力方面。
具体来说,Step 3.5 Flash AI 模型在四个不同的推理基准测试(AIME 2025;IMOAnswerBench 等)中取得了最佳结果,超越了 DeepSeek、Moonshot AI、Zhipu AI 和 MiniMax 产品线中的所有其他模型,唯一的竞争对手是微软的 OpenAI。
Kimi K2.52、DeepSeek V3.2 以及市场上许多其他 AI 模型在与 Step 3.5 Flash 的性能竞争中显得力不从心。参数是构成模型 “智能” 基础的单个信息片段,AI 模型中的大量参数通常与任务性能的提升相关联。
优先考虑逻辑、速度和代理
根据 StepFun 的说法,该模型的设计是经过深思熟虑的,包含了内置的权衡。CTO 兼联合创始人朱毅博表示,他们对实际应用的关注比单纯的头条规模更为重要,他在描述该系统在 AI 代理主导的世界中的整体目的时表示:“逻辑能力、上下文窗口大小和速度是我们最看重的。”
朱表示,他们设计该模型是基于对早期更大模型的经验,因为更大的模型训练时间更长,通常交付时间也比预期要长。
朱还在早前的帖子中表示:“Step 3.5 Flash 的优势来自于我们最关心的领域:其基于代理的行为将有效促进逻辑推理的发生。”
包括华为和 MetaX 在内的多家中国半导体公司已对其芯片的硬件进行了修改,以兼容 StepFun 的新硬件架构,显示出对该系统高效运行的信心。
此次发布的时机恰逢新产品和原型数量的增加,这些产品将在春节期间展示,同时中国公司也在开发或发布新技术。
阿里巴巴和 Moonshot AI 也宣布将发布其模型的更新;然而,Zhipu 和 MiniMax 仍在开发其产品。
最近,StepFun 在 B++ 融资周期中获得了 50 亿人民币(约合 7.2 亿美元)的资金。这轮投资包括政府资助的机构和其他知名公司,表明小型快速模型在中国 AI 市场中有潜力主导的信心日益增强。
让你的广告被看见。请在 Cryptopolitan Research 上投放广告,接触加密领域最敏锐的投资者和建设者。
