开源模型追平闭源:综合差距缩至 3% 以内
最新评测显示头部开源模型与闭源旗舰的综合能力差距已缩至 3% 以内,而推理成本只有后者的十分之一。开源不再是“平替”,而是多数场景的更优解。
一份覆盖知识、推理、代码、数学与指令遵循的聚合评测显示:头部开源模型与闭源旗舰的综合分差缩至 3% 以内。
差距没有消失的部分集中在:超长上下文的精准检索、复杂 Agent 任务的稳定性,以及多模态的边缘案例。这意味着追求极致能力的场景仍会选闭源,但绝大多数应用场景里,开源模型的能力已经够用。
成本侧的对比更悬殊:同档推理价格约为闭源旗舰的十分之一,且可私有部署规避数据合规问题。企业落地的默认选项正在从“闭源 API”转向“开源自托管 + 闭源兜底”。
本文为编辑摘要与评述,原始报道见 量子位。 版权归原出处所有。
继续阅读
推理模型调用量首超对话模型,AI 使用范式正在切换
推理(思考型)模型的 API 调用量首次超过普通对话模型,意味着开发者正在从“让 AI 写”转向“让 AI 想清楚再写”。价格下降与工具调用需求是两大推手。
国产大模型降价潮:推理价格再降 50%
多家国产大模型厂商同步下调 API 推理价格,百万 tokens 最低进入“分时代”。降价被解读为对海外模型的正面价格攻势,也进一步压低了 AI 应用的创业门槛。
具身智能融资热:人形机器人公司单轮融资超 10 亿
具身智能赛道单月融资额再创新高,一家头部人形机器人公司单轮融资超 10 亿元。投资人把 VLA(视觉-语言-动作)模型视为“下一个 ChatGPT 时刻”。