Reasoning models overtake chat models in traffic — the AI usage paradigm is shifting
推理(思考型)模型的 API 调用量首次超过普通对话模型,意味着开发者正在从“让 AI 写”转向“让 AI 想清楚再写”。价格下降与工具调用需求是两大推手。
What happened in AI today? English one-line summaries of the day's AI stories. Full editorial write-ups are currently published in Chinese; the live hot ranking is on the news board.
推理(思考型)模型的 API 调用量首次超过普通对话模型,意味着开发者正在从“让 AI 写”转向“让 AI 想清楚再写”。价格下降与工具调用需求是两大推手。
多家国产大模型厂商同步下调 API 推理价格,百万 tokens 最低进入“分时代”。降价被解读为对海外模型的正面价格攻势,也进一步压低了 AI 应用的创业门槛。
最新评测显示头部开源模型与闭源旗舰的综合能力差距已缩至 3% 以内,而推理成本只有后者的十分之一。开源不再是“平替”,而是多数场景的更优解。
具身智能赛道单月融资额再创新高,一家头部人形机器人公司单轮融资超 10 亿元。投资人把 VLA(视觉-语言-动作)模型视为“下一个 ChatGPT 时刻”。
调研显示超过半数开发团队日常使用 AI 编程助手。招聘要求正从“会写代码”转向“会审 AI 的代码 + 会拆解任务”,初级工程师的定义被重写。
视频生成模型 + 角色一致性控制让 AI 短剧量产成为可能,单条播放破亿,制作成本据称为真人短剧的十分之一。影视行业的内容生产范式正在被改写。
长上下文与知识编辑技术正在挤压传统 RAG 的空间。共识判断是:RAG 不会死,而是退化为“检索层”,并入以 Agent 为中心的全新架构。
OpenAI 把内部用于评审推理模型的评估框架开源,支持自定义任务基准与过程奖励打分。评测标准化被视为 Agent 落地前的关键基建。
一份覆盖 12 个模型的实测显示:指令明确的多步工具调用任务里,小模型的成功率反超部分旗舰模型。上下文管理能力而非参数量,成为 Agent 的分水岭。
Cursor 后台 Agent 在独立环境异步完成完整任务并直接提交 PR,开发者工作流从“逐行补全”正式转向“任务委派”。
该问题的共识答案:来得及。学法从“学模型原理”转向“学会把模型用进自己的工作流”——场景化能力比算法知识更稀缺,也更保值。
多款国产 AI 视频生成应用同时进入海外多国 App 下载榜前十。视频生成被视为中国 AI 出海最成功的品类,复刻了短视频出海的路径。
NotebookLM 新增空间音频播客与可打断追问:上传资料即可生成双人播客对谈。被动学习材料的“音频化”成为 AI 学习场景的新入口。