AI news

What happened in AI today? English one-line summaries of the day's AI stories. Full editorial write-ups are currently published in Chinese; the live hot ranking is on the news board.

Reasoning models overtake chat models in traffic — the AI usage paradigm is shifting

推理(思考型)模型的 API 调用量首次超过普通对话模型,意味着开发者正在从“让 AI 写”转向“让 AI 想清楚再写”。价格下降与工具调用需求是两大推手。

Chinese LLM providers cut inference prices by another 50%

多家国产大模型厂商同步下调 API 推理价格,百万 tokens 最低进入“分时代”。降价被解读为对海外模型的正面价格攻势,也进一步压低了 AI 应用的创业门槛。

Open models close the gap: within 3% on aggregate benchmarks

最新评测显示头部开源模型与闭源旗舰的综合能力差距已缩至 3% 以内,而推理成本只有后者的十分之一。开源不再是“平替”,而是多数场景的更优解。

Embodied AI funding spree: humanoid startup raises over ¥1B

具身智能赛道单月融资额再创新高,一家头部人形机器人公司单轮融资超 10 亿元。投资人把 VLA(视觉-语言-动作)模型视为“下一个 ChatGPT 时刻”。

AI coding assistants pass 50% adoption; junior roles redefined

调研显示超过半数开发团队日常使用 AI 编程助手。招聘要求正从“会写代码”转向“会审 AI 的代码 + 会拆解任务”,初级工程师的定义被重写。

AI-generated short dramas go viral with 1/10 the cost

视频生成模型 + 角色一致性控制让 AI 短剧量产成为可能,单条播放破亿,制作成本据称为真人短剧的十分之一。影视行业的内容生产范式正在被改写。

Is RAG dead? Architecture after vector retrieval

长上下文与知识编辑技术正在挤压传统 RAG 的空间。共识判断是:RAG 不会死,而是退化为“检索层”,并入以 Agent 为中心的全新架构。

OpenAI open-sources its eval framework for reasoning models

OpenAI 把内部用于评审推理模型的评估框架开源,支持自定义任务基准与过程奖励打分。评测标准化被视为 Agent 落地前的关键基建。

Upset: small models beat flagships on agent success rate

一份覆盖 12 个模型的实测显示:指令明确的多步工具调用任务里,小模型的成功率反超部分旗舰模型。上下文管理能力而非参数量,成为 Agent 的分水岭。

Cursor ships background agents that finish tasks and open PRs

Cursor 后台 Agent 在独立环境异步完成完整任务并直接提交 PR,开发者工作流从“逐行补全”正式转向“任务委派”。

Too late to learn AI? Top answer: yes, but the way you learn has changed

该问题的共识答案:来得及。学法从“学模型原理”转向“学会把模型用进自己的工作流”——场景化能力比算法知识更稀缺,也更保值。

Chinese AI video apps top overseas download charts

多款国产 AI 视频生成应用同时进入海外多国 App 下载榜前十。视频生成被视为中国 AI 出海最成功的品类,复刻了短视频出海的路径。

NotebookLM spatial podcasts turn your notes into dialogues

NotebookLM 新增空间音频播客与可打断追问:上传资料即可生成双人播客对谈。被动学习材料的“音频化”成为 AI 学习场景的新入口。