一夜5条大消息!AI圈这48小时,信息量爆炸
2026-09-11
一天之内,5条大消息砸过来,AI 圈的编辑都排不开版了。
DeepSeek 开源新模型,顺手把价格打到地板;OpenAI 语音双线出击;英伟达拉着 Palantir 把 AI 塞进自家供应链;宇树的机器人,一个模型学会了 64 种活……
别慌。我把 9 月 10 日到 11 日最值得看的动态捋成一篇,3 分钟看完,聊天时够用一整周。👇
1.国产开源王炸:DeepSeek 把"性价比"刻进架构里
DeepSeek 正式开源 DeepSeek V4.1 Flash:552B 参数的 MoE 模型,采用全新的非对称 Causal-Encoder-Decoder 架构,输入激活仅 8B——参数看着吓人,实际跑起来只激活一小部分,成本天然就低。
更狠的是价格:闲时输入缓存命中价降到 0.02 元,输出 4.0 元;9 月 14 日起,所有 Pro 请求自动路由到 Flash 并按 Flash 计费,相当于一次变相全面降价。
上下文窗口也从 4K 直接拉到 1M 百万级,腾讯 WorkBuddy、CodeBuddy 与 OpenCode 已全量接入,API 上线即可调用。
一句话总结:别人卷跑分,DeepSeek 卷价格和上下文天花板。
2.语音赛道开战:OpenAI 双线出击
第一条线:GPT-Live-1 上线 API。全双工对话,能处理打断、停顿、背景噪声,语音理解和输出整合进同一个模型,延迟更低;复杂推理交给后端文本模型。餐厅预订、客服电话这类语音智能体,直接有了现成底座。
第二条线:ChatGPT 语音模式支持调用 GPT-5.6 Sol 和 GPT-6 Astra。Pro 用户可以自选模型和推理强度,遇到搜索或复杂推理时系统自动切换。小提醒:每次转交底层文本模型,都计入消息额度。
看懂了吗?语音竞争已经不是"能听会说",而是往"能干活"进化。
3.编程与 Agent:卷完分数,开始卷成本
Cognition 发布 SWE-2:以 64% 更低的成本做到 Fable 5.1 同级表现,已上线 Devin 桌面端和命令行。编程模型的竞争,正在从"谁分高"转向"单位成本能干多少活"。
Qoder 上线 Sonus 模型:擅长长自主任务执行和电脑操作,配合桌面端可以直接操作电脑和专业软件,编程、金融建模、做表格,一条龙自主完成。
基元律动联合无问芯穹推出 Agent-Native 模型 NeoHorse-1:训练数据来自 Harness 结构化执行轨迹,多项 Agent 任务做到同规模 SOTA,提供 48 和 98 两个版本。
OpenAI 在 ChatGPT Work 上线 Data Agent:不用写 SQL,自然语言连接企业数据,直接生成分析和交互式 Dashboard,内部已经覆盖 600PB 数据。
Agent 这个词说了两年,这一周算是集体交作业了。
4.AI进企业:从发布会走向工位
Kimi 启动企业合作伙伴计划:联合 IT 服务商和集成商,共建前线部署工程师队伍,华胜天成、金山云、亚信、中软国际等已签约。大模型公司开始拼"地面部队"了。
英伟达联手 Palantir 搭建供应链运营 AI 技术栈,首批落地英伟达自身:需求预测、库存、排产,全上 AI。算力巨头先在自己产线跑通,再对外输出。
商汤小浣熊上线移动端:手机发指令、电脑持续执行,人不在工位也能远程查看、分享结果。📱
AI 不再只活在发布会 PPT 里,开始真正进车间、进工位。
5.具身与远期:机器人和经济学都动了
宇树公开人形机器人基础模型 UnifoLM-WLA-1.0:60 亿参数,完成 64 项操作任务训练,抓取、移动、装配一个模型搞定。具身智能的竞争,正从"单任务控制器"走向"统一基础模型"。
Anthropic 上线 AI 经济影响交互工具:用"任务包"分析法建模 AI 对 2030 年美国 GDP、工资与失业率的影响,温和、显著、极端三种情景随便推演。大模型公司开始用"可交互模型"向公众解释宏观影响了。