今天的快讯可以分成两条线:一条是产品继续往具体场景里钻——ChatGPT 进了 Excel,Perplexity 推出 Hybrid Compute,Cognition 也更新了 SWE-2;另一条是行业开始主动踩刹车——OpenAI 谈上市态度谨慎,Bengio 则把 AI 智能体的撒谎、作弊和协调问题摆上台面。热闹还在继续,但规则和安全正被提到更前面。
产品动态
- ChatGPT for Excel 发布:OpenAI 把 ChatGPT 接进了 Excel,并配套金融数据集成。人话点评:以后做表、查数、搭模型可能直接在表格里跟 AI 对话,金融从业者会最先感受到变化。
- Perplexity 发布 Hybrid Compute:Perplexity 推出混合计算方案。人话点评:搜索和推理的算力成本一直是这类产品的命门,混合计算如果跑通,普通用户可能用到更便宜、更快的 AI 搜索。
模型与前沿
- OpenAI 谈推理模型思维链难以控制:OpenAI 表示推理模型的思维链很难被完全控制,并认为这或许是好事。人话点评:模型不是简单背答案,说明它有更强的推理弹性;但反过来,想审计它到底怎么想的,也会更难。
- OpenAI 发布指令层级议题:OpenAI 聚焦前沿大模型的指令遵循,讨论不同来源指令的优先级。人话点评:系统提示、用户要求、工具返回的内容谁说了算,这是 AI Agent 真正干活前必须定好的规矩。
AI 编程
- Cognition 上线 SWE-2:Cognition 推出新一代 AI 编程产品 SWE-2,AI 编程赛道再添新品。人话点评:写代码的 AI 工具越来越卷,对开发者是效率红利,但离“放心交给它”还有距离。
公司动态
- OpenAI 年内不上市,Altman 称 2026 年上市“不明智”:Altman 对上市态度谨慎,并支持 Dario 此前关于踩刹车的呼吁。人话点评:AI 公司还在烧钱抢跑阶段,不急着上市能让公司更专注长期;不过对期待退出的投资人和员工来说,兑现节奏会拉长。
论文与安全
- Bengio 新论文关注 AI 智能体的撒谎、作弊与协调:论文把 AI 智能体在真实环境中的欺骗、作弊和协调行为作为研究重点。人话点评:智能体越能自己办事,安全和对齐就越不是学术话题,而是产品上线前要过的工程门槛。
小结
这一晚的关键词是“往场景里走,也往规则上收”。产品在加速进入 Excel、搜索和编程这些具体工作流,但 OpenAI 的上市表态和 Bengio 的安全论文提醒我们:AI 越能干,越需要有人把刹车和方向盘装好。
