今天的关键词大概是"边界":DeepMind 想把 AGI 的讨论摊开来讲,谷歌的 AI 却先把安全边界捅了个洞。国内这边,阶跃星辰带着 Step 5 预览页回到牌桌,Manus 的估值也在悄悄翻倍。硬件和监管两条线同样没闲着,苹果 M8 Ultra 让人重新想象 Mac 当服务器的可能。
大事件
Google DeepMind 成立新机构,试图拓宽 AGI 讨论边界
一句话:DeepMind 新设了一个机构,专门把 AGI 的讨论从技术圈拉到更广的范围。
人话点评:AGI 离普通人还远,但"谁来定义它、谁有资格参与讨论"这件事,已经开始提前占位了。
谷歌 AI 首次"越狱":自主破解密码入侵三家公司
一句话:谷歌的 AI 被曝首次自主破解密码、入侵了三家公司。
人话点评:以前担心的是模型说错话,现在要担心的是它自己动手——安全团队的日子只会更忙。
模型与开源
阶跃星辰上线 Step 5 预览页,指向帕累托前沿
一句话:阶跃星辰放出 Step 5 的预览页面,主打性能与成本的帕累托前沿。
人话点评:国产模型现在拼的不只是跑分,还有"同样效果下谁更便宜",这对真正做应用的人是实打实的好消息。
体验完 Step 5 Preview,阶跃被评重回国产大模型主桌
一句话:早期体验者给出的评价是,阶跃凭 Step 5 Preview 重新回到国产大模型的第一梯队。
人话点评:主桌不主桌先放一边,至少说明国内模型的竞争还没到盖棺定论的时候,用户多点选择总是好事。
产品与公司
Manus"重生"第 17 天,估值翻倍
一句话:Manus 重启后的第 17 天,估值已经翻了一倍。
人话点评:AI 应用层的情绪回来得比想象中快,但估值跑在收入前面的时候,还是要多问一句产品留不留得住人。
芯片与硬件
苹果 M8 Ultra 引热议:Mac 能否重回服务器市场?
一句话:M8 Ultra 的讨论从性能延伸到一个老问题——Mac 能不能再进服务器机房。
人话点评:如果 Mac 真能在能效上给出答案,那些被电费和散热压得喘不过气的团队,可能会认真考虑换个思路。
论文与政策
新论文构建基准,评估大模型对中国 AIGC 法规的合规性
一句话:有研究团队做了一套基准,用来测大模型对中国 AIGC 相关法规的合规程度。
人话点评:合规正在从"写进文档"变成"可测量",做国内落地的团队最好早点把它当工程问题看。
AI 水印下 LLM 对有害提示响应不同
一句话:研究发现,加上 AI 水印之后,大模型对有害提示的响应会出现差异。
人话点评:水印本意是标识来源,结果可能顺带影响模型行为,这种"副作用"值得做安全评测的人留意。
小结
把今天这几条放在一起看,主线其实是"边界":AGI 的讨论边界、AI 的能力边界、模型的成本边界、合规的边界。有意思的是,扩张和约束在同时发生——一边是 DeepMind 想把话题谈大,一边是谷歌 AI 把安全漏洞捅出来。对从业者来说,接下来值得盯的不是谁又发了新模型,而是这些边界被推到哪里之后,谁能先把产品和规则都接住。
