今天的信息量不算大,但方向很清晰:一边是模型侧继续"上量",阿里系被曝下一代要从万亿往 5-10 万亿参数走;另一边是"数学 + AI"这条线突然热闹起来,OpenAI 挂了新小组的条目,陶哲轩也同步发了博客。另外 Product Hunt 上今天格外像模型发布会现场。
大事件
OpenAI 官网新增"数学与 AI 咨询小组"条目,陶哲轩同日发博客谈同一件事。
两边时间点对得很齐,基本可以确认是这个小组在公开亮相。
人话点评:数学家和前沿实验室开始正式"结对"了。对普通人来说短期没什么体感,但这批人做的事情,往往是几年后模型推理能力上限的天花板。
模型与开源
MiMo-V2.6 现身 Product Hunt,归在"模型"分类下;同时 Artificial Analysis 上线了 MiMo-v2.6-Pro 的评测页。
一个是曝光渠道,一个是第三方评测,基本是模型要露面前的标准动作。
人话点评:想尝鲜的可以先去 Artificial Analysis 看跑分再决定要不要动手,别只看 Product Hunt 的票数——那是热度,不是能力。
(小提醒:快讯里一处写 MiMo-V2.6、一处写 MiMo-v2.6-Pro,是不是同一版本还没定论,等官方说清楚更稳妥。)
Grok 4.7 也出现在 Product Hunt,同样归入"模型"分类。
和 MiMo 撞在同一天上同一个榜单,今天这页挺热闹。
人话点评:xAI 的迭代节奏确实快,但"上 Product Hunt"更多是营销动作,实际能力还是得等评测和真实用例来验证。
阿里研究员透露,Qwen4.5 之后的模型参数规模将扩到 5-10 万亿。
结合"下一代模型参数规模据称将达 5-10 万亿"的说法,指向的是同一件事。
人话点评:对从业者来说,这是算力账单和推理成本的问题,不只是榜单数字;对普通用户,短期内更该关心的是它能不能便宜、稳定地跑在你日常用的产品里。
阿里确认 Qwen4 与下一代视频模型都在训练中。
文字和视频两条线同时推进。
人话点评:视频模型这条线值得盯,它比文本模型更快地改变内容生产的工作方式——剪片子、做素材的人会最先感受到。
小结
今天没有颠覆性的大新闻,但两条线索挺值得记一下:一是"数学 + AI"这种偏基础的合作开始被摆到台面上,说明大家在做长线;二是国产模型继续往超大参数推进,同时视频模型也在排队。至于 Product Hunt 上的 MiMo 和 Grok,看看热闹就好,真正判断还得靠评测和上手。
