阿里公布了其在全模态模型方向的最新进展,并确认 Qwen4 与下一代视频模型均处于训练阶段。这一信息指向两点:一是 Qwen 系列主力模型的迭代仍在继续,二是阿里在视频生成方向的投入并未停止,且下一代模型尚未到发布节点。
“全模态”通常指单一模型具备统一处理与生成文本、图像、音频、视频等多种模态信息的能力。相较分别训练语言模型、视觉模型与视频生成模型,全模态路线的价值在于让不同模态共享同一套表征与推理体系,从而支撑跨模态的理解与生成任务。阿里在这一方向披露进展,说明其下一代模型的定位不止于语言能力,而是面向多模态的统一建模。
就 Qwen4 而言,作为该系列的下一代型号,目前的状态是“训练中”,意味着能力尚未成型到可对外发布的程度。视频模型方面,下一代视频模型同样处于训练中,表明视频生成仍是阿里持续加码的技术线之一。
对关注者来说,这条消息的关键点在于状态本身。训练中的模型距离评测、开放体验与正式发布通常还有相当距离,尤其是全模态模型与视频生成模型,其训练成本高、周期长,中间还需要多轮对齐与安全评估。因此短期内更可能看到的是阶段性信息披露,而非立即可用的产品。
截至目前,阿里并未公布 Qwen4 与下一代视频模型的具体发布时间、模型规模与能力边界,相关细节仍需等待官方后续说明。
