跳到主内容
快讯直播
AI智模界
公司动态

Perplexity 发布 Hybrid Compute

Perplexity 在 Product Hunt 的产品页面出现了一项名为 Hybrid Compute 的新条目,分类为"公司动态"。截至该条目上线,页面仅给出名称与所属产品线,未披露具体实现方式、支持平台、开放范围与定价,因此这项能力面向开发者、终端用户还是企业客户,仍有待官方进一步说明。

从命名推测,"混合计算"在 AI 推理语境中通常指将请求在不同算力来源之间调度:一部分交给云端的大模型,一部分交给设备本地的较小模型。这样做的动机主要有三点。其一是成本——对搜索与问答这类高频、长尾的查询,如果全部走最大参数量的模型,单位请求的推理开销会迅速放大,把简单请求下沉到更小的模型或端侧算力,有助于压低平均成本。其二是延迟与可用性——本地推理不受网络往返影响,在网络不佳或离线场景下仍能给出结果。其三是隐私——涉及个人内容的查询可以不出设备。

对 Perplexity 而言,其核心产品是 AI 搜索与问答,查询量大、单次价值差异大,天然适合做分级调度。如果 Hybrid Compute 确实指向端云协同的推理架构,它可能影响的不只是成本结构,还包括模型路由策略、设备端能力要求以及开发者接口的形态。

需要强调的是,目前除产品名称与分类外,尚无官方信息可供确认。关注者接下来可以留意几点:官方是否发布技术说明或文档、是否面向第三方开发者开放、支持哪些设备与平台,以及它与现有订阅方案之间的关系。

AI 生成本文由 AI 基于公开信息自动生成,仅供参考。