跳到主内容
快讯直播
AI智模界
AI 晚报

AI 晚报|9月25日

今天 AI 圈从芯片、模型到产品都有动静:平头哥端出“中国最强 AI 芯片”并开源,Gemini、苹果、YouTube 各自更新能力;Meta 一边被曝做 AI 硬件 Muse,一边靠 Manus 登顶和股价大涨抢镜。整体看,竞争正从模型本身往工具链、端侧和产

阅读全文 →

最新文章

全部专栏
  1. 教程

    把端侧小模型塞进骁龙智能眼镜:导出、量化与端侧实测

    假设手里有一个自研小模型 PrismML,参数量在亚十亿量级,输入是文本 token 或一小段音频特征,目标是让它在一副骁龙平台的智能眼镜上离线常驻推理。这件事的难点不在模型本身,而在"从 PyTorch 到眼镜上的二进

  2. 教程

    用 Mercury 2.5 跑扩散 LLM 高吞吐推理实战

    这篇能做出什么 跟着做完,你手上会有四样东西: 1. 一段能直接跑通的 Mercury 2.5 API 调用代码(curl 与 Python 两版)。 2. 一个参数扫描脚本,用来摸清「去噪步数 / 并行解码宽度 / 输

  3. 教程

    用 PCIe 消费级显卡优化 DeepSeek 推理实战

    多卡消费级机器跑 DeepSeek 这类大模型,很多人第一反应是"没有 NVLink,没救了"。实际情况往往不是这样:真正拖慢速度的,是没配对的内核、走错路径的通信,以及不合适的批处理参数。把这三件事理顺,同一套硬件常常

  4. 教程

    PixVerse R2 实战:单图到可交互实时视频流

    实时世界模型这条线,2024 年下半年起被反复提起,核心卖点就一句话:给一张图,你能"走进去",而且画面是当场生成的。PixVerse R2 属于这一类工具。它不是"输入提示词、等 30 秒出一段 5 秒视频"的批量生成

  5. 教程

    用 Lovable 做全栈 vibe coding:从一句话需求到部署上线

    适用场景 这套流程适合两类人:一类是能说清业务但不想从零搭前端、配数据库的产品同学或运营同学;另一类是会写一点代码、但每次做全栈项目都要花半天折腾脚手架和环境变量的开发者。目标很直接——把一句自然语言需求,变成一个带登录

  6. 教程

    vLLM + llm-d:多模型路由与缓存感知调度实战

    先把成果说清楚:搭完之后,Kubernetes 里会跑起多个 vLLM 模型副本,外部通过一个统一 Gateway 访问;请求按路径或域名路由到不同模型;llmd 的 Endpoint Picker Provider(E

  7. AI 词典

    合理使用(Fair Use):AI 训练数据能用多少别人的作品

    合理使用(Fair Use)是美国版权法下的一项抗辩规则:在满足特定条件时,未经权利人许可使用其受版权保护的作品,不构成侵权。 注意措辞——它是"抗辩"(defense),不是"许可"。你先用了,被起诉了,再拿它来辩护,

  8. AI 词典

    RPA:按剧本干活的机器人,跟会自己拿主意的智能体差在哪

    一句话定义:RPA(Robotic Process Automation,机器人流程自动化)是用软件模拟人在电脑上的操作——点击按钮、填表单、复制粘贴、下载上传——把规则明确、高度重复的流程自动跑完的技术。它没有实体机器

  9. AI 词典

    可访问性树:给智能体一条比截图更清晰的路

    一句话定义:可访问性树(Accessibility Tree)是浏览器或操作系统在渲染界面时额外生成的一棵语义树,它把界面元素描述成带角色(role)、名称(name)、状态和层级的节点,原本是给读屏软件用的。 它是怎么

  10. AI 词典

    GEO(生成引擎优化):让 AI 在答案里点到你

    一句话定义:GEO(Generative Engine Optimization,生成引擎优化)是一套让内容更容易被生成式 AI 搜索「读到、看懂、愿意引用」的做法,目标是出现在 AI 给出的答案里,而不只是排进搜索结果

  11. AI 词典

    单位经济学:每个用户、每千 token 到底赚不赚钱

    一句话定义:单位经济学(Unit Economics)是把生意拆到最小可重复单元——一个用户、一千个 token、一次 API 调用——去算这一单本身是赚还是赔。 为什么不看总账,要看"一单" 总量最容易骗人。月流水一千

  12. AI 词典

    算力折旧:GPU 几年折完,账就长什么样

    一句话:算力折旧(Compute Depreciation)就是把买 GPU、服务器花的钱,按预计使用年限摊到每一年,而不是在买入当年一次记完。 买一台服务器,钱是一次性付的,但它能干活好几年。会计上讲究"谁受益、谁承担

  13. AI 词典

    电力采购协议(PPA):给数据中心锁一份长期电费单

    一句话定义 电力采购协议(Power Purchase Agreement,PPA)是购电方和发电方之间签订的一种长期购电合同:未来若干年里,以事先谈好的价格买下约定数量的电。价格和电量提前写死,不随市场电价起落。 为什

  14. AI 词典

    液冷:风冷吹不动了,改用液体搬热

    一句话定义:液冷(Liquid Cooling)就是用液体而不是空气,把芯片和服务器产生的热量带走、排到室外的散热方式。 服务器里的 CPU、GPU 一通电就发热。传统做法是风冷(Air Cooling):芯片上压一块金

  15. AI 词典

    CoWoS 先进封装:AI 芯片的产能瓶颈

    CoWoS(Chip on Wafer on Substrate)是台积电主导的一种 2.5D 先进封装技术。一句话说:它把算力芯片(如 GPU)和高带宽内存(HBM,High Bandwidth Memory)先并排贴