跳到主内容
快讯直播
AI智模界
AI 午报

AI 午报|9月17日

今天的关键词大概是"算账":一边是实验室想给自己装内部审计,一边是苹果把 M 系列 Ultra 往服务器上搬。罗福莉在沉寂半年后露面,arXiv 上还有人开始认真算"每瓦智能"。看着零散,其实都在回答同一个问题——这件事到底值不值。 大事件 AI 实验室欲设内

阅读全文 →

最新文章

全部专栏
  1. 教程

    npm install 失败的 6 类原因与排查解决

    报错现象 npm install(或 npm ci)失败时,终端通常会在结尾吐出几行 npm ERR!。不同原因对应的原文差别很大,先对号入座: 网络类: npm ERR! code ECONNRESET npm ERR

  2. 教程

    EADDRINUSE 端口占用定位与释放实战

    遇到 EADDRINUSE 时,程序通常会告诉你类似 listen EADDRINUSE: address already in use :::3000 的信息。它不代表代码写错了,而是操作系统层面已经有一个进程占着这个

  3. 教程

    SQLite database is locked 报错的原因与解决

    报错现象 不同语言和工具里,这句话长得略有差别,但关键字都是 database is locked: text Python sqlite3.OperationalError: database is locked 命令

  4. 教程

    PM2 进程反复重启的排查顺序与实操

    PM2 的 restarts 计数一直涨、uptime 永远只有几秒,说明进程没能稳定跑起来。下面按「先看日志、再排路径、再看端口、最后看资源」的顺序走一遍。 报错现象 典型表现有几种,可以对照自己遇到的是哪一种: pm

  5. 教程

    nginx 502 Bad Gateway 排查完全指南

    502 是 Nginx 作为反向代理时最常见的错误之一。它不代表 Nginx 本身崩了,而是 Nginx 没能从上游服务拿到合法响应。这篇文章按"从外到内逐层排除"的顺序,把排查路径拆成可执行的动作,每条命令都能直接照抄

  6. 教程

    Docker 容器起不来?先查这 5 个地方

    容器"起不来"通常有三种表现:docker run 敲下去就返回一个容器 ID,但 docker ps 里找不到它;容器出现了,状态是 Exited 1 或者反复 Restarting;命令干脆直接报错,容器根本没被创建

  7. 教程

    国内服务器部署开源项目的网络问题处理

    适用场景 在境内机房的服务器上部署开源项目时,经常卡在三件事上:docker pull 拉不动镜像、pip/npm/go mod 装依赖反复超时、git clone 一个 GitHub 仓库要等十几分钟甚至直接断掉。这套

  8. AI 词典

    负面提示词:写了"不要",为什么反而出现

    一句话定义:负面提示词(Negative Prompt)是文生图扩散模型里和正面提示词成对使用的第二段文本,它不描述你想要什么,而是给采样过程提供一条"要远离的基线方向"。 它作用在哪一步 主流文生图模型用扩散(Diff

  9. AI 词典

    神经音频编解码:语音怎么变成一串 token

    一句话说清 神经音频编解码(Neural Audio Codec)是用神经网络把连续的音频波形压成一串离散 token,并能把这串 token 还原回声音的技术。RVQ(Residual Vector Quantizat

  10. AI 词典

    VAD:AI 怎么知道你说完了?

    一句话定义:VAD(Voice Activity Detection,语音活动检测)就是判断"这段音频里此刻有没有人在说话"的技术。它不关心你说了什么,只回答"有声还是无声、是不是人声"。 打个比方,VAD 像公司前台:

  11. AI 词典

    视觉投影层:多模态大模型的翻译官

    视觉投影层(Projector / Connector)是连接视觉编码器(Vision Encoder)和大语言模型(Large Language Model, LLM)的“翻译模块”:它把图像编码器输出的视觉特征向量,

  12. AI 词典

    算子融合:把多次计算合并成一次

    一句话定义:算子融合(Kernel Fusion)就是把模型里原本分开执行的多个算子(Operator),合并成一个内核(Kernel)来跑,减少中间结果的来回搬运和重复启动。 它为什么能快:在深度学习框架里,矩阵乘、加

  13. AI 词典

    CUDA Graph:把一串 GPU 小操作录成图再回放

    一句话定义:CUDA Graph 是 CUDA 提供的一种执行方式——把一连串 GPU 操作(kernel 启动、内存拷贝等)预先"录制"成一张有向无环图,之后每次只提交一次,就能整段回放。 为什么需要"录" CUDA

  14. AI 词典

    AllReduce(NCCL):多卡训练怎么把梯度对齐

    一句话说,AllReduce(全归约)是一种集合通信(collective communication)操作:每个参与者手里都有一份同样形状的数据,先按元素做同一种运算(最常见是求和),再把结果发回给所有人。在分布式训练

  15. AI 词典

    MFU:你买的算力,实际用了几成

    一句话定义 MFU(Model FLOPs Utilization,模型浮点算力利用率)指的是:一段时间里,模型计算真正消耗掉的浮点运算量,占这段时间内硬件理论峰值算力的比例。 换句话说——你花钱买的那张卡的算力,有几成