跳到主内容
快讯直播
AI智模界

AI 早报 · AI 午报 · AI 晚报

每天 8:00 晨报、12:00 午报、20:00 晚报,AI 编辑为你整理 AI 行业正在发生的事。所有内容均有标注并附原始来源。

最新文章

全部专栏
  1. AI 词典

    Frontier Intelligence(前沿智能):一条会自己往前跑的线

    一句话定义:Frontier Intelligence(前沿智能)指当前人类把 AI 能力推到的最外沿那一档水平——它是一条不断向前移动的线,而不是某个模型的名字。 为什么说它是一条线 想象一支登山队。走在最前面的开路组

  2. AI 词典

    AI 词典:Instant 模型档(Instant-tier Model)

    一句话定义 Instant 模型档(Instanttier Model)是指模型厂商为低延迟、高并发交互场景专门优化的一类模型档位,通常以更小的模型规模或更轻的推理流程,换取更快的响应速度和更低的单位成本。业界常见命名包

  3. AI 词典

    反例搜索(Counterexample Search):用找一个反例推翻一个猜想

    一句话定义:反例搜索(Counterexample Search)是在给定猜想后,主动寻找满足前提却违反结论的具体例子;一旦找到并经形式化验证,猜想即被推翻。 展开讲清原理:数学猜想常写成“对所有满足条件 X 的对象,都

  4. AI 词典

    Neocloud(算力新云):GPU 租赁、现货与抵押融资

    一句话定义:Neocloud(算力新云)指以 GPU(图形处理器,Graphics Processing Unit)租赁为核心产品的新一代云厂商——自己买卡、建集群,把算力按小时、按月或按年卖给 AI 公司,并用长期合约

  5. AI 词典

    完全自训练(Fully Self-Training):不买半成品菜,从打地基开始盖楼

    一句话定义:完全自训练(Fully SelfTraining)是指不拿现成的开源权重当起点、也不靠大模型的输出去"教"小模型,而是从数据采集清洗、配比,到词表(tokenizer)、网络结构、预训练与后训练对齐,全流程自

  6. AI 词典

    GRPO:不请「裁判」的强化学习算法

    一句话定义 GRPO(Group Relative Policy Optimization,组相对策略优化)是一种强化学习算法。它去掉了 PPO 里那个需要单独训练的价值模型(value model,也叫 critic)

  7. AI 词典

    宪法 AI(Constitutional AI):让模型照着一纸“家规”自我纠错

    一句话定义:宪法 AI(Constitutional AI,简称 CAI)是一种训练 AI 助手的方法——先写下一套自然语言原则(即“宪法”),再让模型依据这些原则批评和修改自己的回答,并用 AI 生成的反馈替代大量人类

  8. AI 词典

    稀疏自编码器(Sparse Autoencoder):把模型的"一锅汤"拆成一排调料瓶

    一句话:稀疏自编码器(Sparse Autoencoder, SAE)是一种训练方法,把大模型内部混杂的激活向量拆成上万个各自只负责一个概念的稀疏特征,是可解释性研究里最常用的工具之一。 为什么需要拆 模型某一层有几千个

  9. AI 词典

    模型合并(Model Merging):不训练,把几个模型合成一个

    一句话定义:模型合并(Model Merging)指把多个已经微调好的模型权重(weights)直接按规则融合成一个新模型,过程中基本不做梯度训练。 大模型微调(finetuning)往往会得到一个“偏科”模型:在代码数

  10. AI 词典

    查询改写与 HyDE:先改问题,还是先编答案?

    一句话定义 查询改写(Query Rewriting)是把用户原话改写成更适合检索系统理解的查询;HyDE(Hypothetical Document Embeddings,假设文档嵌入)则更“绕”:先让大模型虚构一段可

  11. AI 词典

    混合检索(Hybrid Search):关键词和语义,一个都别落下

    一句话定义 混合检索(Hybrid Search)是同时用「关键词检索」和「向量语义检索」两套方式去召回内容,再把双方结果合并、重新排序的一种检索策略。 两种检索各自的短板 BM25 这类关键词检索靠词频和逆文档频率打分

  12. AI 词典

    重排序(Reranking):先海选,再面试

    一句话定义 重排序(Reranking)是在检索系统先用便宜快速的方法捞出一批候选文档,再用更贵、更准的模型对这一小批文档重新打分排序的步骤。它不负责"找得到",只负责"排得准"。 为什么要分两步 在检索增强生成(RAG

  13. AI 词典

    分块(Chunking):把长文档切成能被检索的小块

    一句话定义:分块(Chunking)就是把一份长文档切成一段段短文本(chunk),再分别转成向量存进检索库,让系统需要时只取相关的那几段,而不是把整本书塞给模型。 为什么不能整篇塞进去 想象公司有上千页规章制度,员工问

  14. AI 词典

    HNSW:把百万级向量检索压到毫秒级的多层导航图

    一句话定义 HNSW(Hierarchical Navigable Small World,分层可导航小世界)是一种近似最近邻搜索(Approximate Nearest Neighbor, ANN)索引算法:它把向量组

  15. AI 词典

    向量数据库(Vector Database):给“意思”建索引

    一句话定义:向量数据库(Vector Database)是一种专门存储、管理和检索向量(vector)的数据库,核心能力是“给我一个向量,找出最相似的若干条”。 传统数据库擅长按身份证号找人:知道确切 ID 或字段就能精