一句话:开源模型(open-source model)把权重、代码甚至训练细节交出来,让你能自己下载、部署、改;闭源模型(proprietary model)只给你一个接口,内部怎么做的看不见,也搬不走。
打个饭馆的比方。闭源模型是去餐厅吃饭——点菜、付钱、吃完走人,味道再好你也拿不到厨房。开放权重(open weights)像买了个料理包,可以带回家自己加热、加料,但包装背面写着一行小字:“仅限自家食用,不得转售、不得拿来复刻同款。”真开源则是连菜谱、食材清单、火候记录都给你,你爱怎么改怎么改,改完还能开店卖。
问题就出在中间那层。市面上大量被叫做“开源”的模型,严格说只是开放权重,许可证是自己写的,不是 MIT、Apache 2.0 这类经过 OSI(Open Source Initiative,开源促进会)认证的标准开源许可证。
| 维度 | 闭源模型 | 开放权重 | 真开源 |
|---|---|---|---|
| 你拿到什么 | 只有 API / 产品 | 权重,可能含推理代码 | 权重 + 代码 + 训练细节 |
| 能否自己部署 | 不能 | 能 | 能 |
| 能否商用 | 按服务条款 | 看许可证,常有条件 | 通常可以 |
| 能否改完再发布 | 不能 | 常有限制 | 可以 |
| 许可证形态 | 商业协议 | 自定义社区许可证 | MIT、Apache 2.0 等 |
许可证里的门道,主要看这几处:
- 商用门槛。有的许可证按用户规模或营收划线,小团队免费用,做大了要单独谈。具体数字以官方许可证原文为准。
- 禁止蒸馏。不少许可证写明,不许用它的输出或权重去训练别的模型。
- 衍生品约束。改了再发布,可能要求沿用某个名字、加署名,或者把改动也一并公开。
- 用途限制。有的只授权研究用途,商用要另签协议。
- 版本不一致。同一家公司的不同模型,许可证可能完全不同,别按印象套用。
- 专利与责任。Apache 2.0 这类许可证含专利授权条款;自定义许可证往往把责任撇得很干净。
对从业者的实际意义:选型时别只看跑分和价格,“能不能商用、能不能改、改了能不能发”是三条硬杠。请法务看 LICENSE 原文和模型卡(model card),别信二手转述。另外,开放权重不等于免费——权重不要钱,GPU 要钱。
对普通职场人:你用到的很多产品,背后可能跑着开源或开放权重模型,这对你的日常使用没影响。但如果公司打算把模型嵌进对外产品,采购前问一句“这个许可证允许我们这么用吗”,能省掉后面很多麻烦。
一句话收尾:开源闭源的分界线不在“能不能下载”,而在许可证允许你拿它做什么。判断标准只有一份,就是官方发布的那份许可证原文。
