开源大模型的 License 地图:从 Apache 2.0 到「开放权重」的口诀

「权重挂上 HuggingFace、免费可下载」就等于开源大模型?按 OSI(Open Source Initiative)的尺子量,这顶多叫开放权重(open weights)。2024 年 10 月,OSI 发布 Open Source AI Definition(OSAID)1.0,给「开源 AI」立了硬标准:一套 AI 系统要配得上「开源」,必须给用户四种自由——任意用途使用、研究并检查组件、任意修改(包括改输出)、任意再分发;而且「偏好的修改形态」必须同时包含数据信息、代码、参数三件套,数据信息要细到「一个具备技能的人可以构建出实质等价的系统」。

按这把尺子量,多数明星模型都不达标:训练数据清单给不全、使用条款带附加约束,OSI 从未给 Llama 盖过章。Meta 当时公开唱反调,据 Time 2024 年 11 月报道,Meta 称「不存在单一的开源 AI 定义,定义它是个移动靶」。这场争论到今天(截至 2026-10-07)也没有共识收场——社区里「开源洗白」的批评仍在,越来越多发布说明则改用「开放权重」这个更诚实的措辞。

对工程团队来说,立场之争可以放一边,条款才是每天要用的东西。本文不谈商业模式(那另有一篇文章),只画一张协议地图:约束强度分三层,主流家族各就各位,最后给商用决策要点与实操清单。

三层谱系:真开源 / 带条件的社区协议 / 仅研究

第一层:真 OSI 开源(Apache 2.0 / MIT)。 用途不限、可商用、可再分发、可转授权,义务基本只有保留版权与许可声明(Apache 2.0 另有专利授权与 NOTICE 要求)。截至 2026-10-07,Qwen3 全系、DeepSeek-R1 与 V3-0324 之后的 V3 系列、GLM-4.6 与 GLM-5、Phi-4、Mistral Small/Devstral 等,以及 2026 年 4 月起改用 Apache 2.0 的 Gemma 4,都在这一层。

第二层:附加约束的社区协议。 免费商用,但夹带私货。代表是 Llama Community License:月活超 7 亿要向 Meta 单独申请授权;用 Llama 材料或其输出训练别的模型并分发,模型名必须以「Llama」开头;再分发要显著展示「Built with Llama」。旧版 Gemma Terms of Use(Gemma 1–3)也属此类:禁用清单(Prohibited Use Policy)作为条款流向下游,用 Gemma 蒸馏或合成数据训练的模型同样算 Model Derivative、照样受约束。

第三层:仅研究/非商用或纯开放权重。 Mistral Research License(Ministral 系列研究权重)、Mistral Non-Production License,以及各种 research-only 条款:商用免谈,进生产得找厂商另谈。只有权重、没附清晰许可的发布也归这层——能下载不等于有授权。

一句话口诀:开放的是权重,给的是条款;Apache/MIT 放心用,社区协议读三遍,研究许可别商用。

主流模型家族对照表(截至 2026-10-07)

模型家族 当前协议 关键限制 / 备注
Meta Llama Llama Community License(每代单发一份) 月活超 7 亿须向 Meta 申请授权(批准与否凭其酌情);衍生模型名须以「Llama」开头;须展示「Built with Llama」;多模态模型在 AUP 中对欧盟主体保留授权(终端用户除外)
Google Gemma Gemma 1–3:Gemma Terms of Use;Gemma 4:Apache 2.0 旧条款:禁用清单随协议流向下游、蒸馏/合成数据训练也算 Model Derivative、保留远程限制使用权;无月活/收入门槛;条款有版本更迭史
阿里 Qwen Qwen3 开源系列:Apache 2.0 例外在旧代:Qwen2-72B 等走通义千问协议(月活超 1 亿须申请授权)、Qwen2.5-3B 走研究许可;逐仓库核对为准
DeepSeek MIT(R1 起陆续切换,V3-0324 起权重全面 MIT) 无附加限制;官方蒸馏版随各自基座协议(Llama 蒸馏版仍受 Llama 协议约束);早期版本为 OpenRAIL 类协议
智谱 GLM GLM-4.6 / GLM-5:MIT 无附加限制;早期 ChatGLM/GLM-4 时代商用需登记授权,已成历史
Microsoft Phi MIT(Phi-4 系列) 无附加限制
Mistral 多数开放模型 Apache 2.0 Ministral 等走 Mistral Research License(仅研究)/ MNPL(非生产);个别新旗舰条款特殊,需查阅官方条款

表里是「家族当前主流」,同一家族不同代际、不同尺寸可能是不同协议——以各仓库 LICENSE 原文为准;查不到或含糊的,一律按「需查阅官方条款」处理,宁可多问法务,不要脑补条款。

商用决策的四个要点

月活门槛怎么算。 Llama 协议看的是「由被许可方或其关联方提供的产品或服务」在上一个日历月的月活是否超过 7 亿——算的是整个产品或服务的账,不是模型调用量,关联公司一并计入;通义千问协议(Qwen2-72B 等旧代)的门槛是 1 亿月活,口径类似。超线不会自动违法,但免费授权终止,得找厂商谈,而批不批写明「sole discretion(全凭酌情)」——谈判筹码要提前攒。

输出物归谁。 旧版 Gemma 条款明确「Google 对你用 Gemma 生成的输出不主张权利」,输出也不算 Model Derivative。Llama 协议的 Llama Materials 定义只覆盖模型与文档,但输出并不因此脱钩:拿输出训练别的模型照样触发命名义务,而免责声明条款明确把「任何输出及其结果」排除在 Meta 责任之外。多数协议的共同点是:输出归你,责任也归你。

微调产物继承什么。 微调后的权重——包括不合并回基座的 LoRA adapter(离开基座权重无法工作)——一般被认定为基座模型的衍生作品,随基座协议走。基座是 Apache 2.0/MIT,你的 adapter 可以自由授权;基座是 Llama,你的 fine-tune 也要带「Llama」名字前缀并附协议副本。现成的例子是 DeepSeek 官方蒸馏版:基于 Qwen 的蒸馏版随 Apache 2.0,基于 Llama 的蒸馏版仍受 Llama 协议约束——同一张模型卡下的两种命运。

「传染」是条款问题,不是版权法的自动结果。 版权法里没有「开源传染」这回事:Apache 2.0/MIT 本身没有 copyleft,衍生作品完全可以换协议。大家口中的「传染」其实是合同条款的流向——Llama 的命名与展示义务、Gemma 的禁用清单流向下游,都是你接受许可后承担的约定义务;范围多大、约束谁,全看条款怎么写。所以读条款,比背「这个协议传染不传染」有用得多。

工程团队的实操清单

  1. 选型前查模型卡 License 区:HuggingFace 的 license 标签只是速记,去读仓库里的 LICENSE 原文;同家族不同尺寸、不同代际可能是不同协议(Qwen2.5-3B 和同门兄弟拿的就不是同一张纸)。
  2. 留存协议副本:记下下载日期与协议版本。Gemma 条款有版本更迭史(官方按版本存档),Llama 每一代单发一份——半年后要自证合规时,「当时那张纸」就是证据。
  3. 三条常见红线:
    • 超规模部署未谈授权:月活逼近门槛前启动商务谈判,别等法务找上门;
    • 把「社区版」当无限制:命名前缀、「Built with Llama」展示、禁用清单流向下游,都是发布环节的硬要求;
    • 忽视可生成内容责任条款:协议免责声明普遍把输出责任划给使用者,旧版 Gemma 还保留远程限制使用的权利——生成内容的合规责任最终在自己。

趋势:条款是商业策略的函数

拉长时间看,协议一直在随商业策略摇摆。Llama 协议三年数改:Llama 2(2023-07)立下 7 亿月活门槛与品牌要求;3.1(2024-07-23)新增衍生模型命名条款;3.2(2024-09)起多模态模型在 AUP 里对欧盟主体保留授权(终端用户除外),Llama 4(2025-04)延续至今。反向的例子也有:Mistral Small 从研究许可转回 Apache 2.0,DeepSeek 从 OpenRAIL 类协议转向 MIT,GLM 从商用登记制转向 MIT,Gemma 4 干脆改用 Apache 2.0。每一次发新版本,协议都要重读一遍——它是商业策略的函数,不是法律文本的常数。

监管侧,欧盟 AI Act 给开源留了豁免,但口子很窄:通用目的模型(GPAI)不在豁免之列,OSI 与 Linux 基金会欧洲分会多次批评对社区开发者过苛;2025 年以来欧盟又在简化监管的压力下讨论放宽,态势未定。对使用方而言,协议与监管的双重变量,短期都不会消失。

回到开头:下次看到「开源大模型」五个字,先问一句——开放的是权重,还是权利?然后打开 LICENSE 文件,从第一行读起。

参考资料

  1. Open Source AI Definition (OSAID) 1.0 — OSI
  2. Llama 4 Community License Agreement(GitHub 原文)
  3. Llama 3.2 模型卡与 Acceptable Use Policy(EU 条款原文)
  4. Gemma Terms of Use — Google
  5. DeepSeek-R1 模型卡(License 区)
  6. Qwen2-72B-Instruct LICENSE(通义千问协议原文)
  7. 浅析 AI 大模型开源许可协议条款分析 — 金杜研究院
← 返回资讯列表

读者留言

COMMENTS 暂无
仅本站原创文章开放留言 · 请勿留下手机号、邮箱等个人信息

还没有留言,来说第一句?