关键要点
- Llama、Qwen、Mistral、Gemma都不是单一统一许可证——条款按模型检查点确定,同一系列的不同尺寸可能采用不同许可证。
- Llama社区许可证允许商用直至月活跃用户达到7亿;超过该阈值,Meta要求申请单独许可证,由其自行决定是否授予。
- Qwen和Mistral的大多数当前模型尺寸采用Apache 2.0(OSI认可,无使用规模阈值),但两者也都发布过更受限的研究或非生产许可证下的检查点。
- Gemma采用Google自定义使用条款,并结合单独的禁止使用政策——这是OSI认可开源许可证所不施加的基于行为的限制。
- 四种许可证均不包含针对第三方知识产权索赔对部署企业的赔偿条款——四者均"按现状"分发,不附任何担保。
- "开放权重"是描述这四个系列更准确的术语:权重可下载,但许可证至少未满足OSI开源定义的一项要求(使用规模限制、使用领域限制或行为政策)。
- 本文不构成法律建议。许可证文本会在模型版本之间发生变化——部署商用产品前请核实所用具体检查点的当前许可证并咨询律师。
这是法律建议吗?
不是——本指南不构成法律建议,也不能替代阅读许可证正文本身。 本文基于公开发布的许可证文档,在一般层面上概述了Llama、Qwen、Mistral、Gemma当前商用条款的结构。许可证条款会在模型版本之间变化,厂商也会在不总是更改许可证名称的情况下修订条款,而你部署的具体情况(营收、用户数、再分发计划、司法管辖区)会影响某一条款对你的适用方式。任何商用部署前,请阅读你计划使用的模型检查点所附的确切许可证文件,并咨询熟悉软件许可及你所在司法管辖区的合格律师。
"开放权重"与"开源"有何区别?
"开放权重"是指模型的训练参数可供任何人下载和运行;OSI意义上的"开源"还要求许可证不得对使用领域或被许可方的业务规模施加限制。 Open Source Initiative的开源定义明确禁止歧视特定活动领域或人群/团体的许可证——像Llama的7亿月活用户上限这样的使用规模阈值,即使权重本身可自由下载,也无法通过这一测试。
当某模型的许可证包含任何使用规模阈值、基于行为的禁止使用政策,或与特定商业活动挂钩的限制时,应准确使用"开放权重"这一表述——这适用于Llama、Gemma,以及任何以非Apache许可证发布的Qwen或Mistral检查点。将"开源"保留给真正以OSI认可许可证文本(如Apache 2.0或MIT)发布的具体模型尺寸——这适用于若干Qwen和Mistral检查点。
这一区分不仅是语义问题,也有商业意义:评估"开源AI"这一类别的采购或法务团队需要知道,这个标签并不保证不受限制的商用权利,实际条款取决于所部署的具体文件,而不是厂商的营销描述。
📍 简单一句话
如果模型参数可自由下载,该模型就是"开放权重";只有当许可证同时不施加使用领域或业务规模限制时,它才是OSI意义上的"开源"——这排除了Llama、Gemma以及若干Qwen/Mistral检查点。
💬 简单来说
可下载不等于无限制。请检查许可证是否附带使用上限或行为规范政策——如果有,在向法务团队说明时应将其归类为"开放权重",而非"开源"。
Llama的商用许可证条款是什么?
Meta以自己的Llama社区许可证发布Llama,允许大多数企业商用,但附加了OSI认可开源许可证所没有的使用规模阈值。 如果你的产品或服务(含关联公司)在相应Llama版本发布前一个月的月活跃用户超过7亿,标准许可证不再授权你使用该模型;你必须直接向Meta申请单独的商用许可证,Meta可自行决定是否授予或拒绝。
在该阈值以下,社区许可证允许商用部署、微调及构建衍生产品。近期版本历来在特定情形下要求署名(如"Built with Llama"或类似表述),并限制使用Llama或其输出来训练或改进Llama系列之外的竞争性大语言模型。Meta还维护一份单独的可接受使用政策,列出禁止的使用类别,其结构与下文Gemma的禁止使用政策类似。
7亿月活用户阈值是一种基于业务规模的限制,这正是Llama社区许可证不被视为OSI认可开源许可证的原因,即使在该阈值以下权重可自由下载——它属于上文所述的"开放权重"类别。
- 阈值:被许可方(含关联公司)的产品/服务在相应Llama版本发布日前一个月的月活跃用户超过7亿
- 超过阈值:须直接向Meta申请单独许可证;Meta自行决定是否授予或拒绝
- 署名要求:近期Llama版本在特定情形下要求"Built with Llama"或类似署名——请查阅版本特定的许可证文本
- 训练限制:部分版本限制使用Llama输出来训练或改进另一款竞争性大语言模型
- 可接受使用政策:与许可证本身并行适用的单独文档,列出禁止的使用类别
Qwen的商用许可证条款是什么?
阿里巴巴将当前大多数Qwen模型尺寸以Apache License 2.0发布——这是一种宽松、OSI认可的许可证,无使用规模阈值,仅需标准署名声明即可商用、再分发及构建衍生模型。 就其覆盖的尺寸而言,这是四个系列中对企业最友好的许可证。
例外之处很重要:阿里巴巴也曾将部分Qwen检查点——历来包括一些最大或最新的旗舰尺寸——以单独、更受限的自定义许可证(在Qwen自己的代码仓库中称为"Qwen License")发布,该许可证有自己的使用规模阈值,部分版本还要求在衍生产品中显示模型名称。由于许可证与检查点绑定,而非与"Qwen"整个品牌绑定,同一周发布的两个不同尺寸Qwen模型可能采用不同许可证。
在商用部署任何具体Qwen检查点前,请打开该模型在Hugging Face或ModelScope仓库中的LICENSE文件,而不要因为其他Qwen尺寸采用Apache 2.0就假定同样适用。
- 大多数尺寸:Apache License 2.0——无使用规模阈值,OSI认可,商用与再分发自由允许
- 部分旗舰/大尺寸检查点:采用单独的自定义Qwen许可证,附有自己的商用阈值——需按检查点逐一核实
- 署名要求:Apache 2.0仅要求保留标准声明/许可证;自定义Qwen许可证在部分版本中要求在衍生产品中显示模型名称
- 核查位置:具体模型的Hugging Face或ModelScope仓库中附带的LICENSE文件——切勿仅凭品牌名称假定
Mistral的商用许可证条款是什么?
Mistral AI已将当前大多数开放权重发布转向Apache License 2.0——与Qwen大多数尺寸采用的相同宽松、OSI认可条款——但公司的模型目录中仍包含以更受限的仅限研究或非生产许可证发布的模型。 Mistral已公开表示新发布模型总体转向Apache 2.0的趋势,但这一转变是逐个模型进行的,并不会追溯适用于该公司此前发布的每一个检查点。
采用Apache 2.0的模型可以商用部署、微调及以仅需标准声明的方式再分发。仍处于Mistral更受限的研究/非生产条款下的模型,未经与Mistral AI单独签订商用协议不得商用部署——对于许可证文件未明确注明Apache 2.0的任何Mistral检查点,在确认之前应视为非商用。
由于Mistral在不同发布中改变过许可策略,不要将此前部署过的某个Mistral模型的假设延续下来——每次评估新模型时都应重新核实该具体检查点的许可证。
- 当前趋势:大多数近期Mistral发布采用Apache License 2.0——商用、再分发及微调均自由允许
- 存在例外:部分模型仍处于更受限的仅限研究或非生产许可证下,需单独签订商用协议
- 默认假设:除非LICENSE文件明确注明Apache 2.0或同等宽松许可证,否则应将Mistral检查点视为非商用
- 每次发布重新核查:Mistral的许可策略随时间变化——请按模型核实,而非凭对以往发布的记忆判断
Gemma的商用许可证条款是什么?
Google以自己的Gemma使用条款发布Gemma,并配以单独的Gemma禁止使用政策,而非标准的OSI认可开源许可证。 在这些条款下商用一般是允许的,但许可证结构在采购或法务审查中一个重要方面不同于Apache 2.0或MIT:它包含基于行为的限制(禁止使用政策禁止某些使用类别,例如生成侵犯权利或助长违法活动的内容),且Google保留限制其认为违反这些条款的使用行为的权利。
这类使用领域或行为限制正是OSI开源定义所禁止的条款类型——这也是为什么无论权重如何被宣传,Gemma与Llama一样,严格来说属于"开放权重"而非"开源"类别的原因。
Google曾在公开发言及不同场合讨论过为其部分模型阵容采用更宽松许可方向的可能性。请不要将此类信号视为对你计划部署的具体Gemma版本或检查点已经确认适用——只有与该具体发布版本相绑定的条款才对你的使用具有约束力,而Google可能随时间修订使用条款及禁止使用政策。
- 许可证结构:自定义Gemma使用条款加单独的Gemma禁止使用政策,非标准OSI许可证
- 商用:在当前条款下一般允许,但须遵守禁止使用政策的行为限制
- 执行:Google保留限制其认为违反使用条款或禁止使用政策的使用行为的权利
- 版本敏感性:许可证条款可能在Gemma版本之间发生变化——请阅读你所部署具体版本的条款页面,而非旧版本的摘要
四种许可证如何对比?
这四种许可证结构没有任何两个是相同的,而在Qwen和Mistral内部,同一系列的不同检查点也可能采用不同许可证。 请以下表作为参考方向,部署前务必核实你所用具体模型的当前许可证文件。
| 模型系列 | 许可证类型 | MAU/营收阈值 | 再分发 | OSI认可? |
|---|---|---|---|---|
| Llama(Meta) | 自定义(Llama社区许可证) | 月活7亿+触发单独许可证 | 允许,需附"Built with Llama"署名 | 否 |
| Qwen(阿里巴巴) | Apache 2.0(多数尺寸)/自定义(部分) | Apache尺寸无阈值/部分有阈值 | Apache 2.0下自由允许 | 是(仅限Apache许可尺寸) |
| Mistral(Mistral AI) | Apache 2.0(近期多数)/研究许可(部分) | Apache 2.0模型无阈值 | Apache 2.0下自由允许 | 是(仅限Apache许可模型) |
| Gemma(Google) | 自定义Gemma使用条款 | 无公开MAU上限;有行为限制 | 在条款+禁止使用政策下允许 | 否 |
本表反映通常公开的许可证结构;具体检查点可能有所不同。请始终核实你计划部署的具体模型仓库中的LICENSE文件。
使用规模阈值何时限制商用?
使用规模阈值会在产品达到特定规模后,将许可证从"允许商用"转变为"需要单独许可证",而唯一公开了明确知名数字的是Llama:7亿月活跃用户。 Qwen在部分非Apache检查点上也使用过类似的阈值结构,历来常表述为月活跃用户与月营收的组合,但具体数字因许可证而异,应直接查阅原文而非凭假设。
应用场景:一家基于Llama许可模型构建面向客户产品的初创公司,在上线时无需担心7亿MAU阈值——只有当公司后来达到大多数初创企业永远不会达到的规模时,该阈值才具有相关性,法务团队应在那个增长阶段而非之前重新审视许可问题。
对于采用Apache 2.0许可证的检查点(大多数Qwen和Mistral尺寸),不存在任何使用规模阈值——无论公司规模或营收如何,许可证均允许商用。当你的商业模式预期高速增长、且希望避免日后重新审视许可问题时,这是一个有意义的区别点。
署名与再分发规则是什么?
署名要求从"除标准许可声明外无其他要求"(Apache 2.0)到"在特定情形下按名称署名模型"(Llama、部分Qwen检查点)不等。 再分发——将模型或其衍生物传递给第三方——在四种许可证结构下的当前主流发布中均获允许,但各自附有自己的条件。
如果你的部署计划涉及将微调衍生模型再分发给客户,或将模型嵌入转售产品中,请使用Apache 2.0许可的检查点(当前大多数Qwen和Mistral尺寸)——署名负担仅限于保留标准声明。对Llama和Gemma的衍生模型需格外谨慎:两者都要求衍生模型延续原始许可证的条件(对Llama而言,包括特定情形下的"Built with Llama"署名;对Gemma而言,包括遵守禁止使用政策),而Qwen的非Apache检查点也可能施加类似的传递要求。
何时不应假设再分发不受限制:如果你的产品将经过微调的Llama、Gemma或非Apache的Qwen/Mistral衍生模型嵌入销售给企业客户的SaaS产品中,请确认许可证的署名和传递条件是否适用于你具体的分发方式——仅限API访问、本地部署交付、以及打包软件,在这些许可证文本下各自引发略有不同的问题。
这些许可证是否包含赔偿或保证条款?
四种许可证系列均不为部署企业提供赔偿条款,四者均"按现状"分发,不附任何形式的担保——这在开放权重和开源许可证中普遍如此,并非某一厂商特有。 如果第三方日后就模型训练数据或输出提出知识产权主张,许可证文本并未要求Meta、阿里巴巴、Mistral AI或Google为部署该模型的企业进行辩护或赔偿。
这与部分商用闭源AI厂商构建企业协议的方式不同——后者有时会将针对知识产权索赔的有限赔偿作为付费层级功能提供。在评估用于知识产权诉讼风险较高场景的开放权重模型时,缺乏赔偿条款是一项真实的业务风险因素,需要与自建托管带来的成本节约和控制优势进行权衡——这是一项商业决策,不是一篇概述文章能替你做出的。
处于这种情形的企业通常通过自身的责任保险、与自身客户之间的合同风险分配,或将部署限制在第三方风险敞口较低的内部/非面向客户场景来管理风险——但这些都不能替代针对你具体情况的法律风险评估。
哪种许可证适合你的部署场景?
将你的部署场景与合适的许可证结构相匹配,然后在投入工程时间前核实检查点的确切许可证文件。
- ✅ 初创或中型企业,远低于任何使用阈值 → 从阈值角度看四个系列都可行;若希望在增长过程中不再重新审视许可问题,可优先选择Apache 2.0许可的Qwen或Mistral检查点。
- ✅ 构建可转售的白标产品,附微调衍生模型 → Apache 2.0许可的Qwen或Mistral检查点能最小化所发布衍生模型的署名和传递义务。
- ✅ 内部企业工具,不涉及面向客户的再分发 → 署名和再分发条款的重要性降低;即便是纯内部使用,使用阈值和担保免责声明仍然相关。
- ❌ 可能达到数亿月活跃用户规模的消费级产品 → 未经7亿MAU条款的法务审查、且没有接近该阈值时的应对计划,不要默认选用Llama许可模型;Apache 2.0替代方案可完全规避该问题。
- ❌ 知识产权诉讼风险较高、内部无风险容忍度的任何部署 → 这里没有任何开放权重许可证提供赔偿;在默认选用自建托管的开放权重模型前,评估提供合同赔偿的商用厂商是否更合适。
- 如不确定:从Apache 2.0许可的检查点(大多数Qwen和Mistral尺寸均可获得)入手,以消除使用阈值问题,并在上线前无论选择哪个系列都让任何商用部署计划经过法务审核。
最常见的许可证误区是什么?
大多数许可证问题源于把模型系列的品牌名当作许可证的代理指标,而不是阅读绑定在所部署检查点上的具体文件。
- 误区:笼统地假设"Qwen都是Apache 2.0"或"Mistral都是Apache 2.0"。纠正:核查具体检查点的LICENSE文件——两家公司都在Apache许可模型之外发布过非Apache模型。
- 误区:因公司当前规模远低于Llama的7亿MAU阈值而忽视它。纠正:将该阈值记入合规日历,并在任何重大增长阶段的法务审查中重新审视,而不是仅在自认为已接近时才关注。
- 误区:在向自己的法务或采购团队描述模型时,将"开放权重"与"开源"混用。纠正:对Llama、Gemma及任何非Apache的Qwen/Mistral检查点使用"开放权重";将"开源"保留给真正采用OSI许可证的检查点。
- 误区:将许可证摘要(包括本文)视为商用上线的充分签字依据。纠正:让最终决定经由法务人员审核,他们应阅读针对你具体使用场景的当前许可证文本——许可证文本会在版本间变化,过时的摘要在部署时可能已经不准确。
- 误区:假设一旦出现第三方知识产权索赔,这些厂商中的某一家会为你提供赔偿。纠正:明确确认许可证文本中不存在此类义务,并相应规划自身的风险缓解措施(保险、合同风险分配,或选择提供赔偿条款的商用厂商)。
部署前许可证核查清单是什么?
在基于任何Llama、Qwen、Mistral或Gemma检查点进行商用上线前,请完成以下核查清单。
- 1确定具体的模型检查点及其仓库页面
Why it matters: 许可证条款按检查点而非品牌确定——你需要的是具体文件,而非泛泛的摘要。 - 2完整阅读当前的LICENSE文件(以及任何单独的使用条款/可接受使用政策)
Why it matters: 摘要——包括本文——可能遗漏版本特定条款,或在你部署时已经过时。 - 3检查是否适用使用规模阈值,以及公司目前相对该阈值处于什么位置
Why it matters: Llama的7亿MAU条款及类似的Qwen阈值一旦超过,会彻底改变许可证结果。 - 4确认针对你具体分发方式(仅API、本地部署、打包)的署名要求
Why it matters: 同一许可证下,不同的分发方式可能触发不同的署名或传递义务。 - 5确认不存在赔偿条款,并记录自身的风险缓解计划
Why it matters: 四种许可证系列均不为部署企业提供赔偿——这需要自己的答案,而非假设。 - 6让最终的go/no-go决定经由熟悉你所在司法管辖区的法律顾问审核
Why it matters: 本指南不构成法律建议;最终签字应来自能够依据你具体情况阅读许可证的人员。 - 7设置日历提醒,在下一次重大版本升级前重新核查许可证
Why it matters: 厂商此前已在模型版本之间更改过许可证条款——今天有效的许可证不保证在你下一次升级时保持不变。
常见问题
本文是关于该使用哪种LLM许可证的法律建议吗?
不是。本指南基于公开发布的许可证文档,在一般层面概述了Llama、Qwen、Mistral、Gemma当前商用条款的结构。它不能替代阅读你所用模型检查点所附的确切许可证文本,也不能替代熟悉你所在司法管辖区和使用场景的合格律师的建议。
小企业无需联系Meta就可以商用Llama吗?
可以,只要企业(含关联公司)在其所有产品或服务中的月活跃用户少于7亿。低于该阈值,Llama社区许可证允许无需单独协议即可商用。超过该阈值,则必须直接向Meta申请单独许可证,由Meta自行决定是否授予或拒绝。
所有Qwen模型都采用同一许可证吗?
不是。阿里巴巴将当前大多数Qwen模型尺寸以无使用规模阈值的Apache License 2.0发布,但也曾将部分检查点——历来包括一些最大或最新的旗舰尺寸——以单独、更受限的自定义许可证发布。许可证绑定的是具体检查点,而非Qwen整个品牌,因此在假定适用Apache 2.0之前,请核实具体模型仓库中的LICENSE文件。
Mistral是否始终采用Apache 2.0许可证?
不是。Mistral AI已将当前大多数开放权重发布转向Apache License 2.0,但公司的模型目录中仍包含以更受限的仅限研究或非生产许可证发布的模型。除非LICENSE文件明确注明Apache 2.0或同等宽松许可证,否则应将任何Mistral检查点视为非商用。
Gemma的许可证算是开源吗?
严格按照OSI(Open Source Initiative)的定义来说不算。Google以自定义的Gemma使用条款配合单独的禁止使用政策发布Gemma,其中包含真正开源许可证下OSI开源定义所不允许的基于行为的限制。将Gemma描述为"开放权重"更为准确——参数可自由下载,但许可证附带的条件超出了标准开源许可证的范围。
LLM的"开放权重"与"开源"有什么区别?
"开放权重"描述的是训练参数可供任何人下载和运行的模型,无论所附许可证条款如何。OSI意义上的"开源"还要求许可证不得对使用领域或被许可方的业务规模施加限制。Llama、Gemma以及任何非Apache的Qwen或Mistral检查点属于开放权重,但严格来说不属于开源;采用Apache 2.0许可证的Qwen和Mistral检查点同时满足这两个定义。
如果有人就训练数据或模型输出提起诉讼,这些厂商中有谁会为我提供赔偿吗?
不会。四种许可证系列均"按现状"分发模型,不附担保,也都不包含针对第三方知识产权索赔对部署企业的赔偿义务。这在开放权重和开源许可证中普遍如此。知识产权诉讼风险较高的企业应权衡选择那些有时会将赔偿作为付费企业功能提供的商用厂商。
使用Meta、阿里巴巴、Mistral AI或Google的模型时,我需要为其署名吗?
这取决于具体许可证。Apache 2.0许可的检查点(当前大多数Qwen和Mistral尺寸)仅要求保留标准声明/许可证,不要求在产品中可见署名。Llama在多个近期版本中曾在特定情形下要求"Built with Llama"署名;Gemma和部分非Apache的Qwen检查点也附有各自的署名或命名条件。请核实你所部署具体检查点的当前许可证文本。
自建托管这些模型会改变许可证条款吗?
不会——许可证约束的是模型本身,而不是你在哪里运行它。与使用同一模型的云托管API相比,自建托管不会改变底层许可证条件(使用阈值、署名要求或赔偿条款的缺失),但会改变数据驻留和自身基础设施责任等其他因素,这些是独立于模型许可证本身的法律考量。
这些许可证条款多久会变化一次?
比大多数企业预期得更频繁——Meta、阿里巴巴、Mistral AI和Google都曾在模型版本之间修订许可证条款,而某公司最新发布版本的许可策略不会自动追溯适用于仍在使用的旧检查点。这正是本文设定为半年更新周期的原因,也是上文核查清单建议在每次重大版本升级前重新核实许可证,而不是仅依赖一次性审查的原因。
在哪里可以找到原始许可证文本?
- Llama社区许可证(llama.com/llama3_1/license) — 官方许可证文本,包含7亿MAU条款;请始终核实你所部署模型的版本特定页面
- Qwen模型仓库(huggingface.co/Qwen) — 每个检查点的仓库都包含各自的LICENSE文件;切勿在未核实的情况下假定适用Apache 2.0
- Mistral AI模型发布(mistral.ai/news)及Hugging Face仓库 — 请核实与具体模型卡片绑定的许可证
- Gemma使用条款(ai.google.dev/gemma/terms)及Gemma禁止使用政策(ai.google.dev/gemma/prohibited_use_policy) — 共同规范Gemma使用的两份文档
- Open Source Initiative——开源定义(opensource.org/osd) — 本指南用于区分"开放权重"与"开源"的参考标准