重要なポイント
- 「オープンウェイト」とは、学習済みモデルファイルが公開されており誰でも実行できることを意味する — ライセンスがOpen Source Initiative(OSI)の定義を満たすかどうかについては何も語っていない。
- 厳密な意味での「オープンソース」は、Apache 2.0やMITなどのOSI承認ライセンスを必要とし、ライセンス自体に商用利用・事業規模・用途分野の制限がない。
- Llama(Meta)とGemma(Google)はオープンウェイトだが、OSI承認のオープンソースではない。両ライセンスとも重みに利用規模または行動に関する制限を付している。
- 現行のDeepSeek、Phi、GLM、gpt-ossのほとんどのリリースは真にOSI承認ライセンス(MITまたはApache 2.0)の下で配布されており、QwenとMistralも現行のほとんどのサイズで同様 — 必ず具体的なチェックポイントを確認すること。
- OLMoのような少数のプロジェクトは、重みだけでなく学習コードとデータも公開している — 「完全オープン」と呼ばれることもある、より稀なケース。
- 個人・ローカル利用の場合、この違いが実際の行動を変えることはほとんどない。商用製品・再配布されるファインチューン・SaaS展開の場合は、別途ライセンスが必要かどうかを左右し得る。
📍 一文で説明
「オープンウェイト」はモデルの学習済みパラメータがダウンロード・実行可能であることを意味し、厳密な意味での「オープンソース」はさらに、商用利用・規模・用途分野の制限がないOSI承認ライセンスを必要とする。
💬 簡潔に説明
ダウンロードできることは自動的にオープンソースを意味しません。モデルが商用利用・再配布・改名に自由だと思い込む前に、マーケティングページではなく実際のライセンスファイルを確認してください。
「オープンウェイト」はダウンロード可能なパラメータを意味し、自由な権利を意味しない
「オープンウェイト」とは、モデルを機能させる数値パラメータ(重み)が、誰でもダウンロードして実行できるよう公開されているモデルを指す。 それがすべての意味だ。モデルの構築に使われた学習コード、学習に使われたデータセット、正確な学習レシピ、あるいは付随するライセンスが外部の何らかのオープン性の基準を満たしているかどうかについては、何も語っていない。
実際には、ほとんどのオープンウェイトのリリースは、標準的なオープンソースライセンスではなく、提供元が独自に作成したライセンスとともに配布される。MetaのLlama Community LicenseとGoogleのGemma利用規約は、本サイトのモデル比較で最もよく見られる2つの例だ。両方とも重みのダウンロードと実行を許可し、ほとんどの組織に商用利用を許可しているが、標準的なオープンソースライセンスにはない条件を付している — Llamaは利用規模の閾値(月間アクティブユーザー数の上限。これを超えると別途契約が必要)、Gemmaは独自の利用規約に加えて行動に基づく禁止事項ポリシーを課している。
これらのいずれも「オープンウェイト」を悪い、または誤解を招く表現にするものではない — 実際に公開されている内容を正確に説明しているだけだ。問題が生じるのは、「オープンウェイト」が略式の表現で「オープンソース」と呼ばれてしまうときだけであり、これは2つの用語が異なる問いに答えているからだ。オープンウェイトは「このファイルをダウンロードして実行できるか」に答え、オープンソース(以下の厳密な意味)は「ライセンス自体が、利用規模や用途分野の落とし穴なしに外部のオープン性基準を満たしているか」に答える。
「オープンソース」はOSI承認ライセンスを必要とし、単なるダウンロード可能な重みではない
モデルが厳密な意味で「オープンソース」と言えるのは、そのライセンスがOpen Source Initiative(OSI)によって承認されている場合のみだ — OSIはオープンソースの定義を維持する組織である。 この定義は、活動分野による差別(例:「研究のみ無料、商用利用不可」)や特定の人々のグループに対する差別を行うライセンスを明確に禁じており、また利用者の事業規模に紐づく制限も禁じている。月間アクティブユーザー数の閾値のような利用ベースの上限は、重み自体が自由にダウンロード可能であっても、この基準を満たさない — これこそ、上記で説明したLlamaとGemmaが、広くダウンロード可能であるにもかかわらずOSI承認のオープンソースに該当しない理由だ。
真にオープンソースなローカルLLMリリースの大部分は、2つのライセンスでカバーされている:Apache License 2.0とMITライセンスであり、いずれもOSI承認済みで、商用利用・改変・再配布を、標準的な表示・帰属表示の義務のみで許可しており、利用規模や収益の閾値も課していない。あるモデルファミリーのライセンスページが、検討中の特定のチェックポイントについてこの2つのいずれかのライセンスを明記していれば、そのチェックポイントはここで説明した厳密な意味でのオープンソースである。
知っておくべき注意点として、Open Source Initiativeは別途オープンソースAIの定義も公開しており、これは寛容なコードライセンスにとどまらず、重みに関するライセンス条文だけでなく、学習データや学習プロセス自体についての実質的な透明性を求めている。この比較に挙げたモデルのうち、この、より高いハードルを満たすものはほとんどない。以下で扱うOLMoが、ここに挙げたファミリーの中では最も近い。この区別は本記事が詳しく扱う範囲を超えるが、ある提供元がモデルを「オープンソースAI」として宣伝しており、その主張が実際に何に基づいているかを確認したい場合には知っておく価値がある。
学習データまで公開する、さらに踏み込んだ一部のリリース
重みのみのオープン性と、完全にオープンなリリースは同じではなく、その間のギャップは通常、ライセンス文言ではなく学習データとコードにある。 下の比較表にあるモデルのほとんどはライセンスの意味でオープンソースであり — 重みはApache 2.0またはMITの下で配布されている — が、学習に使われたデータセット、正確なデータの組み合わせ、学習パイプライン自体は非公開のままだ。Allen Institute for AIのOLMoは、このリストの中で、さらに踏み込んだモデルの最も明確な例である:重みとともに学習コードと相当量の学習データを、Apache 2.0の下で公開している。このような追加のオープン性のレイヤーは、現在のローカルLLMの状況では実際にはかなり稀だ — あるモデルファミリーについての「完全オープン」という主張は、モデルカード上のライセンスバッジだけでなく、実際に公開されているデータセットと学習コードを指し示せるまでは、未確認のものとして扱うべきだ。
ローカルLLMライセンスの比較:オープンウェイト vs オープンソース vs 完全オープン
これらのライセンス構造は互いに同一ではなく、複数のファミリーはチェックポイントごとに異なるライセンスを採用している — ライセンスはブランドではなくモデルファイルごとに設定される。 この表を目安として使い、商用展開の前には必ず具体的なチェックポイントのLICENSEファイルを確認してほしい。
モデルファミリー | 提供元 | ライセンス | カテゴリ |
|---|---|---|---|
| Llama 3 / 4 | Meta | Llama Community License | オープンウェイトのみ(OSI未承認) |
| Qwen | Alibaba | Apache 2.0(大半)/ 独自(一部) | 大半はオープンソース — チェックポイントごとに確認 |
| Mistral / Mixtral | Mistral AI | Apache 2.0(大半)/ Modified MIT(一部) | 大半はオープンソース — チェックポイントごとに確認 |
| Gemma | Gemma利用規約 | オープンウェイトのみ(OSI未承認) | |
| DeepSeek | DeepSeek | MIT(現行フラッグシップ) | オープンソースライセンス(重みのみ) |
| GLM | Zhipu / Z.ai | MIT / Apache 2.0(現行の大半) | オープンソースライセンス(重みのみ) |
| gpt-oss | OpenAI | Apache 2.0 | オープンソースライセンス(重みのみ) |
| Kimi K2 | Moonshot AI | Modified MIT | オープンソース風、条項が1つ追加 |
| Phi | Microsoft | MIT | オープンソースライセンス(重みのみ) |
| OLMo | Ai2 | Apache 2.0 | 完全オープン — 重み・コード・データ |
この表は一般に公開されているライセンス構造を説明したものだ。法的助言ではなく、網羅的でもない:ここに挙げたいくつかのファミリー(Qwen、Mistral、そしてやや程度は低いがGLM)は、ファミリーの通常のライセンスより制限的な条件で特定のチェックポイントをリリースしており、ライセンス条件はモデルバージョンごとに変わる。Kimi K2のModified MITライセンスは通常のMITに条項を1つ追加しているため、「Modified MIT」がMITとまったく同じ振る舞いをすると思い込まず、実際に読むこと。展開予定の具体的なチェックポイントに紐づくLICENSEファイルを必ず確認すること。これらおよび他のファミリーにわたる商用利用条件のシナリオ別のより詳しい解説については、ローカルLLM商用ライセンスガイドを参照。
ライセンスが重要になるのは個人利用を超えた時だけ
チャット、コーディング支援、執筆、実験など、モデルを自分だけのためにローカルで実行している場合、オープンウェイトとオープンソースの区別が実際の行動を変えることはほとんどない。 上の比較表にあるすべてのモデルは、現行のライセンスの下で個人・ローカル利用を許可している。ダウンロードし、OllamaやIlama.cppで実行し、自分のマシン上で自分の目的のためにファインチューニングする限り、「オープンウェイト」と「オープンソース」の実際的な違いはほぼゼロだ。
この区別が重要になり始めるのは、他の人々のために何かを作り始めた瞬間からだ。 商用製品を出荷する、モデルを基にしたホスト型APIやSaaSを提供する、重み(ファインチューニングした派生モデルを含む)を再配布する、あるいはライセンスが定める規模の閾値(Llamaの月間アクティブユーザー数の上限やMistralの収益上限付きチェックポイントなど)に近づく場合、ライセンスのカテゴリが次に何を確認すべきかを示してくれる:Apache 2.0やMITのようなOSI承認ライセンスには通常このような落とし穴はない。LlamaやGemmaのようなオープンウェイトライセンスにはある可能性がある。
これは法的助言ではなく、ここでのライセンスの要約はいずれも、展開予定の具体的なチェックポイントに紐づく実際のライセンス文書を読むことの代わりにはならない。商用に関する判断を下す前に、必ず現行のライセンスを確認し、出荷前に弁護士に相談すること。
よくある質問
Llamaはオープンソースですか?
厳密なOSI承認の意味ではオープンソースではありません。Llamaはオープンウェイトです:パラメータは自由にダウンロードでき、ほとんどの組織で商用利用が許可されていますが、MetaのLlama Community Licenseは利用規模の閾値(月間アクティブユーザー数の上限)を追加しており、これはOpen Source Initiativeの定義が承認済みオープンソースライセンスにおいて認めていない内容です。
「オープンウェイト」とはどういう意味ですか?
モデルの学習済みパラメータが、誰でもダウンロードして実行できるよう公開されていることを意味します。学習コードや学習データが公開されているか、ライセンスが外部のオープンソース基準を満たしているかについては何も語っていません — これらの答えについては具体的なライセンス文言を確認してください。
DeepSeekを商用利用できますか?
DeepSeekの現行フラッグシップリリースは、利用規模の閾値なしに商用利用・改変・再配布を許可する通常のMITライセンスの下で配布されています。一部の旧DeepSeekチェックポイントは異なる、より制限的なライセンスの下でリリースされていたため、商用展開の前には必ず具体的なチェックポイントのLICENSEファイルを確認してください — これは法的助言ではありません。
本当にオープンソースなローカルLLMはどれですか?
現行のDeepSeek、Phi、GLM、gpt-ossのほとんどのリリースは真にOSI承認ライセンス(MITまたはApache 2.0)の下で配布されており、現行のQwenとMistralのほとんどのサイズも同様です。OLMoはさらに一歩進み、重みだけでなく学習コードとデータも公開しています — より稀な、完全オープンの事例です。
なぜGemmaはオープンソースとみなされないのですか?
Gemmaの重みは自由にダウンロードでき、商用利用も概ね許可されていますが、Googleは標準的なOSI承認ライセンスではなく、独自のGemma利用規約と別途の禁止事項ポリシーの下でこれを配布しています。この行動に基づく制限は、まさにオープンソースの定義が禁じている種類の条項であり、これによってGemmaはオープンソースではなくオープンウェイトのカテゴリに分類されます。
モデルを自分だけのためにローカルで実行する場合、ライセンスは重要ですか?
ほとんど重要ではありません。本記事で扱ったすべてのモデルファミリーは、現行のライセンスの下で個人・ローカル利用を許可しています。ライセンスのカテゴリが関係してくるのは、商用製品を構築する、重みを再配布する、あるいは具体的なライセンスが定める利用または収益の閾値に近づく時です。