オープンソースAIという言葉は、今やどこでも目にする。問題は、「オープンソース」と呼ばれているものの多くが、実際にはまったくオープンソースではないことだ。
AIモデルやAIプラットフォームを説明する言葉として、「プロプライエタリ」「オープンソース」「オープンウェイト」といった用語が使われる機会が増えている。ところが、これらはしばしば混同され、区別なく使われている。
この区別が重要なのは、どのラベルが付くかによって、次の四つが決まるからだ。(1)その技術を誰が管理するのか。(2)中身をどこまで見られるのか。(3)手を加えられるのか。そして、(4)法律上どこまでの使い方が許されるのか。
AIモデルを選ぶ企業にとって、こうした違いは、コストやカスタマイズのしやすさから、データの管理、透明性、特定の技術提供元への長期的な依存に至るまで、あらゆる面に影響しうる。
では、プロプライエタリAI、オープンソースAI、オープンウェイトAIとは、実際には何を指すのか。以下に、その違いを簡単に整理しておく。
ChatGPTなどのプロプライエタリAI、使い方は開発企業が決める
プロプライエタリAIとは、開発・販売する企業が自社の知的財産(IP)として所有しているアルゴリズムやツールのことだ。多くの場合、開発元はモデルそのものや学習データ、学習の仕組みの詳細を自社のサーバーにしまい込んで外に出さず、顧客にはAPI(外部のプログラムから機能を呼び出すための窓口)を通じて利用させる。最もわかりやすい例がChatGPTである。
プロプライエタリAIはクローズドソースAIと呼ばれることもあり、実質的には、その知的財産が企業の私有財産であることを意味する。販売されているものであれば、所有者が定めた利用条件を守るかぎり使うことができる。プロプライエタリのソフトウェアには、無料版が用意されている場合さえある(ここでもChatGPTが一番の例だ)。それでも、利用や配布、改変は所有者の管理下に置かれたままである。
真のオープンソースAIはまれ、Llama 3.1は該当せず
オープンソースは最も透明性の高い選択肢である。だが、AIの世界で本当の意味でのオープンソースはめったにない。
オープンソースとは、厳密には、ソースコード(プログラムの中身を人が読める形で書き表したもの)が自由に入手でき、誰でも好きなように使えることを意味する。
ところが実際には、オープンソースとうたわれているソフトウェアの多く、とりわけAI分野のものは、さまざまなライセンスのもとで提供されている。そして、そのライセンスが、使い方に実際に制限を課している。
たとえば、メタのCEOマーク・ザッカーバーグは、同社のAIモデル「Llama 3.1」を初の「フロンティア級(最先端水準)のオープンソースAI」と呼んだ。ところが、汎用AIの能力とリスク、安全対策について各国の専門家がまとめた「2026年国際AI安全性報告書」は、Llamaが公開されたときのライセンスには「制約の多いライセンス条件」が付いていたため、とてもオープンソースとは呼べないと指摘している。
オープンソースの定義を管理する非営利団体Open Source Initiative(オープンソース・イニシアティブ、OSI)によれば、真にオープンソースと呼べるAIシステム(オープンソースAI)は、利用者に四つのことを認めなければならない。どんな目的にも使えること、仕組みを調べられること、改変できること、そして他者と共有できることである。



