モデルは無料、データが賃料
オープンウェイトモデルが氾濫し、重みは平凡な商品となった。競争優位性は独占データとフィードバックループへ移行し、賃貸資産に変化した。韓国企業のクローズドドメインデータがなぜ真の堀なのかを検証する。
AI要約
Meta、Alibaba、DeepSeekなどのオープンウェイトモデルの公開により、モデルの重みは無料の商品と化した。競争優位性は、独占データとフィードバックループという「賃貸資産」へ移行しており、韓国企業が保有する医療、製造、物流などのクローズドドメインデータこそが真の堀となる。データをパイプライン化しないまま傍観する企業は、自社データの価値を賃料として徴収される側に回ることになる。
一週間で無料になったもの
2025年の一年間、MetaのLlama、AlibabaのQwen、DeepSeek、Mistralが次々と重みを公開した。かつて数千万ドルの資産だったモデルが、Hugging Faceから単にダウンロードするファイルになった。性能格差も縮小した。オープンウェイトモデルが数ヶ月の時差を置いてクローズドモデルのベンチマークに追いつくパターンが繰り返し現れた。
ここで止まれば平凡な結論に流れる。「AIが民主化された、今や誰でも良いモデルを使える。」半分だけ正しい言葉だ。重みが無料になったということは、重みがもはや堀ではないという意味だ。堀が消えたのではなく、場所を移しただけだ。
ビッグテックがモデルを公開する本当の理由
MetaがLlamaを公開したことを慈善と読めば誤読だ。モデルを無料で公開すれば、競合のクローズドモデルの価格が崩壊する。OpenAIがAPIで得ていたマージンも圧迫を受ける。Metaはそもそもモデルで稼ぐつもりはない。広告とレコメンドアルゴリズムで稼ぐ。だからモデルレイヤーをわざと原価まで引き下げ、競合の収益源を枯渇させる。商品化は事故ではなく戦略だ。
では、ビッグテックはどこで優位性を保つのか。三箇所だ。推論を回すインフラ、すなわちNVIDIA GPUとクラウドと電力が一つ。ユーザーがモデルとやり取りしながら残すフィードバックデータが二つ。特定ドメインでのみ生成される独占データが三つ。モデルの重みは誰でも複製できるが、数億人が実際に使って作る選好シグナルは複製できない。
OpenAIがChatGPTを無料で公開する理由もここにある。モデルで稼ぐのではなく、使用ログで次のモデルを育てる。ユーザーがまさにデータ工場なのだ。資本も同じ方向に動く。2024〜2025年の米国VC投資の重心は、ファウンデーションモデルスタートアップからデータインフラ、評価ツール、ドメイン特化アプリケーションへ移行した。モデルを新たに作る会社よりも、モデルに供給するデータとそのデータを精製する会社へ資金が流れた。Scale AIのようなデータラベリング会社の評価額がそのシグナルだ。
重みから賃料へ
資産の定義が変わった。以前の堀は「我々のモデルがより賢い」だった。今の堀は「我々だけが持つデータでモデルを継続的により賢く回すループを回す」だ。モデルは一度買えば終わる資産のように無料になり、データとフィードバックループは毎月更新される賃貸資産になった。賃料を払う側はデータを持たない者、受け取る側はデータを握る者だ。
この構造で危険な立場が一つある。他人のモデルの上に薄いアプリ一つを載せ、プロンプトで差別化しようとする会社だ。モデルは無料でプロンプトは複製されるため、これらには堀と呼べるものがない。データループを握る会社が同じ機能を吸収した瞬間に消滅する。
ここで強い反論が出る。「公開データがすでに溢れ、合成データまで注がれている。独占データの優位性はすぐに希釈されるだろう。」一理ある言葉で、一般的なテキスト領域では正しい。しかし、合成データはモデルがすでに知っていることを変奏するだけで、現実世界で測定しなければ得られないシグナルは作れない。手術室の実際の経過、工場設備の振動と不良率の相関、早朝物流動線の変数。これはシミュレーションではなく測定の産物だ。クローズドドメインのデータほど、合成では埋められない。
韓国企業は供給者か顧客か設計者か
最初の質問に戻ろう。韓国企業はこの競争で供給者か、顧客か、標準設計者か。ファウンデーションモデル競争では大半が顧客だ。そのゲームは資本とGPU規模ですでに決着がついた。しかし、データ賃貸経済に来れば話は変わる。
韓国が強い領域を見よ。医療は健康保険単一体系のおかげで、定型化された請求と処方データが一箇所に蓄積される。製造はSamsung Electronics、SK Hynix、Hyundaiの工程データが世界のどこにもない密度で積み上げられている。物流はCoupangの早朝配送運営データがそれ自体で学習不可能なドメイン資産だ。MetaもOpenAIも取得できない、測定でのみ生成されるクローズドデータだ。釜山だけを見ても、港湾物動量と船舶入出港データが港湾公社に蓄積される。これをモデルに供給できる形に精製すれば、それ自体が堀になる。
| 韓国の強いドメイン | 測定でのみ生まれるクローズドデータ | |
|---|---|---|
| 医療 | 健康保険単一体系 | 定型化された請求・処方データ |
| 製造 | サムスン電子・SKハイニックス・現代自動車 | 世界最高密度の工程データ |
| 物流 | クーパン早朝配送 | 学習不可能な運営データ |
前提は一つだ。データを資産として扱う会社だけがここに該当する。データを単にERPに埋もれさせ外部APIに依存すれば、韓国企業は自社データで作られたモデルをかえって賃料を払って借りる立場になる。供給者になれる資産を握りながらも顧客に甘んじることになる。
傍観のコスト
シリコンバレーのニュースは他人事ではない。モデルが無料になったというヘッドラインの裏には、競争優位性がデータ賃料へ再編されたという構造変化が敷かれている。この変化が韓国企業の次のコスト構造を直ちに決定する。自社ドメインデータを精製してループを回す会社は賃料を受け取る側に立つ。傍観する会社は毎月賃料を払う側に立つ。モデルが無料になったから安心するという判断が最も高くつく判断だ。今データパイプラインを敷かなければ、1年後には他人のループの中で自社データの価値を賃料として換算される。
この記事はAIが韓国語の原文を自動翻訳したものです。正確な内容は韓国語の原文をご確認ください。
韓国語の原文を読む →