推論がデバイスに降りてくる
2026年のチップに搭載されるNPUは新機能ではない。クラウドが握っていた推論とデータをデバイスに引き下ろす権力移動だ。韓国のデバイス製造業はこの再編において供給者に留まるのか。
AI要約
2026年のシリコンバレーのチップロードマップにはNPUが標準搭載され、AI推論がクラウドからデバイスへ移行している。この変化はコスト削減とデータ規制への対応が背景にあり、クラウド陣営とオンデバイス陣営の主導権争いが今後10年の課金構造を左右する。韓国企業はメモリ供給者の地位に留まらず、推論規格の標準設計者として参画しなければ、将来的にコスト構造を米国企業に決定される立場になる。
2026年のシリコンバレーのチップロードマップには同じ言葉が繰り返し登場する。NPU。ニューラルネットワーク演算のみを専門に担当するコアがモバイルSoCとPCチップに標準搭載されるようになった。Qualcomm、Apple、AMD、Intelは発表資料のたびに毎秒数十兆回の演算を前面に押し出している。
表面だけを見ればまた一つのスペック競争だ。より速いチップ、よりスマートなフォン。そう読めば核心を見逃す。
NPUが強化されるということは、推論がデータセンターを離れるという意味だ。これまでAIの応答はほぼすべてクラウドサーバーで生成されていた。写真を補正するにせよ、文章を要約するにせよ、データは一度デバイスを離れて誰かのGPUを経由して戻ってきた。
その往復が消えつつある。
ビッグテックはなぜ突然推論をデバイスに降ろそうとするのか。圧力は二つある。一つはGPUサーバーの推論コストがユーザー数に比例して爆発するということ。もう一つは、クラウドを経由するデータがすべて規制と訴訟の標的になるということだ。
ここで構図が分かれる。OpenAIとAnthropicは巨大モデルをクラウドに置いてAPIで販売する側だ。AppleとQualcommは小さなモデルをチップ内に入れてデータがデバイスを離れないようにする側だ。同じAIという言葉を使うが、掌握しようとするレイヤーが異なる。
クラウド陣営はモデルという頭脳を握る。オンデバイス陣営はユーザーのデータと接点を握る。両者のうち誰が標準を定めるかに、今後10年の課金構造がかかっている。
資本はすでに動いた。VC資金は巨大ファウンデーションモデル一箇所に賭ける代わりに、推論効率、モデル軽量化、エッジ展開スタックへと分散している。同じ性能をより安く、より近くで回す企業に資金が流れている。推論コストがすなわち生存ラインという計算だ。
この話がデータ主権に発展する地点がまさにここだ。推論がデバイスで完結すれば、機密データはそもそも国境を越えない。欧州が規制で強制しようとしていたデータのローカライゼーションをチップが物理的に解決してしまう形だ。クラウド依存が解ける一方で、データがどのチップ上に存在するかが新たな権力となる。
それでは韓国企業はこの再編のどこに立っているのか。供給者なのか、顧客なのか、標準設計者なのか。
サムスン電子とSKハイニックスはメモリとファウンドリでこの流れの基盤を敷いている。オンデバイス推論は高帯域幅メモリと低電力DRAMを必要とする。良いポジションだ。しかしそれは正確に供給者のポジションだ。チップとメモリは販売するが、その上で動くモデルとデータ規格は米国が定める。
反論は可能だ。部品供給も十分に大きな事業であり、標準を握れなくてもメモリシェアがすなわち交渉力だという見方だ。正しい指摘だ。ただし供給者のマージンは常に標準設計者が主導権を握る。NPU命令セットとオンデバイスモデルフォーマットを米国のチップ企業が握れば、韓国は良い部品を売る下請けの上位に留まる。
釜山ではこれを遠く離れた他人の争いのように見ることもできる。そうではない。釜山の製造業と物流が今後導入する産業用デバイス、検査装置、車両端末はすべてこのオンデバイス推論チップ上で動くことになる。そのチップの規格を誰が定めるかが、釜山の工場の次のコスト表を決める。
だから傍観のコストを計算すべきだ。今NPUの発表を製品ニュースとして流し読みすれば、3年後韓国は自国デバイスに搭載される推論規格を米国チップ企業のロードマップから通知される立場になる。シリコンバレーのチップ発表は他人事ではない。韓国企業が次に支払うコスト表の草案だ。今読まなければ、後で請求書として読むことになる。
この記事はAIが韓国語の原文を自動翻訳したものです。正確な内容は韓国語の原文をご確認ください。
韓国語の原文を読む →