
Summary
ひと目でわかる要約
- オープンウェイトでも、事業形態と規模によって名称表示や別の商用契約が必要になる場合があります。
- AIの処理量はモデルとGPUだけでなく、系統接続、冷却、ネットワーク、メモリ供給の時期に左右されます。
- 業務AIは既存のデータと作業の中で役立ちやすい一方、狭い権限と成果測定が必要です。
資料基準:2026年8月9日午前、韓国時間 · 8月10日確認
新しいモデルを見ると、私はまず性能表を開いていた。今回のブリーフを技術の視点で読み直し、その順番を少し変えた。モデルカードだけ持って出発したら、ライセンス、電気代、メモリ、権限表がタクシーで後を追ってきた。結局、全員が同じ導入会議に座った。
要点は難しくない。AIサービスはモデル一つではなく、契約、計算資源、業務データ、制御がつながったシステムだ。
1. ライセンスも実行環境の一部だ
「オープンウェイト」は、主にモデルの重みをダウンロードできることを意味する。すべての商用利用が無料で無条件という意味ではない。
公開されているKimi K3ライセンスを見ると違いが分かる。モデル自体を第三者向けサービスとして提供する事業で、連続する12か月の合計売上が2,000万ドルを超える場合、別の商用契約が必要になる。月間利用者が1億人、または月間売上が2,000万ドルを超える商用製品は、Kimi K3の名称を目立つ形で表示しなければならない。社内利用と公式・認定パートナー経由の利用には例外がある。
Alibabaが将来のQwenで、大規模な商用利用者に収益分配を求める可能性も報じられた。ただし最終ライセンスはまだ公開されていないため、施行済みの規則ではなく方向を示す報道として扱う。
導入前に残す記録は四つだ。
- 受け取ったモデルとライセンスの正確なバージョン
- 社内利用、顧客向けAPI、SaaS再販売のどれに当たるか
- 売上・利用者基準や名称表示の義務があるか
- 派生モデルと再配布が許可されるか
downloadを押しても法務確認までは自動インストールされない。残念ながら、まだそのパッケージはない。
出典:Kimi K3公式ライセンス、Kimi K3公式リポジトリ
2. GPUの前には電力、横にはメモリがある
NvidiaがLanciumに最大30億ドルを投資する可能性があるという報道で、私が設計メモに確定事項として持ち込むのは、完了した投資ではなくインフラ規模だ。Lanciumはテキサス州AbileneのStargate 1に、1.2GWの承認済み系統接続容量があると公表している。
重要なのは依存関係だ。大規模クラスターはGPU、電力、冷却、ネットワークのどれか一つが不足しても、全体の処理量が下がる。GPU台数だけで性能と原価を計算すると、実際の請求額や稼働率とずれる。
メモリ供給もすぐには増えない。SK hynixは龍仁Y2と清州M17に合計54.3兆ウォンを投資すると承認したが、最初のクリーンルームは2029年6月と2028年12月の予定だ。その後も装置、歩留まり、顧客認証が続く。この投資を「すぐAIサービス価格が下がる」という意味には読まない。
私のTCO表には次を入れる。
- モデルとライセンス費用
- GPUとメモリ使用量
- 電力、冷却、ネットワーク費用
- 予約容量と実際の稼働率
- 供給遅延と代替インフラの費用
出典:LanciumのAbileneキャンパス、SK hynixのY2・M17投資発表
3. AIは別の窓より、今の仕事の中で見えやすい
Atlassianは2026年度第4四半期に、売上高17億6,600万ドル、クラウド売上高12億1,300万ドルを記録した。MCPサーバーとTeamwork Graph CLIの月間利用者が100万人を超えたとも発表した。
この決算だけでAI機能ごとの売上効果を分けることはできない。それでも設計上のヒントはある。Jiraの課題、Confluenceの文書、担当者、権限がすでにつながっている場所なら、仕事をすべて別のチャットにコピーせずにAIが手伝える。
便利になるほど権限設計は重要になる。エージェントが検索できる文書、編集できる課題、実行できるツールを、利用者と作業ごとに狭める。私は強い共有アカウント一つより、最小権限、短時間だけ有効な認証情報、実行記録を基本にしたい。
成果も利用量だけでは測らない。月間利用者と一緒に、作業完了率、人が直した量、エラーと事故、実際に短縮した時間を見る。AIが忙しく動くことと、仕事がうまく終わることは違う。洗濯機が2時間回っても、靴下の相方まで見つけてはくれない。
私が変えた導入の順番
以前はモデルを選ぶと、すぐAPIをつないだ。今は次の順番で確認する。
- 用途とライセンス: 誰がどの製品形態でモデルを使うか決める。
- データと権限: 読み取り、書き込み、実行範囲を作業ごとに絞る。
- インフラと原価: 電力、メモリ、ネットワーク、稼働率まで計算する。
- 評価と記録: モデル版、結果、人の修正、事故を再確認できるように残す。
- 止める方法: 費用や危険が基準を超えたら機能を停止できるようにする。
結論は、良いモデルを選ぶことと、良いAIサービスを運用することは別の問題だということだ。モデルはエンジン、ライセンスは利用条件、インフラは道路、権限はブレーキだ。ブレーキなしは映画では格好いいが、運用会議ではだいたい残業になる。
反応を残すと、重複防止のためランダムな識別子がこのブラウザーに保存される場合があります。

