Kimi K3のオープンウェイトLLMは誰が使う?費用・危険性・企業の狙い

#AI#オープンウェイト#LLM#Kimi K3#Moonshot AI#ローカルLLM

モデル本体が置かれるデータセンターのサーバー列(夜)

この記事の内容を動画で見る

オープンウェイトなのに6500万の初期費用|使うのは誰か?【Kimi K3】

YouTubeで見る ↗

Kimi K3のオープンウェイトはなぜ無料なのか

2026年7月27日、中国のAI企業Moonshot AIが、最高性能クラスのAI、Kimi K3の本体ファイルを丸ごと無料のオープンウェイトで公開しました。誰でもHugging Faceから落とせます。

ただ、無料で配られたのは、いちばん高くつく使い方です。

まず、落としても、自宅の普通のパソコンでは動きません。 ファイルは1.56テラバイト。最高スペックのMacを12台つないでも載せられない。 読み込めるマシンは、GPU換算でおよそ6,500万円。

同じKimi K3を、同社のAPIで使うなら100人で月およそ39万円、一人あたり月3,900円で使えます。個人にとっては、無料のファイルを動かすより、有料のAPIで借りるほうが、はるかに安いのです。

ところがこのKimi K3のオープンウェイトは非常に人気があります。 公開の当日から、この無料のモデルを自社のマシンに落とし、自社のAPI商品として売り始めた会社もあります。米国のFireworks AI。

一方で、この無料のAIは、危険な依頼を断る仕組みを、取り外せるAIでもあります。

このオープンウェイトは回り回って個人の僕たちにも恩恵とリスクの両方をもたらします。

一つずつ紐解いていきましょう。

断らないAI——Kimi K3の安全分類器を外せるリスク

無料で配られたKimi K3は、頼まれた仕事を断らないAIでもあります。

ChatGPTやClaudeのような商用のAIは、サイバー攻撃の手伝いのような危険な依頼を断ります。断らせているのは、安全分類器と呼ばれる仕組みです。

ところが、オープンウェイトには、良くも悪くもそれが付いていないか、あったとしても取り外せます。悪意あるハッカーにとっては、Claude OpusやFableレベルにかなり近い、断らない最高レベルのAIが手に入るということです。

悪意あるハッカーは、攻撃に商用APIは使いにくい。記録も残り、安全分類器も付いているからです。ところがオープンウェイトモデルを利用するならば、誰の監視もなく、やりたい放題にできる。

一方で、断らないAIを必要としていたのは、攻撃する側だけではありません。 守る側にとっても要になり得ます。これは後半で説明します。

2026年7月27日のモデル公開は、最高性能クラスの断らないAIが、世界中の誰の手にも渡った出来事でもあるのです。

Kimi K3をローカルで動かす費用——500万円でも人間より遅い

CPUと大量メモリで組んだ自作機の内部

オープンウェイトのKimi K3は、自宅のパソコンでは動きません。

AIの学習結果を保存したファイルを、ウェイトと呼びます。これを丸ごと公開する配り方が、オープンウェイトです。Kimi K3のウェイトは合計およそ1.56テラバイト。同じオープンウェイトでも、OpenAIが公開したgpt-oss-120bは約61ギガバイトで、Kimi K3はその25倍です。

AIを動かすには、ウェイトをGPUのメモリーに読み込む必要があります。Appleでいま購入できるMacは、最大でも128ギガバイト。12台ぶんを足しても1.53テラバイトで、届きません。

載る最小の構成は、NvidiaのB300を8基積んだマシンからで、平均でおよそ6,500万円です。

次に足りなくなるのは、電気です。この機械は最大14.5キロワットを消費します。家庭向け契約の上限は6キロワットなので、その2.4倍の電力が必要です。 工場と同じ動力契約を引いて24時間動かせば、電気代は月およそ32万円になります。

安く済ませる道もあります。数値を粗い精度で保存し直して容量を減らす、量子化です。いちばん粗い1ビット版なら594ギガバイト。GPUを使わず、CPUと大量のメモリーで動かす自作なら、およそ500万円に収まります。

ただ、このやり方はものすごく挙動が遅い。 生成の速さは毎秒3から9トークン。日本語では1文字がおよそ1トークンです。人間の黙読速度は平均で毎秒18〜21文字程度。500万円かけた自作機は、人間が読むスピード以下でしか、文字を出力できません。

この無料のモデルは動かすだけで、最低でも500万円。 まともな速さで動かすなら6,500万円かかります。

だから僕の家には、無料で使えるKimi K3はまだ招かれていません。 多分ずっと招かれません。

実は、Kimi K3は公式からAPIとしても提供されています。 使った処理量だけを払う従量課金であれば、GPUも電気も自分で用意しなくていい。

約3,000文字の資料を読ませ、約1,000文字の回答を受け取って、一回およそ4円。一日50回、月20日使っても、一人あたり月およそ3,900円です。 サーバーを借りてオープンウェイトを落とすより、公式APIのほうがはるかに安い。

ただ、公式のAPIを利用する場合、送った文章は中国企業のサーバーへ渡ります。 それを許容できるかは各々の判断。

チャット画面で使うなら、月額のサブスクリプションがもっと安い。

標準的な有料プランは、ChatGPTもClaudeもKimiも月3,000円台。 上位プランだと、ChatGPT ProとClaude Maxは、月約1万6,000円と約3万3,000円の2段。Kimiも、月約1万6,000円と約3万3,000円です。 ほぼ同じ価格です。

一方、同じ3社のAPI価格は揃っていません。入力3に対して出力1でならすと、100万トークンあたりKimi K3が約982円、Claude Opus 5が約1,637円、GPT-5.6 Solが約1,841円。1.88倍の開きがあります。

3社の最高額が揃っているのは、Moonshot AIがサブスクでの顧客を積極的に取りにいっていないからだと考えられます。

使った分だけ払うAPIでは、渡した計算資源はその都度売上として回収できます。一方でサブスクは、AI企業にとっては基本的に収支の割に合わない。 OpenAIやグーグルほどの資本力があれば赤字を大量に垂れ流してユーザシェアを囲い込む戦略が取れますが、Moonshot AIに、その余裕はありません。

なので、LLMの能力でもブランドでも、OpenAIとAnthropicに負けていると分かっていながら、同じ3万3,000円でプランを出す。その条件で利用できるユーザーだけが来てくれればそれでいいのです。

使った分だけ払ってもらえる従量課金だけが、Moonshot AIの主戦場になっています。

Mac StudioでオープンウェイトLLMは動くのか

一世代前のKimi K2を自宅で動かした、興味深い実験があります。

米国の調査会社Creative Strategiesが2025年12月に公開したもので、Mac Studioを4台つなぎ、一世代前のKimi K2を毎秒25トークンで動かしました。Kimi K3は2.8兆パラメータなのに対し、Kimi K2は1兆パラメータのモデルです。 機材の合計はおよそ648万円、消費電力は450ワット未満。4台のメモリーを合計1.5テラバイトの一つの置き場として使い、価格と電力の問題を解決してみせた。個人に届く範囲では最も現実的な解答でした。

まあ、648万円が個人に届くかは、とっても疑問ではありますが…。

ところが、その中心部品だった512ギガバイトメモリーのMac Studioは、すでに販売されていません。5月には128と256ギガバイトも消え、いまMac Studioで選べる最大は96ギガバイト。理由は、AIの競争でメモリーが世界規模で高騰していることです。AIを自宅で動かしたい個人は、AI需要そのものに機材を奪われています。

米国の調査会社Artificial Analysisは、難関試験と実務課題9種でAIを採点した知能指数を公表しています。最上位のクローズドモデル、Claude Opus 5が61。オープンモデルの最高はKimi K3の57で、差は4点です。

オープンのLLMはクローズドにほぼ追いついた、という2026年の通説は、この4点差を指しています。

ただしその57は、1.56テラバイトを積めるマシンでの数字です。1台のMacに載る範囲での最高は、GoogleのGemma 4の29点。主語をオープンウェイトから自宅のPCで動くオープンウェイトに替えた途端、差は4点から32点に開きます。

自宅で動くAIとクローズドの最上位の差は、縮まるどころか開いている。

それでも、この動かし難い2.8兆パラメータのモデルは、世界中でニーズがあるのです。誰が利用しているのでしょう?

Hugging Faceの防御を拒否した安全分類器——GLM-5.2が選ばれた理由

侵入を受けた本番設備の監視ルーム(夜)

最高性能のオープンモデルAIを手元で動かす理由は、安さではありません。その利用の自由度です。

業務の効率化が目的なら、自宅のPCで動くオープンウェイトモデルを選ぶ理由はかなり薄い。 いわゆるローカルLLMと呼ばれるモデルですが、任せられるのはごくごく単純な作業だけですし、それでもかなりのメモリを食って、動きも非常に遅い。 一方で、その規模のAIはプロンプトインジェクション、つまり意図しない行動を引き起こさせるトラップに弱いというリスクもある。

ところが、2.8兆パラメータほどの、高性能オープンウェイトモデルだと、利用するユースケースがまるで違います。 2026年7月9日から13日にかけての約4日半、Hugging Faceの本番設備が、AIエージェントによる侵入を受けました。記録された攻撃者の操作は、約1万7,600件。動いていたのは、OpenAIがサイバー能力を測るために、安全分類器を外して走らせていたモデルです。 ここでは、その後の新情報を追加します。

Hugging Faceはこう説明しています。攻撃の解析はまず、Claude FableとOpusの公式APIに依頼した。ところがその解析は、規定の安全分類器によって阻まれた。安全分類器は、インシデントの防御者と攻撃者を区別できない。 この安全のための機構が、攻撃しようとしていることと、受けた攻撃を解析することを同じものとして見なし、依頼を拒否したのです。

Anthropicの公式文書にも、分類器は、善良なサイバーセキュリティ業務でも作動しうると書かれています。正当な防御の仕事で拒否されるのは、商用APIの仕様なのです。

救済措置はあります。Anthropicは審査つきの枠組みを持っていて、通れば組織単位で制限が緩む。申請は無料で、承認までおよそ2営業日という実務者の報告があります。承認が降りるまでは、使えないということ。

でもインシデントは、起こった瞬間にすでに有事です。実際に今回の侵入は4日半の間に、約1万7,600件の不正な操作がなされています。 2営業日かかる制度は、実際の有事には機能しません。

だから、Hugging Faceは、中国のオープンウェイトであるGLM-5.2を利用しました。自社の設備で動かせるGPUを大量に持つ同社は、このモデルのおかげで自社データを一切社外に出さずに処理しきりました。ウェイトは1.4から1.5テラバイトで、Kimi K3とほぼ同じ階級。 GPUを十分に積んだマシンを持っている企業なら、何の追加投資も必要とせず、電気代のみで解決できたわけです。

設備をすでに持つ企業にとっては、高性能オープンウェイトが、一つには守りの要になり得ます。 今回のケースでもオープンウェイトモデルを利用したのは、ClaudeのAPIに拒否され必要に迫られた大企業でした。 そしてこれからは中小企業でも大企業でも、多くの企業が必要とするかもしれません。 どう楽観的に予測しても、サイバー攻撃やセキュリティ被害は増えると予想されるからです。

これは今回のインシデントだけの話ではありません。 研究者はGLMのような中国製のオープンモデルに頼るか、それらを利用せざるを得ない状況に置かれている。セキュリティ企業RemoteThreatのChris Thompsonが2026年7月に出したレポートです。 正当な防御の担い手が、米国企業の管理するシステムから、中国企業の持つシステムへ移りつつあります。

第一章で見たとおり、断らないAIは、悪意ある攻撃者への贈り物でもあります。 一方で、その同じ断らないAIが、防御の現場では必需品でもあった。今回のKimi K3の公開で、守る側にも攻撃する側にも、同じ水準の断らないAIが開かれたことになります。

裏を返せば、安全分類器は有事の防御には不便ですが、その不便が、世界規模で有事の起こる確率を下げていたわけでもあります。

Moonshot AIはなぜKimi K3を無料公開したのか

2026年7月20日、Moonshot AIは、新しい会員プランの販売開始を、計算資源の不足を理由に延期しました。その7日後、同じ会社が1.56テラバイトのモデル本体を無料で公開します。売るほうは品切れでしたが、無料配布は躊躇なく実行されました。

これは矛盾しません。同社にとって、会員を一人増やせば、その人の質問に答え続けるGPUを同社が使い続けることになるからです。一方で、モデルの配布であれば、Hugging Faceにファイルを置くだけで、その後の運用コストは何もかかりません。

アメリカからGPU規制を受けている中国のAI企業にとって、希少なのはモデルではなく、計算資源の方なのです。

またモデルを配ったとしても顧客はほとんど失いません。 無料のウェイトを受け取っても、個人と大半の企業は自己運用へ移れないからです。

一方で、得るものは大きい。

一つ目は、計算資源の肩代わりです。 第三者が自分の計算資源でKimi K3を動かし、自分の顧客へ提供する。売上は第三者のものですが、GPUと電気代も第三者の負担です。その分、浮いたGPUを、次のモデルの研究開発に回せます。

二つ目は、地政学の問題でリーチできなかった層への訴求です。 中国企業のサーバーへ業務データを送れない企業や政府機関は、オープンウェイトがあれば自社のサーバーの中で動かせる。価格ではなく、サーバーを置く場所の問題で閉じていた市場が開きます。

実は、Moonshot AIが、オープンウェイトの方針へ切り替えたのは途中からです。 2024年、同社は、チャットアプリKimiの広告におよそ115億円を注ぎ込みました。 2025年1月20日、Moonshot AIは新モデルKimi k1.5を閉じたサブスクと公式APIとして公開しましたが、同じ日に、DeepSeekが推論モデルR1をオープンウェイトで公開しました。

結果として、世界の注目はR1に集中し、翌月、Moonshot AIは広告をほぼ全面停止します。 Kimiの月間利用者は、2025年のあいだに約2,165万人から約903万人へ半分以下に減りました。 同年7月11日、同社は初めてモデルを開き、以後の主力はすべてオープンウェイトです。同社のエンジニアは後に、能力こそが最良の広告だったと書き残しました。

Fireworks AIはKimi K3をどう事業化したのか

米国の推論事業者のデータホール

Kimi K3のオープンウェイトが公開され、即日にその運用を開始した会社があります。 米国の推論事業者Fireworks AIです。 公開の当日から、Fireworks AIがKimi K3を自社のサーバーで運用し始め、自社商品としてKimi K3のAPIを世界中に販売しています。

価格は、入力100万トークンあたり約491円、出力が約2,455円。 Moonshot AIの公式APIと同じ料金で利用できます。

こんなことが許されるのかと思うかもしれませんが、何の規約違反もありません。むしろ、Moonshot AIにとっては、これがオープンウェイト公開の戦略ですらあります。

Fireworksは、年間の売上が約1,600億円を超える米国の企業です。もちろん自社サーバーで運用しています。 ならば中国サーバーにデータが送られるリスクのせいで、モデルを使えなかった多くの西側企業が気兼ねなくAPIを利用できるようになります。 公式のAPIよりも、非公式のAPIの方が信用されるという逆転現象が起こっています。

Kimi K3はClaude OpusやFableに肉薄する性能にも関わらず、かなり格安で使えるモデルです。需要は世界中でかなり強い。 Fireworksは、Kimi K3に安全と信用を付加価値として付け、公式以上にユーザーに提供している企業であると言えます。 一方で、Moonshot AIにとっても、これでKimi K3が西側諸国にブランドとモデルの性能を実体験として知らしめることができます。

両者にとってwin-winなんですね。

また、自前で計算リソースを準備できる企業なら、得るものはもっと増えます。 オープンウェイトモデルは、自分のマシンで自在に動き、自社向けにファインチューニングすることさえ可能です。誰かが停止することも、値上げを通告することも、地政学のリスクもない。

そして、新しく始まった試みもあります。 今回のKimi K3のオープンウェイトには、一定の条件で効く条項がライセンスに書き加えられました。

会社の売上が連続する12か月でおよそ32億7,000万円を超えていて、モデルを他人に貸す事業をやるなら、商用に使う前にMoonshot AIと個別に契約を要する、と書いてあります。

条文が言う貸す事業とは、第三者に入力やパラメータを操作させる形で提供するもの。自社製品の機能に埋め込む場合や、他社のモデルへ要求を中継するだけの場合は外れます。

モデルを自社のマシンに載せて他人に貸す事業者だけを、狙って書かれている。

契約の中身は公表されていません。ただ、条文の形はこう推測することもできます。 無料で配って世界中に広げ、その上で商売になった事業者からは、個別にロイヤリティを取る。機械の代金は受け取った側へ移し、そこから上がる収益の権利は、配った側に残り得る。

オープンウェイトのKimi K3を自社で動かしたい企業はたくさんあります。 攻撃を受けて、自社の設備の中でしか解析できなかった会社。業務データを国外へ出せない企業と政府機関。自社のAIプロダクトのためにモデルをファインチューニングしたい会社。そして、潤沢な計算資源を持ち、Kimi K3を自社APIとして販売したい事業者。

無料で配られたのは、いちばんお金のかかる使い方でした。 ただしそれは初期投資がかかるという意味で、モデルの利用自体は本当に無料です。 計算資源やマシンをすでに自前で持っている企業にとっては、本当に無料で利用できるモデルが公開された。しかも自社向けにモデルそのものをチューニングすることもできる。

公開されたオープンウェイトモデルは、世界中の企業で様々な形で付加価値をつけて利用されるでしょう。 その恩恵も、断らないAIが攻撃してくるリスクも、回り回って僕たちにも届き得ます。

まあ、とりあえずは僕の家にはKimi K3を使う用事はないのですが…。

無料相談

この記事を、御社の判断に変える。

この記事の内容を御社に当てはめると、何を優先し、何を見送るべきか。
いま困っていることを伺いながら、30分で一緒に整理します。

  • 30分
  • オンライン
  • 売り込みなし
ご相談はこちらから

相談だけで終わっても、もちろん大丈夫です。

関連記事

続けて読む

すべての記事を見る →
  • 暖色の神経細胞と青い人工ニューラルネットワークが向かい合うイメージ

    AIはどこまで脳なのか? J-spaceと生命なき知能の現在地

    AnthropicがClaudeの内部で見つけたJ-spaceは、AIに思考の途中があることを示しました。しかし、脳は経験で変わりながら自己維持もします。人工ニューロン、ホメオスタシス、外部ハーネス、世界モデルを手がかりに、LLMが脳になれない理由と人間型AGIの限界を考えます。

  • ヒーローカット風に照らされた一匹のフグ(Sakana Fugu の象徴)

    Sakana AI「Fugu/Fugu Ultra」とは?性能・仕組み・使用感を解説

    2026年6月、日本のSakana AIがFugu/Fugu Ultraを発表。Claude FableやChatGPT5.5級のベンチマークを、単体の巨大LLMではなくマルチエージェント・オーケストレーションで示したこのAIの正体を、OpenRouter Fusionとの違いや使用感まで丸ごと整理します。

  • ブリュッセルの欧州委員会ベルレモン館と、前に並ぶEU旗

    EUのAI規制はなぜ始まったのか——OpenAI・AnthropicのハッキングとAI法

    OpenAIとAnthropicのモデルが隔離環境を抜け、現実のシステムへ侵入した事例から、AIのサイバー能力と社会インフラの脆弱性を考えます。EUのAI法が、なぜ企業の所在地ではなく検証可能な運用工程を規制し、一社だけでは止まれない競争へ介入するのかを整理します。