Moonshot AIは、1,048,576トークンのコンテキストを持つ2.8兆パラメータMoEモデルKimi K3の全ウェイトを、2026年7月27日にModified MITライセンスで公開します。kimi k3 open weightsの動向を追うMLエンジニア、クローズドモデルとの費用対効果を比較するテックリード、Hugging Face公開前に自前運用を検討するSRE向けに、タイムライン・仕様・ベンチマーク・API料金・ハード要件・業界インパクト・公開日チェックリストを整理します。結論:K3はClaude Fable 5の完全な置き換えではありませんが、Artificial Analysis Intelligence Indexで57.1(189モデル中3位)を記録し、タスク単価はFable 5比65.8%安、1Mコンテキストとオープンウェイトという独自の強みを持ちます。
SECTION 01 Kimi K3オープンウェイトでMLエンジニアが混乱しやすい5つの論点
- 公開日が二段階:7月16日にAPIとKimiアプリが先行稼働、7月27日にHF上で全ウェイト配布。検索意図が日付ごとに分かれるため、混同するとスニペット適格性を損ないます。
- オープンウェイト≠オープンソース:チェックポイントのダウンロードは可能でも、学習コードとデータセットは含まれません。用語の使い分けはr/LocalLLaMAやHNでの信頼性に直結します。
- 自前運用の見出しは半分しか語らない:4-bit量子化だけで約1.4TB、公式は64基以上のアクセラレータをスーパーノード構成で推奨。ノートPC運用は現実的ではありません。
- ベンチマークハーネスの影響:Moonshotは推論内容を返すハーネスへの感度と、曖昧な意図への過剰反応を公式に認めています。ベンダー横断比較には測定日と前提の明記が必要です。
- クローズドモデルは会話品質で依然優位:GDPval v2 EloやDeepSWEではFable 5とGPT-5.6 Solが上回ります。K3は持続コーディングと自動化ベンチで強み——ワークロードで選定してください。
SECTION 02 Kimi K3公開スケジュールと主要スペック
| 日付 | イベント |
|---|---|
| 2026-07-16 | API・Kimi App・Kimi Work・Kimi CodeでK3稼働開始。Artificial Analysisが同日に独立評価を公開 |
| 2026-07-17 | 上海WAIC開幕。新華社がK3を国家AIマイルストーンとして報道 |
| 2026-07-27 | Hugging Faceで全2.8Tウェイト(Modified MIT)+技術レポート(アーキテクチャ・学習・評価) |
| 項目 | 詳細 |
|---|---|
| 総パラメータ | 2.8兆(2.8T)——現時点で最大級のオープンウェイト |
| アーキテクチャ | スパースMoE——Stable LatentMoE、896エキスパート、トークンあたり16活性化 |
| アテンション | Kimi Delta Attention(KDA、ハイブリッド線形)+Attention Residuals(AttnRes)+Gated MLA |
| コンテキスト | 1,048,576トークン(約1M) |
| モダリティ | ネイティブビジョン(テキスト+画像)。製品版は動画理解を追加。出力はテキスト |
| ウェイト形式 | MXFP4ウェイト+MXFP8活性化(ネイティブ低精度学習) |
| スケーリング効率 | 同等計算量でK2比約2.5倍(公式主張) |
| 学習安定性 | Quantile Balancing(エキスパートルーティング)、Per-Head Muon最適化、SiTU活性化 |
| 長コンテキストデコード | 1MトークンでKDAにより最大6.3倍のデコード高速化 |
K3は約3Tクラス初のオープンウェイトモデルとして位置づけられ、クローズドソースの価格プレミアムに挑む設計です——全ベンチマークで全フラッグシップを凌駕するという主張ではありません。
SECTION 03 Kimi K3ベンチマーク:Claude Fable 5・GPT-5.6 Solとの比較
Artificial Analysis Intelligence Index(2026年7月16日計測):
| モデル | スコア | 順位 |
|---|---|---|
| Claude Fable 5 | 59.9 | 1 |
| GPT-5.6 Sol | 58.9 | 2 |
| Kimi K3 | 57.1 | 3 / 189 |
K3が優位または同率の領域:Frontend Code Arena #1(UIコードでFable 5・Solをブラインド評価で上回る);Automation Bench・SpreadsheetBench 2 #1;BrowseComp 91.2(#1、1M非圧縮戦略で90.4+);SWE Marathon 42.0(長時間コーディング——GPT-5.5・GLM-5.2は10台前半に急落);Terminal Bench 2.1 88.3(Sol 88.8に接近);Program Bench 77.8(Sol 77.6を僅差で上回る);FrontierSWE 81.2(Sol 71.3を大きく上回り、Fable 5 86.6には及ばず)。
K3が依然劣る領域:GDPval v2 Elo 1668–1687(Fable 5 1760、Sol 1748);DeepSWE 67.5(Sol 73.0);幻覚率はK2.6比で上昇(公式認定);Redditユーザーは自前ホスト環境で上位クローズドモデルより幻覚が多いと報告;対話の洗練度と単一セッションのばらつきはFable 5・Solに劣ります。
アーキテクチャの深掘りはKimi K3オープンソースLLMレビューを、別系統のオープンウェイト候補はDeepSeek V4 GA公開分析を参照してください。
SECTION 04 Kimi K3 API料金とキャッシュ込み実コスト
| 項目 | 価格 |
|---|---|
| 入力(キャッシュミス) | $3.00 |
| 入力(キャッシュヒット、自動) | $0.30 |
| 出力 | $15.00 |
中国系LLMベンダー中最も高い帯ですが、Claude Opus 4.8の単タスクコストよりは大幅に低くなります。Artificial AnalysisはK3のタスク単価$0.94を計測——GPT-5.6 Sol比9.4%安、Claude Fable 5比65.8%安です。コーディングワークロードではキャッシュヒット率90%超の報告もあり、表定価より実支出は低くなるケースが多いです。
SECTION 05 Kimi K3はオープンソースか?——オープンウェイトとオープンソースの違い
7月27日、MoonshotはHugging Face上で全2.8TウェイトをModified MITライセンス(正確な条項は公開日に確認)で配布し、技術レポート(アーキテクチャ・学習・評価)を同時公開します。KDAとプレフィックスキャッシュ対応のvLLMサポートがウェイトと同時期に届く見込みです。OllamaやGGUF量子化はK2シリーズの先例に沿ってコミュニティが追随する流れです。
用語の整理:K3はオープンウェイトリリース——ライセンス条項のもとでダウンロード・実行可能なチェックポイントを提供します。学習コードやデータセットを含むオープンソースではありません。コンプライアンスチームやis kimi k3 open source系クエリへの回答では、この区別を明示してください。
SECTION 06 Kimi K3をローカルで動かせるか——ハード要件と公開日チェックリスト
率直な答え:一般向けハードでは不可能です。4-bit量子化ウェイトだけで約1.4TB。公式はエキスパート並列+テンソル並列を組み合わせたスーパーノード構成で64基以上のアクセラレータを想定しています。参考:1TパラメータのK2.7 CodeはINT4で約577GB VRAM——K3は2.8倍の規模です。
自前運用が合理的なのは、(1)データレジデンシーまたはオフライン要件、(2)独自データでのファインチューニング、(3)API請求を上回る呼び出し量——のいずれかに該当する場合に限られます。それ以外は$3/$15 per M tokensのAPIが正解です。
- Hugging Face組織をウォッチ:7月27日前にMoonshot AIをフォローし、リポジトリ公開を即座に検知します。
- 公開日にLICENSE全文を確認:Modified MITは標準MITと異なる場合があるため、条項を必ず精読します。
- ウェイトシャードと量子化形式を検証:MXFP4バンドルとコミュニティのINT4/GGUF配布を確認します。
- vLLMリリースノートを追跡:KDA・プレフィックスキャッシュ対応コミットを本番前に固定します。
- 技術レポートから最小ハードを文書化:アクセラレータ数・インターコネクト・並列戦略をクラスタ予算と照合します。
- 長コンテキストテストを独自実施:1Mトークンデコードの主張は自社ハーネスで再現確認します。
- API vs 自前のTCOを比較:電力・ネットワーク・運用人件費・キャッシュヒット率をコーディングエージェント前提で試算します。
SECTION 07 7月27日ウェイト公開が業界に与える4つの意味
- オープンとクローズドの差がほぼ消失:Intelligence Indexの差は数百点から一桁ポイントに縮小——能力だけではクローズドベンダーのプレミアムを正当化しにくくなりました。
- 地政学の文脈:K3はWAIC 2026直前に登場。1か月前には米国がAnthropic Fable/Mythosモデルを一時デリスト(7月1日復帰)。ウェイトが公開されれば規制で「未公開」に戻すことはできません——オープンウェイト擁護の新論点です。
- 中国ベンダーの波:Z.ai GLM-5.2(Opus 4.8級コーディングを約1/5価格)、DeepSeek V4 Pro(1.6T)、MiniMaxなど——K3はこのサイクルの頂点です。
- Moonshotの再浮上:2025年初頭のDeepSeek R1ショックで国内7位に後退した後、K2→K2.5→K3のオープンウェイト路線で信頼を回復しました。
SECTION 08 引用可能な技術データと一次情報源
- パラメータ:2.8T総量;MoE 896エキスパート、トークンあたり16活性
- コンテキスト:1,048,576トークン
- Intelligence Index:K3 57.1 / Sol 58.9 / Fable 5 59.9(AA、2026年7月16日)
- タスク単価:K3 $0.94——Fable 5比65.8%安
- API:入力$3ミス / $0.30ヒット / 出力$15 per M tokens
- 自前ストレージ:4-bitで約1.4TB;64基以上のアクセラレータ推奨
- ライセンス:Modified MIT(7月27日に全文確認)
- コーディングハイライト:Frontend Code Arena #1;SWE Marathon 42.0
公式・独立評価の参照先——上流更新後はリンクを再確認してください:
Artificial Analysis — Intelligence Indexとコストベンチマーク(2026年7月16日)
K3オープンウェイトはフロンティア級AIの経済性を変えますが、Xcodeプロジェクトのコンパイル、iOSバイナリ署名、Metalシェーダのデバッグまでは担いません。仮想化macOSスタックはEULAリスクと測定可能なオーバーヘッドを伴います。実践的な本番パターンは、K3 API(または将来の自前エンドポイント)で100万トークン推論とエージェント編成を行い、VPSNIX M4/M4 Pro物理ノードでApple Siliconネイティブビルドを実行することです——100% Appleハード、フルroot、仮想化タックスなし、日次・月次の弾性課金。料金を確認し、長時間エージェントは準拠した物理インフラに載せてください。
SECTION 09 よくある質問 FAQ
Kimi K3ウェイトはいつ公開されますか?
2026年7月27日です。APIとKimiアプリは7月16日に先行稼働し、ダウンロード可能な全チェックポイントと技術レポートは27日にHugging FaceでModified MITとして公開されます。
Kimi K3は本当にオープンソースですか?
オープンウェイトリリースです——ライセンス付きチェックポイントを取得できます。学習コードとデータセットは7月27日の配布に含まれません。タイトルでは「オープンウェイト」、本文でニュアンスを説明してください。
Kimi K3の利用料金はいくらですか?
API表定価:入力$3/M(キャッシュミス)、$0.30/M(キャッシュヒット)、出力$15/M。Artificial Analysisの代表タスク単価は約$0.94——Claude Fable 5比65.8%安です。
一般GPUでKimi K3を動かせますか?
現実的ではありません。4-bitで約1.4TB、公式は64基以上のアクセラレータを分散スーパーノードで推奨。データセンター規模のハードがない限りAPIを利用してください。
K3はClaude Fable 5やGPT-5.6 Solより優れていますか?
総合Intelligence Indexではいいえ——K3は57.1で3位、Fable 5 59.9、Sol 58.9です。特定のコーディング・自動化ベンチでは優位で、タスク単価は大幅に安い。ワークロードで選んでください。
Kimi K3のライセンスは何ですか?
Modified MITです。7月27日のHugging Faceリリースで全文が公開されます。商用再配布やファインチューン再配布の前に実ファイルを必ず読んでください。