Kimi K3 は 2026 年 7 月 16 日にリリースされました。2.8 兆パラメータ。100 万トークンのコンテキスト。これまでにリリースされた最大のオープンウェイトモデルです。
見出しの機能は K3 Swarm Max です。最大 300 のサブエージェントが並列実行され、4,000 ステップにわたって調整し、チャット回答ではなく実際のファイルを生成します。2 つのバリアントは同じ頭脳を共有しています。K3 Max は日常的なタスクを処理します。K3 Swarm Max は問題に対して艦隊を差し向けます。

ほとんどの人は Kimi を開き、質問を入力し、回答を得て、タブを閉じます。それは製品の機能の約 10% です。このガイドでは残りの 90% をカバーします。

スウォームは後付けの機能ではありません。オーケストレーターは、並列エージェント強化学習で訓練された学習済みポリシーです。目標を記述すると、スウォームがそれをどのように分割するか、いくつのエージェントを生成するか、結果をどのように統合するかを決定します。スウォームは広範で並列化可能な作業で優れています:50 以上のソースにわたる調査、バッチ分析、競合モニタリング、データセット構築などです。しかし、ステップ 3 がステップ 2 に依存するような深い逐次タスクでは苦戦します。

- 仕様を書け、プロンプトを書くな
「フィットネスアプリ市場を調査しろ」というのは、クレジットを無駄にしてゴミを得る方法です。一行のプロンプトでは、スウォームにすべてを決定する権限を与えてしまいます。それは間違った決定を下します。

スウォームを請負業者のように扱いましょう。仕様書は、何を収集するか、何が有効とみなされるか、どのソースが許可されるか、正確な出力形式、および競合時に何をすべきかを定義します。仕様書はワークフロー全体の中で最もレバレッジの高い成果物です。なぜなら、レベル 2 ではそれが再利用可能なスキルの種になるからです。
1# プロジェクト: [名前]2目標: [一文、成果物、トピックではない]3範囲: [含むもの、明示的に含まないもの]4ルール: [検証、検証済みの所見とみなされるもの]5ソース: [公式投稿、論文、一次情報のみ、アグリゲーターは不可]6出力: [ファイル形式 / 数 / 命名規則 / 形式の詳細]7競合時: 行にフラグを立て、黙って解決しない8停止条件: [推測する代わりに停止して報告するタイミング]
- 費用をかける前に分解計画を確認せよ
仕様書を提出すると、Kimi は実行前に実行計画を表示します:サブエージェントの数、各エージェントが担当する内容、依存関係の順序、ステップ予算。これは初心者がスキップするステップであり、スキップするのに最もコストがかかるステップです。

200 エージェントのスウォームを誤って分解すると、実際のお金がかかります。計画を確認するのは無料です。確認すべき 3 つのポイント:スコープを理解しているか、エージェント数がタスクに対して妥当か、出力計画が実際に必要なものと一致しているか。
1実行前に提案された分解計画を表示せよ:2- サブエージェントの数と各エージェントが担当する内容3- 依存関係の順序(何が何をブロックするか)4- 推定ステップ予算5- 品質低下のリスクが最も高い箇所6まだ実行するな。私の確認を待て。
知っておく価値のある詳細:4,000 ステップはスウォーム全体での調整された予算であり、エージェントあたり 4,000 ではありません。300 エージェントの実行では、平均約 13 ステップです。これにより、タスクがその形状に適合するかどうかがわかります。
- 実行する
さあ実行します。最大 300 のサブエージェントが並列の波で起動し、それぞれが独自の境界コンテキスト内で動作します。構造化された出力のみがコーディネーターに戻ります。
1仕様書を最初から最後まで実行せよ。2計画が許す限り並列化せよ。3ブロッカーがあれば直ちに報告し、黙って回避するな。4すべてを仕様書で定義された出力にマージせよ。
レベル 1 の後に得られるもの
仕様書から構築された単一のスウォーム出力。生の、未検証だが構造化されたもの。ほとんどの人はここで止まります。価値はレベル 2 から始まります。

- 実際のファイルを要求せよ、チャットの回答ではなく
「包括的なレポート」はエージェントに早期停止の許可を与えます。「40 ページの PDF + 20,000 行の CSV + 14 のエクスポート可能な PNG チャート」は品質目標を与えます。常に仕様書の先頭に出力を置きましょう。出力レベルの具体性が、リサーチチームと高価な提案箱の違いです。
1# 優れた出力例:2出力: 1 つの .xlsx、モデルごとに 1 行、+ 200 語の概要3出力: 30 の HTML ファイル、店舗ごとに 1 つ、ビジネス名で命名4出力: 40 ページの PDF + 20,000 行の CSV + 14 の PNG チャート
- 実際のファイルを要求せよ、チャットの回答ではなく
「包括的なレポート」はエージェントに早期停止の許可を与えます。「40 ページの PDF + 20,000 行の CSV + 14 のエクスポート可能な PNG チャート」は品質目標を与えます。常に仕様書の先頭に出力を置きましょう。出力レベルの具体性が、リサーチチームと高価な提案箱の違いです。
1# 優れた出力例:2出力: 1 つの .xlsx、モデルごとに 1 行、+ 200 語の概要3出力: 30 の HTML ファイル、店舗ごとに 1 つ、ビジネス名で命名4出力: 40 ページの PDF + 20,000 行の CSV + 14 の PNG チャート
- 別のモデルを出力に向けよ
スウォームの既知の欠点:明示的に検証を要求しない限り、自信過剰で引用が不十分な主張を生成し、独立したサブエージェントが時々互いに矛盾します。「完了したように見える」と「正しい」は別世界です。検証ゲートとして 2 番目のモデルを使用します。その唯一の仕事は反論であって称賛ではありません。プレミアムトークンを支払って生成しているのではありません。次のステップでワークフローを再利用可能なスキルとして保存する前に、静かな欠陥をキャッチするために支払っているのです。

1あなたは検証者です。エージェントのスウォームが添付の出力を生成しました。2あなたの唯一の仕事は、何が間違っているかを見つけることです。34確認事項:5- 主張されたすべての数値は、名前付きのソースにトレース可能か?6- どの 2 つのセクションも互いに矛盾していないか?7- 実際には推論である事実が提示されていないか?8- 出力は仕様書の形式要件を満たしているか?910各問題について:正確な場所と修正を提示せよ。11すべてが問題なければ:承認。12何かが失敗した場合:却下 + 最も重要な修正を最初に。
- ワークフロー全体をスキルとして保存せよ
検証済みの実行後、Kimi にワークフロー全体をキャプチャするよう指示します:入力形式、エージェントステップ、出力形式、検証ルール。最初の実行は 20 分かかります。それ以降の実行は 30 秒です。スキルがあるからこそ、システムは毎回再起動するのではなく、複利的に成長するのです。
1このワークフロー全体を再利用可能なスキルとして保存せよ:「[名前]」2キャプチャするもの:3- 入力形式(期待するファイル / 仕様の形状)4- 機能したエージェントステップ5- 出力形式と命名規則6- 仕様書の検証ルール7次回これを実行するときは、新しいファイルを添付して同じ形状を得る。
レベル 2 の後に得られるもの
信頼できる検証済みの出力と、仕様書を再構築せずに再生できる保存済みスキル。ここからループが複利的に成長し始めます。

- 独自のドキュメントをスウォーム知識として投入せよ
スキルはプロセスをキャプチャします。ドキュメントからスキルへの変換はドメインをキャプチャします。最高の成果物をアップロードすると、Kimi はその構造的な指紋をスキルとしてキャプチャし、将来のすべてのスウォームがそれを適用します。

フィードするすべての PDF、トランスクリプト、スプレッドシートは、300 のエージェントすべてがトレーニングデータに頼るのではなく、それに対してグラウンディングするコンテキストになります。多くをフィードするほど、出力は汎用的な AI ではなく、あなたの仕事のように読めるようになります。
1このドキュメントを再利用可能なスキルとしてキャプチャせよ。何が機能しているかを特定せよ:2- 構造とセクションの順序3- トーンと声の登録4- セクションごとの分析の深さ5「[名前]」として保存せよ。次に、キャプチャしたスキルを使用して、[異なるトピック]に関する新しいドキュメントを生成せよ。内容ではなく品質水準に合わせること。
- すべての拒否を恒久的なルールに変えよ
検証ステップは一度欠陥をキャッチします。このステップは、スウォームがそれを二度と繰り返さないようにします。フィードバックをハードルールに蒸留し、スウォームが何かをする前に読み込む制約ファイルに書き込みます。
1# CONSTRAINTS.md、自動的に読み込まれる2- 主張されたすべての数値は一次ソースにトレース可能であるか、フラグが立てられること3- 黙ったままの競合解決は禁止:矛盾を表面化すること4- [前回の実行の検証者のフィードバックから蒸留されたルール]5- [二度と繰り返したくない間違い]6スコープロック:仕様書のスコープブロックの外には一切触れないこと。
- 新しい入力でスキルを再生せよ
ここで「複利効果」は単なるバズワードではなくなり、請求書に現れます。2 回目の実行はゼロから始まりません。スキル、スウォーム知識、そして上記で構築した制約ファイルから始まります。同じワークフロー、新しいファイル、セットアップのごく一部。経済性は再生時に劇的に変化します。K3 のキャッシュヒット価格は繰り返しコンテキストに対して 100 万トークンあたり $0.30 に下がり、初回実行の入力価格より 10 倍安くなります。スキル、制約、仕様書はすべて繰り返しコンテキストです。新しい入力ファイルのみが全額のレートになります。初回実行は投資です。その後のすべての実行がそのリターンを収穫します。

出力も構造的に改善されます。スキルが形式を強制します。制約は検証者がすでにキャッチしたすべての間違いをブロックします。スウォーム知識は、トレーニングデータではなく実際のドキュメントに対して各エージェントをグラウンディングします。4 回目の実行は 1 回目よりもコストがかかるだけでなく、より良い結果を生み出します。なぜなら、システムは 3 回の実際のフィードバックから学習しているからです。

1保存されたスキル「[名前]」をこれらの新しい入力で実行せよ。2CONSTRAINTS.md を適用せよ。キャプチャされた出力形式を使用せよ。3[新しいファイルを添付]45この実行の出力を前回の実行と比較せよ。6報告:7- 前回存在しなかった新しい発見8- 前回から変更された発見9- 消失したもの(潜在的なギャップとしてフラグ)10- スキルの期待される形状からの逸脱
レベル 3 の後に得られるもの
自己改善型のリサーチパイプライン。スキルライブラリ、知識ベース、制約ファイルが成長し続けるため、実行ごとに安く、速く、正確になります。

- スキルをスケジュールエージェントに昇格させよ
ループが安定し、スキルに支えられたら、手動で起動するのをやめます。Kimi にトリガーを設定します:スケジュール、新しいファイルのドロップ、監視対象の URL。スウォーム全体をプロアクティブに実行させ、成果物と注意を要する逸脱のみを提示させます。

競合モニタリングはその良い例です。1 回目の実行:手動で構築し検証します。バックグラウンドエージェントになる頃には、毎週すべての競合を並列でチェックし、限界時間コストゼロでインボックスにブリーフを届けます。ループに残る唯一の人間は、設定した質問と回答に対する意思決定です。
1スキル「[名前]」を毎週のスケジュールで実行せよ。2トリガー:[スケジュール / 新しいファイル / 監視対象 URL]3各実行で:スウォームを実行し、CONSTRAINTS.md を適用し、4検証し、出力 + 前回との差分を配信せよ。5逸脱が [しきい値] を超えた場合のみ私に通知せよ。
2.8T パラメータでも修正できないこと

幻覚は並列性に比例して増大します。 検証パスを実行しない限り、より多くのエージェントが検索するほど、より自信過剰な誤った回答が増えます。スウォームは自分自身をファクトチェックしません。
K3 は K2.6 よりも 3~4 倍コストがかかります。 入力:$3.00/M vs $0.95/M。出力:$15.00/M vs $4.00/M。キャッシュは再生時に役立ちますが、初回実行は高価です。純粋なコスト最適化には、K2.6 が依然として予算に優しい選択肢です。
オープンウェイトはまだリリースされていません。 Moonshot は 2026 年 7 月 27 日までにリリースすると約束しています。それまでは、K3 は API と Kimi アプリ経由でのみ実行できます。
スウォームは悪い仕様書を増幅します。 1 つのエージェントを通じた曖昧なプロンプトは 1 つのコンテキストウィンドウを無駄にします。300 のエージェントを通じると、300 を並列で無駄にします。
短いリスト
- 一行プロンプト。 スウォームがすべてを決定します。間違った決定を下します。
- 分解レビューのスキップ。 スキップするのに最もコストがかかるステップ。
- 検証パスの欠如。「完了したように見える」は「正しい」ではありません。
- 未検証の出力をスキルとして保存。 その間違いは将来のすべての実行で複利的に増大します。
- 逐次タスクに 300 エージェント。 スウォームは思考の連鎖を並列化できません。
- K2.6 で十分な場所に K3 を使用。 すべてのタスクに 2.8T パラメータが必要なわけではありません。
結論
ほとんどの人は Kimi を開き、質問を入力し、タブを閉じるでしょう。それはチャットボックスです。それは K3 の機能の約 10% です。残りの 90% は、一度構築すれば永久に再生できるリサーチチームです。各レベルでより多くのレバレッジが解放されます:最初の実行、次に信頼、次に複利効果、そして自律性。これらすべてを初日に必要とするわけではありません。レベル 1 から 1 つの仕様書で始めてください。出力が有用であれば、レベル 2 に進んで検証してください。再度実行する予定があれば、スキルを保存してください。システムはそこから自動的にシャープになります。
仕様書を書け、プロンプトを書くな。保存する前に検証せよ。そうすれば、実行ごとに前回より安く、よりシャープになるのを見守れ。





