Claude Code で Kimi K3 を使用する方法 (Fable レベルのコーディングを 5 倍安く実現)

@sairahul1
英語2 日前 · 2026年7月20日
211K
103
11
9
295

TL;DR

Rahul が、定型コードやテストなどの日常的なタスクにおいて、Claude Code で高価な Fable 5 モデルの代わりに Kimi K3 を使用することで、AI コーディングの費用を 90% 削減するシステムを紹介します。

Claude Code は、これまでに作られた最高のコーディング環境の 1 つです。

とはいえ、すべてのリクエストを Fable 5 に送るべきというわけではありません。

ほとんどの人は Claude Code を使い、すべてのリクエストを最も高価なモデルに送信しています。

コードの読み取り。ファイルの検索。ボイラープレートの作成。テストの実行。ドキュメント。

それらのどれにも、フロンティア級の推論は必要ありません。

やかんでお湯を沸かすために原子炉にお金を払っているようなものです。

ここでは、ハーネス、差分エンジン、そして私が実際に気に入っている UX に一切触れずに、Claude Code のコストを 10 分の 1 に抑えるために私が使っているシステムを紹介します。

誰も語らない問題

Rahul - inline image

Fable 5 は、100 万トークンあたり入力 $10 / 出力 $50 のコストがかかります。

Kimi K3 は、100 万トークンあたり入力 $3 / 出力 $15 のコストです。

表示価格だけで 5 倍安いです。

しかし、実際の差はそれ以上です。

K3 は 100 万トークンのコンテキストウィンドウを備えており、一律料金で、長いプロンプトによる追加料金はありません。

Fable 5 は、大きなリポジトリをコンテキストに引きずり込むと、すぐに高額になります。

K3 はスループットも非常に高いです。

大規模なコードベースや大量のタスクでは、K3 は、繰り返しのコンテキストが $3 ではなく $0.30 でキャッシュにヒットするため、コストがわずかです。

実際のセッションでの計算:

800K の安定したコードベースコンテキスト + ターンあたり 50K の新しいトークン。

→ K3(キャッシュ利用): $0.24 + $0.15 = ターンあたり $0.39

→ Fable 5(同じコンテキスト): ターンあたり $8.50

同じコンテキストで、21 倍の差です。

これは、K3 が Fable 5 より優れているという話ではありません。

Fable 5 を使うまでもないあらゆる場面で使えるほど、K3 が安いという話です。

あなたが実際に支払っているもの

Rahul - inline image

ほとんどの開発者は、Claude Code にお金を払っているとき、Claude を購入していると思っています。

違います。

彼らが購入しているのは、ハーネスです。

差分エンジン。承認フロー。複数ファイル編集。ツール使用。プランニング。セッション管理。あなたを本当に 10 倍速くする UX。

それらはすべて、Claude Code という環境に存在します。

Claude というモデルではありません。

モデルは単なるインテリジェンス層です。

そして、インテリジェンス層は交換可能です。

Claude Code を素晴らしくしているすべての要素を維持したまま、特定のタスクを K3 にルーティングできます。

ハーネスはそのままです。変更されるのは、それらのタスクの背後にあるモデルだけです。

Claude Code 内で K3 を実行する 3 つの方法

最も簡単なものから、最も強力なものまで。

━━━

方法 1: Kimi Code(5 分、設定不要)

Rahul - inline image

Kimi Code は、彼ら独自の Claude Code 互換 CLI です。

同じハーネスの感触で、内部は K3 です。月額 $19 のサブスクリプションです。

トークンカウンターを気にする必要のないデイリークォータが付いています。

100 万入力トークンあたり $0.60(Claude Code の $3 と比較)で、生の API コストが 5 倍安くなります。

インストール:

Rahul - inline image

実行したら、フロントエンドデザインスキルをインストールして、デフォルトのダサい雰囲気コーディング出力を回避します:

Rahul - inline image

最適な用途: Claude Code のサブスクリプションを完全にやめて、すぐに 80% 以上節約したい開発者向け。

方法 2: CC Switch を介した Codex 内の K3(5 分、1 つの GUI)

Rahul - inline image

これが現在最もクリーンなセットアップです。

CC Switch は、Codex と Claude Code のモデル設定を、設定ファイルを手動で触らずに管理するデスクトップ GUI です。

K3 をプロバイダーとして追加し、ローカルルーティングをオンに切り替えると、Codex はすべての呼び出しで K3 経由でルーティングされます。

ステップバイステップ:

ステップ 1: Kimi API キーを取得する

platform.kimi.ai にアクセス

→ アカウントを作成

→ クレジットを追加($10 でも始められます)

→ API キーを生成

ステップ 2: CC Switch をインストールする

ccswitch.io → お使いの OS 用をダウンロード

→ GUI アプリなので、開くだけです

ステップ 3: Kimi をプロバイダーとして追加する

→ CC Switch を開く

→ Codex(または Claude Code)を選択

→ プロバイダー追加 → Kimi

→ API キーを貼り付け

→ モデル: kimi-k3

→ コンテキストウィンドウ: 1048576

→ アップストリーム形式: Chat Completions

(Codex は Responses API、Kimi は Chat Completions を使用します。

CC Switch が翻訳を処理します — これが重要な設定です)

ステップ 4: ルーティングを有効にする

→ 設定 → ルーティング → ローカルルーティング → マスタースイッチ ON

ステップ 5: Codex を開く

→ 完了。すべてのリクエストが K3 経由でルーティングされるようになりました。

→ モデルピッカーには "カスタム" と表示されます — 見た目だけで、問題なく動作します。

実際のコスト差:

Codex デフォルト(GPT-5.6 Sol): 100 万トークンあたり ~$5 入力 / $30 出力

CC Switch 経由の K3: $3 入力 / $15 出力

典型的な 800K コンテキストセッションの場合: Sol は $24+、K3 は $2.40 です。

1 回のセッションで 10 倍安くなります。

方法 3: Codex Orchestration プラグイン(最も強力)

Rahul - inline image

ここからが面白くなります。

Codex Orchestration プラグインを使用すると、1 つの Codex セッション内で異なる役割に異なるモデルを割り当てることができます。

プランナー。アドバイザー。デザイナー。実行者。

各役割は異なるモデルを取得します。

モデルを交換するだけではありません。特定の種類の作業を、そのジョブに最も安価で適切なモデルにルーティングしているのです。

インストール:

Rahul - inline image

リポジトリ: https://github.com/Cjbuilds/Codex-Orchestration

セットアップ例:

なぜ K3 がデザイナーとして特に機能するのか:

K3 はネイティブのビジョンとマルチモーダル入力を備えています。

UI のスクリーンショットを読み取り、レイアウトを理解し、デザイン仕様を生成します。

フロントエンド作業では非常に強力で、出力 $15/M 対 Fable 5 の $50/M を考えると、ビジュアル関連の明白な実行者です。

私が実際に使っているルーティングルール

複雑ではありません。単純な決定木です。

Rahul - inline image

ルールは、タスクが本当に Fable 5 の限界能力を必要とするまで K3 を使うことです。

ほとんどのタスクは必要としません。

Fable 5 が必要だと思うタスクの 95% でさえ、実際には必要ありません。

まず K3 をテストしてください。実際に限界に達した場合にのみ、エスカレーションしてください。

今日から実際にやるべきこと

自分の状況に合ったパスを選んでください。

最も早く結果を出したい場合(5 分):

Kimi Code をインストール。月額 $19。重要でないすべてのものに使用します。

Rahul - inline image

Codex 内で K3 を使いたい場合(これも 5 分):

CC Switch をインストール。K3 をプロバイダーとして追加。ローカルルーティングを有効化。

Rahul - inline image

完全なロールベースのオーケストレーションを実現したい場合:

Codex Orchestration プラグインをインストール。モデルを役割に割り当て。

Rahul - inline image

3 つのケースすべてで — ルーティングルールを CLAUDE.md に保存してください:

Rahul - inline image

その CLAUDE.md ブロックはすべてのセッションで読み込まれます。

ルーティングは自動的に行われます。

考える必要がなくなります。

あなたが選択しているのは、Claude Code と Kimi の間ではありません。

あなたが選択しているのは、すべてに 1 つの高価なモデルを使うことと、両方が同じであり(時には Kimi の方が Fable よりも優れていることさえあるため)、スマートにルーティングすることの間です。

Claude Code はそのままです。差分エンジンもそのままです。承認フローもそのままです。あなたを 10 倍速くする UX もそのままです。

変更されるのは、特定のタスクの背後にあるインテリジェンス層だけです。

Fable 5 は、本当に必要な 10% のタスクに。

K3 は、必要ない 90% のタスクに。

請求額は 90% 下がります。

出力品質は同じか、あるいは向上します。なぜなら、プランニング段階が今では最強のモデルから十分な注意を払ってもらえるからであり、ボイラープレートに浪費されることがないからです。

これがシステムのすべてです。

これが役に立ったなら:

→ Claude Code を定価で使っているすべての開発者と共有するためにリポストしてください

→ コストを削減しつつ出力を落とさない、より多くのシステムについては @sairahul1 をフォローしてください

→ これをブックマークしてください — 3 つのセットアップパスはすべてコピー&ペーストで使えます

さらに興味深い記事については、theaibuilders.co を購読してください

私は AI、プロダクト構築、そしてあなたがいなくても機能するシステムについて書いています。

━━━━━━━━━━━━━━━━━━

言及されたツール:

→ Kimi Code: kimi.com/code

→ Kimi API: platform.kimi.ai

→ CC Switch: ccswitch.io

→ Codex Orchestration: github.com/Cjbuilds/Codex-Orchestration

YouMindで再制作

Turn one viral article into a full content workflow

Collect the source, decode the pattern, create assets, draft the story, and distribute from one AI workspace.

Explore YouMind
クリエイターのために

あなたの Markdown をきれいな 𝕏 記事に

自分の長文を投稿するとき、画像・表・コードブロックを 𝕏 向けに整形するのは手間がかかります。YouMind は Markdown 全体を、そのまま投稿できるきれいな 𝕏 記事に変換します。

Markdown → 𝕏 を試す

解読すべきパターンをもっと

最近のバイラル記事

バイラル記事をもっと見る