
Grok 4.6 vs Kimi K3:今どちらを使うべきか
結論から: 文書化されたモデル、EvoLink に掲載済みのテキストルート、公開ウェイト、あるいは画像・動画をネイティブに理解し100万トークンのコンテキストを持つ上流モデルが必要なら、Kimi K3 を評価してください。本番投入前に、実際のリクエスト、返されたモデル識別子、使用量、請求を確認してください。Grok 4.6 の評価は、xAI が呼び出し可能な API を公開し、EvoLink がモデルID、価格、入力仕様、パラメータ、制限、ルート挙動を検証してからにしてください。
2026年8月11日時点で、これは通常のベンチマーク対決ではありません。Kimi K3 はリリース済みでテストできます。Grok 4.6 は公の場で名前は挙がっているものの、xAI の公式 API モデルカタログ、料金ページ、リリースノートのいずれにも掲載されていません。Grok 4.6 に確定したパラメータ数、コンテキストウィンドウ、価格、ベンチマークスコア、優劣を割り当てた表は、いずれも根拠を先取りしています。
Grok 4.6 と Kimi K3、今はどちらを使うべきか
いま開発またはテストが必要なら Kimi K3 を選んでください。Grok 4.6 はまだデプロイできる選択肢ではありません。公式モデルID、API価格、入力仕様、検証済みの EvoLink ルートのいずれもありません。Grok 4.6 は将来の評価候補として扱い、本番の依存先にはしないでください。
| 要件 | 今の最善策 | 理由 |
|---|---|---|
| 今日検証できる本番候補 | Kimi K3 を評価する | モデル識別子とAPIドキュメントは公開済みで、EvoLink は呼び出し検証用のルートを掲載しています。 |
| 公開ウェイトや自社運用の調査 | Kimi K3 を選ぶ | Moonshot は K3 のウェイトとモデルリポジトリを公開しています。Grok 4.6 に相当する公開はありません。 |
| リポジトリ規模やマルチモーダルの検証 | まず Kimi K3 を試す | Moonshot は100万トークンのコンテキストと画像・動画のネイティブ理解を明記しています。選んだAPIルートが必要な入力モードを提供しているか確認してください。 |
| Grok 4.5 の後継候補として | Grok 4.6 の再現テストを準備する | リリースへの関心はありますが、検証済みのAPI仕様もワークロードの実測もまだありません。 |
| Grok 4.6 登場後に低リスクで切り替えたい | 両方を EvoLink のルーティング配下に置く | 共通ゲートウェイは実装コストを下げますが、各ルートには依然として品質・コスト・互換性の基準が必要です。 |
| 「どちらが賢いか」の一般解 | まだ断定しない | 条件をそろえて評価できる Grok 4.6 のルートが存在しません。 |
2026年8月11日時点で確認できる事実
最も重要な違いは、推測されたベンチマークの点数ではなく、根拠の成熟度です。
| 項目 | Grok 4.6 | Kimi K3 | 本番運用への意味 |
|---|---|---|---|
| 公式ステータス | 公の場で名前は挙がるが、xAI の API モデル、価格、リリースノートに未掲載 | Moonshot が正式にリリース | K3 は今すぐ評価でき、4.6 はできません。 |
| EvoLink での提供 | リリース通知のみ。呼び出せるルートなし | 掲載済み/設定済みルート。本番呼び出しの証拠は未検証 | 本番トラフィックの前に識別子、使用量、請求、フォールバックを検証してください。 |
| モデルID | 未公開 | kimi-k3 | 後から 4.6 を追加できるよう、IDは設定値として持ってください。 |
| API 価格 | 未公開 | Moonshot が公開。EvoLink の現行価格はモデルページに掲載 | テスト時にルート価格と受け入れタスクあたりのコストを比較してください。 |
| 入力モード | 未公開 | Moonshot は上流でテキスト・画像・動画に対応と明記。EvoLink は現在 K3 をテキストルートとして登録 | 選んだルートで公開されているモダリティだけをテストし、上流の性能からゲートウェイの同等性を推測しないでください。 |
| コンテキストウィンドウ | 未公開 | 100万トークン | 大きなコンテキストは検証すべき K3 の性能であり、検索精度の証明ではありません。 |
| ウェイト | 公開なし | Kimi K3 ライセンスの公開ウェイト | K3 はウェイトレベルの検証と自社運用の調査に対応できます。 |
| アーキテクチャの開示 | 未公開 | 総パラメータ2.8兆、アクティブ1040億、KDA と Attention Residuals | アーキテクチャは運用上のトレードオフを説明しますが、それ自体がタスク品質を示すわけではありません。 |
| 推論の制御 | 未公開 | 常時オンの推論と、公開された low・high・max の強度設定 | K3 の設定を記録し、4.6 の制御はドキュメント公開後に検証してください。 |
| ツールと構造化出力 | 未公開 | ワークフロー別の扱い方とともに API 対応が明記 | 今日 K3 を検証し、後から 4.6 に同じ仕様を満たさせてください。 |
この表の Kimi K3 の数値は、Moonshot の公式リポジトリとプラットフォームのドキュメントに基づきます。Grok 4.6 の欄は、xAI が出典を公開していない箇所を意図的に不明のままにしています。これにより、リリース時の論評が API 仕様に変わってしまうのを防ぎます。
提供状況: Kimi K3 は公開済み、Grok 4.6 はテスト計画
kimi-k3 ルートを掲載し、既存のモデル価格システムを通じて現行価格を提示しています。本番対応と呼ぶ前に、成功したリクエスト、返されたモデル識別子、使用量と請求、請求額、エラー時の挙動、フォールバックを記録してください。Grok 4.6 はまだそのテストに入れません。製品ページの slug はモデルIDではなく、告知された日付はエンドポイントではなく、ベンダーの発表はゲートウェイのルートが動く証拠にはなりません。EvoLink が提供中と表示するには、検証済みの上流モデル、リクエストスキーマ、使用量計上、価格、キャパシティ、エラー挙動、ロールバック経路をルートが備えている必要があります。
そのため当面の判断は単純です。K3 が現在の課題を解決できそうならルートを検証し、xAI の次のリリースが戦略的に重要なら Grok 4.6 用のトレースを準備してください。EvoLink 掲載済みルートの検証と明確な本番基準で進められる作業を、待機によって止めるべきではありません。
公開ウェイトとデプロイの主導権
K3 の公開ウェイトは、ホスティング前提の比較では見落とされる選択肢を生みます。
- 公開されたモデル成果物とライセンスを確認する
- 自社運用の実現性を評価する
- 量子化やインフラ固有の最適化を試す
- サービングスタックをより自社の管理下に置く
- 直接利用や自社ホスティングと、マネージドな EvoLink ルートを比較する
これらの選択肢には実際のコストが伴います。1トークンあたり1040億パラメータしか活性化しないとはいえ、総2.8兆パラメータの Mixture-of-Experts モデルは運用負荷が高いままです。公開ウェイトがあっても、キャパシティ計画、推論最適化、セキュリティ、アップグレード、可観測性が無料になるわけではありません。
Grok 4.6 には公開ウェイトも確定したデプロイ形態もありません。ウェイトへのアクセスが好みではなく要件であるなら、この判断は今日、ベンチマークではなく根拠によって K3 の勝ちです。
コンテキストとマルチモーダル作業
Moonshot の上流モデル K3 は、100万トークンのコンテキストウィンドウと画像・動画のネイティブ理解を明記しており、リポジトリ規模のコーディング、文書群、スクリーンショット、デザイン参照、動画の証跡、長いツール履歴に適しています。現在の EvoLink カタログでは K3 をテキストルートとして登録しているため、テキスト以外の入力を送る前にルートの実仕様を確認してください。適切な検証は「リクエストが収まるか」ではなく、「モデルがトークンを浪費せずに正しい根拠を見つけて使えるか」です。
次を測定してください。
| テスト | 合格のシグナル | 見落としやすい失敗 |
|---|---|---|
| 大規模リポジトリの変更 | 正しいファイルと不変条件を特定できる | 重要なコードが存在するのに無視される。 |
| スクリーンショットからUIを作る課題 | 視覚的な階層と挙動が一致する | 見栄えは良いがデザインシステムやアクセシビリティに反する。 |
| 動画を根拠にする課題 | 出来事と時系列を正しく特定できる | 遷移を捏造したり、決定的なフレームを見落とす。 |
| 長文ドキュメントの統合 | 主張が提供した根拠までたどれる | 断定的な細部が捏造されたり、根拠が混ざる。 |
| 長いツールセッション | 状態と引数の整合が保たれる | 以前の結果が失われ、壊れたツール呼び出しが積み上がる。 |
Grok 4.6 については、入力モードもコンテキスト上限も不明のままです。データセットは維持しつつ、xAI が仕様を公開するまでマルチモーダルの直接対決を約束しないでください。
セッション移行、キャッシュ再利用、100万コンテキストのコスト
100万トークンの窓は容量であって、毎ターン100万トークンを送り直すべきという意味ではありません。長い履歴は、回答が短くてもPrefillのレイテンシと未キャッシュ入力のコストを増やします。キャッシュはそのコストを下げられますが、選択したプロバイダー、モデルバージョン、リクエスト前置き、保持期間、ルートのすべてが条件を満たす場合に限られます。
| 運用上の問い | 安全な前提 | 測定すべきこと |
|---|---|---|
| 旧Kimiセッションをそのまま K3 へ移せるか? | 推論状態やプロバイダー側のKVキャッシュがモデルバージョンをまたいで引き継がれると仮定しないでください。基準用には新しい統制されたセッションを開始します。 | 初回ターンのPrefill、回答の一致度、ツール状態の継続性、キャッシュ読み取り量。 |
| 100万コンテキストはあらゆる長時間タスクを改善するか? | いいえ。無関係な履歴はコストを上げ、検索を妨げます。 | 32k・128k・ワークロード必要量の固定予算での有用な根拠の再現率。 |
| 繰り返しの前置きは必ずキャッシュされるか? | いいえ。キャッシュ適用条件と計上はルート契約に依存します。 | キャッシュ済み/未キャッシュ入力、TTLの挙動、前置きの安定性、請求突合。 |
| 直接APIのキャッシュ率をゲートウェイに適用できるか? | いいえ。Moonshotが公開するキャッシュ数値は直接サービスのものであり、EvoLinkや第三者の保証ではありません。 | 実際のルートが返す使用量フィールドと請求額。 |
| 長時間稼働のエージェントは全ターンを保持すべきか? | 保持した履歴が、要約や検索よりも完了率を高める場合に限ります。 | 合格タスク単価、圧縮エラー、失われた制約、復旧状況。 |
リリース直後の議論では、既存のKimiセッションを開き直す必要があるか、長い履歴の大コンテキストエージェントが高額になるかが繰り返し問われます。これらの報告はテスト項目を示すもので、普遍的なキャッシュ方針を証明するものではありません。本番の原則は、キャッシュ済みと未キャッシュの入力を分けて記録し、必要なツール状態だけを保持し、新規セッションの基準と履歴移行後の実行を比較することです。
直接API、ゲートウェイ、サブスク、それとも自己ホストのウェイトか
「Kimi K3の価格」は4つの異なる製品を指し得ます。これらを混ぜると誤ったコスト比較になります。
| 提供チャネル | 価格・制御の面 | 検証すべき内容 |
|---|---|---|
| Moonshot 直接API | Moonshotがキャッシュ入力・未キャッシュ入力・出力のトークン単価を公開 | リージョン、アカウント資格、キャッシュ規則、入力仕様、データ保持、請求単位。 |
| EvoLink 統合ルート | 現在のルート価格はEvoLinkの既存モデル価格表示で提供 | 実際のモデル識別子、対応モダリティ、パラメータ、使用量フィールド、SLO、フォールバック挙動。 |
| IDEまたはサブスク | トークン課金ではなく、リクエスト枠・プレミアム枠・フェアユース方針を使う場合がある | ホストが上流モデル/プロバイダー、コンテキスト予算、ツール方針、スロットリングを明示しているか。 |
| 自己ホストの公開ウェイト | ホスト型のトークンSKUは無いが、アクセラレータ・ネットワーク・運用・セキュリティ・更新に相応のコスト | Kimi K3ライセンス義務、インフラ適合性、量子化品質、キャパシティ、ログの管理権。 |
| Grok 4.6 | 検証済みAPIも商用条件もまだ無い | モデルID、チャネル、表示価格、キャッシュ、制限、データ保持、ルート提供状況。 |
Moonshotの公式リリース記事は、直接APIの料金としてキャッシュ入力100万トークンあたり0.30ドル、未キャッシュ入力3ドル、出力15ドルを挙げています。これらは8月11日時点で公開されたMoonshotの直接APIを説明する数値であり、EvoLinkルート、IDEサブスク、自己ホスト推論の価格に自動的に当てはまるものではありません。実際に導入するチャネルの最新価格を参照してください。
パラメータとエージェントの挙動
reasoning_effort の low・high・max、ツール呼び出し、ツール選択、構造化出力、そして会話履歴に関する重要な要件を明記しています。複数ターンのツール作業では、表示される最終テキストだけを再送するのではなく、K3 が必要とするアシスタントの内容をすべて保持してください。Grok 4.6 については、リリース当日に次の互換性マトリクスを確認します。
| フィールド/挙動 | Kimi K3 の基準 | Grok 4.6 で確認すべきこと |
|---|---|---|
model | kimi-k3 | 正確なID、エイリアス、バージョン固定時の挙動 |
| input/messages | テキスト・画像・動画。Moonshot 直接 API の視覚入力は公開URLではなく Base64 または ms:// のファイルIDを使用 | エンドポイントとマルチモーダルコンテンツのスキーマ |
| 推論の制御 | reasoning_effort: low、high、max | 対応値、既定値、課金、レイテンシ |
| 出力上限 | max_completion_tokens は既定131,072、上流では最大1,048,576まで対応 | 既定値、最大値、切り詰め挙動、課金 |
| サンプリング設定 | temperature=1.0、top_p=0.95、n=1、両ペナルティ 0 が上流で固定 | 対応するサンプリングフィールドと検証時の挙動 |
stream | 選んだルートで検証 | イベント種別、usage イベント、ツールの差分 |
tools / tool_choice | K3 固有の注意点とともに明記 | スキーマの範囲、強制選択、並列時の挙動 |
| 構造化出力 | 明記あり | JSON Schema 対応とツールとの併用 |
| 状態の再送 | 必要な推論とツール履歴を保持 | 会話ID、推論内容、保持ルール |
| 制限 | 上流で100万コンテキストを明記 | コンテキスト、出力、RPS、TPM、同時実行、リージョン |
| usage | ルートの計上に利用可能 | トークン区分、推論使用量、キャッシュ、請求突合 |
互換性は、両社が似たフィールド名を使っているからと推測するのではなく、実際のリクエストとレスポンスで示すべきです。
コスト: 不明な価格ではなく、完了した仕事で比較する
Kimi K3 には公開された直接価格と、EvoLink 上の実価格があります。Grok 4.6 には公式価格も EvoLink の SKU もありません。したがって今日の時点で数値のコスト比較を出せば、それは作り話になります。
いまできるのは、K3 と将来の 4.6 ルートが満たすべきコストの計上方法を決めておくことです。
accepted_task_cost = primary_calls
+ retries
+ fallback_calls
+ tool charges
+ reviewer_time
+ defect_repair入力、キャッシュ入力、出力、推論使用量、ツール料金、所要時間、そして結果が受け入れられたかどうかを記録します。トークン単価が安いルートでも、推論が長引く、ツールを再試行する、レビュー工数が増えるといった理由で高くつくことがあります。逆に単価の高いルートでも、失敗作業を防げるなら経済的です。

ユーザーが言う「より良い」とは何か
この比較をめぐる検索やコミュニティの言葉は、パラメータより運用寄りです。Kimi K3を今使うか待つか、公開ウェイトに意味があるか、100万コンテキストが正しい根拠を取得できるか、エージェントが全工程を完了するか、再試行後にどちらのルートが安いか、といった問いです。これらは勝敗の憶測ではなく、テストケースに変換すべきです。
| ユーザーの問い | 必要な証拠 |
|---|---|
| 「Kimi K3を今使うか、Grok 4.6を待つか?」 | 提供期限、現行ルートのSLO、待つことの機会費用 |
| 「100万コンテキストは本当に役立つか?」 | 大規模リポジトリや文書群での検索精度と合格した成果物 |
| 「コーディングエージェントにはどちらが良いか?」 | 同条件のツール実行、完全な変更の達成率、復旧、誤完了率 |
| 「どちらが安いか?」 | 再試行・ツール呼び出し・フォールバック・レビューを含む合格タスク単価 |
| 「公開ウェイトは重要か?」 | 自己ホスト、検査、カスタマイズ、統制の実需があるか |
| 「後から切り替えられるか?」 | 設定可能なID、共通リクエスト部分集合、オフライン再生、カナリア、ロールバック |
準備すべき条件をそろえた評価
実際のトレースから20〜50件のタスクセットを作り、どちらのモデルを動かす前にも客観的な受け入れ基準を割り当てます。
| ワークロード | 含めるべき理由 | 評価する項目 |
|---|---|---|
| 既存リポジトリのバグ修正 | 診断力と隠れた制約への対応を見る | 根本原因、テスト、リグレッション、不要な変更 |
| ビジュアル重視の React 実装 | ネイティブな視覚理解とフロントエンドの判断を見る | 見た目の一致、レスポンシブ、アクセシビリティ、保守性 |
| ツールを多用するエージェント実行 | スキーマ、状態、リカバリを見る | 有効な呼び出し、リカバリ、ループ回数、人手介入 |
| 構造化抽出 | 仕様どおりの安定性を見る | スキーマ妥当性、フィールド精度、修復率 |
| 長コンテキストの根拠課題 | 容量ではなく検索能力を見る | 引用の正確さ、見落とした根拠、裏付けのない主張 |
| 難易度の高い推論課題 | 品質とコストのバランスを見る | 受け入れられた回答、推論使用量、レイテンシ、レビュー修正 |
K3 を実行して測定可能な基準を作ります。Grok 4.6 が呼び出せるようになったら、プロンプト、リポジトリの状態、ツール、権限、時間・金額予算、評価ルーブリック、セッションの新しさ、有効なコンテキスト予算を固定します。キャッシュ済み入力と未キャッシュ入力を分けて記録し、結果がばらつく場合は複数回試行してください。制約付きの K3 本番設定と無制限の Grok デモを比較せず、タスクが必要としない最大コンテキストを双方に埋めないでください。
本番ルーティングの判断フロー
まず提供状況を第一のゲートにし、次にワークロード要件、最後に実測結果で判断します。これにより、稼働中のルートと仮定のルートを比べずに済みます。
Grok 4.6 に検証済みAPIルートができる前にリリースが必要か?
├─ はい → EvoLink 掲載済みの Kimi K3 ルートを検証するか、呼び出し確認済みの別の EvoLink ルートを使う。
└─ いいえ → Grok 固有の継続性が主要な要件か?
├─ はい → 現行の Grok 基盤を維持し、4.6 の再現レーンを準備する。
└─ いいえ → 公開ウェイト、100万コンテキスト、ネイティブ画像入力が必要か?
├─ はい → まず Kimi K3 を評価する。
└─ いいえ → 今 K3 をベンチマークし、ルート検証後に 4.6 を追加する。
Grok 4.6 が呼び出せるようになったら:
仕様の検証 → オフラインでの対応付け再現 → シャドーテスト → 小規模カナリア
→ 勝ったワークロードだけを昇格 → 検証済みフォールバックを維持| 判断ゲート | ルートの扱い | 中止条件 |
|---|---|---|
| Grok 4.6 の検証済みモデルID・価格・EvoLink ルートがない | Grok 4.6 は無効のまま | 推測した識別子にトラフィックを流さない |
| K3 の性能が目前のワークロードに合う | 代表的なトレースで K3 を検証 | 品質・レイテンシ・受け入れタスクあたりコストが SLO を外したら昇格しない |
| Grok の継続性は重要だが現行ルートは安定 | 現行ルートを維持し対応付け再現を準備 | 確約済みのリリースを妨げるなら待たない |
| Grok 4.6 のルートが検証できた | オフラインとシャドーで評価 | 互換性ゲートを通るまで顧客向け出力に出さない |
| あるルートがワークロード別カナリアで勝つ | そのタスク種別だけ昇格 | 同一性・信頼性・コスト・重要品質が劣化したらロールバック |
推奨する EvoLink ルーティング方針
| ルートの役割 | 初期ルート | 昇格ルール |
|---|---|---|
| K3 ルートの検証 | Kimi K3 | 品質・レイテンシ・受け入れコストの基準を満たしたワークロードだけ昇格。 |
| 現行の本番フォールバック | 既存の対応済みルート | K3 か 4.6 が SLO を損なわない代替だと示すまで維持。 |
| Grok 4.6 候補 | 無効/ウェイトリスト | 上流と EvoLink ルートの検証後にのみ有効化。 |
| Grok 4.6 のシャドーテスト | リリース後の Grok 4.6 | 仕様と品質の確認を通るまで顧客向け出力は行わない。 |
| カナリア | ワークロード別の勝者 | 小さなトラフィック比率と自動ロールバックから開始。 |
EvoLink は単一のアクセス層を通じてベンダー比較に必要な実装作業を減らしますが、モデル固有の検証をなくすものではありません。モデルIDは設定可能にし、可能な範囲で共通のリクエスト仕様を狙い、互換性の差分を記録し、タスクの切れ目でルーティングしてください。
今 K3 を使うべき場合と、待つべき場合
次の場合は今すぐ Kimi K3 を使ってください。
- 呼び出せるモデルと公開された識別子が必要
- 公開ウェイトやデプロイの主導権が判断を変える
- 100万コンテキストや視覚入力がワークロードに含まれる
- タスクに明確な受け入れテストとフォールバックがある
- 評判ではなく、完了タスクあたりのコストを測定できる
次の場合は Grok 4.6 の根拠を待ってください。
- 製品がすでに Grok 前提で標準化されており、アップグレードで移行コストを減らせる
- 4.6 が Grok 4.5 の失敗パターンを改善するかを具体的に確かめたい
- 現行ルートが SLO を満たしており、待っても機会損失がない
- 4.6 でまだ公開されていない xAI 固有の機能が必要
適切なルートが利用できるのに、時間に追われた製品を止めてまで待つ必要はありません。また、アーキテクチャが公開されている、コンテキストが大きいというだけで K3 に移行するのも避けてください。どちらの判断にもワークロードの実測が必要です。
よくある質問
Grok 4.6 は Kimi K3 より優れていますか?
そう主張できる検証済みの根拠はありません。Kimi K3 はリリース済みでテストできますが、Grok 4.6 には条件をそろえて検証できる公開APIがまだありません。
Grok 4.6 API は利用できますか?
2026年8月11日に確認した xAI の公式 API モデルカタログ、料金ページ、リリースノートによれば利用できません。EvoLink にも呼び出せる Grok 4.6 ルートはまだありません。
EvoLink は Kimi K3 ルートを掲載していますか?
kimi-k3 ルートを掲載し、文書化しています。これは掲載と設定を示すもので、本番呼び出しの成功を証明するものではありません。価格はモデルページで確認し、本番投入前にモデル識別子、使用量、請求を検証してください。コンテキストウィンドウが大きいのはどちらですか?
Kimi K3 は100万トークンのコンテキストウィンドウを明記しています。Grok 4.6 のコンテキストウィンドウは未公開のため、事実に基づく大きさの比較はできません。
両方ともマルチモーダルですか?
Moonshot の上流モデル Kimi K3 は、画像と動画のネイティブ理解に公式対応しています。選んだ直接ルートまたはゲートウェイのルートがそれらのモードを提供しているか確認してください。Grok 4.6 の入力モードは未公開であり、以前の Grok モデルと同等だと仮定しないでください。
公開ウェイトがあるのはどちらですか?
Kimi K3 は Kimi K3 ライセンスのもとで公式に公開ウェイトをリリースしています。Grok 4.6 のウェイト公開は確認されていません。
どちらが安いですか?
Kimi K3 は Moonshot 直結 API の価格を公開していますが、Grok 4.6 は公開していません。ゲートウェイ、IDE サブスクリプション、セルフホストは商用条件が異なります。4.6 に検証済みルートと同条件の結果がそろってから、選択したチャネルの現行価格と受け入れタスクあたりのコストを比較してください。
Grok 4.6 のリリース後、すぐに切り替えられますか?
モデルIDが設定可能で、アプリケーションが互換性のあるリクエスト仕様を使っており、K3 か別の対応ルートをフォールバックとして残していれば可能です。それでもオフライン、シャドー、カナリア、ロールバックの確認は必須です。
掲載済みルートを検証し、候補を追跡する
測定可能なワークロードで EvoLink 掲載済みの Kimi K3 ルートを検証し、ルートは設定で切り替えられるようにして、Grok 4.6 の更新を受け取ってください。目的は見出しでベンダーを選ぶことではなく、明確な本番基準のもとで進めながら、検証済みの根拠が出たときにより良いルートへ移る選択肢を残すことです。
EvoLink で利用可能なモデルを比較する関連記事:
出典
- xAI: API モデルカタログ
- xAI: API 料金
- xAI: API リリースノート
- Moonshot AI: Kimi K3 公式リポジトリ
- Kimi: Kimi K3 公式リリース記事と直接API料金
- Moonshot AI: Kimi K3 モデルコレクション
- Kimi Platform: Kimi K3 クイックスタート
- Kimi Platform: Kimi K3 直接APIの料金
- Linux.do: Kimi K3 のセッションとキャッシュ移行に関する議論
- Linux.do: Kimi K3 と OpenCode の価格に関する議論
コミュニティの議論と現在の検索結果は、比較テーマ、提供チャネルの表現、セッション移行の懸念、評価観点の選定にのみ利用しました。モデルの提供状況、ID、アーキテクチャ、コンテキスト、入力モード、パラメータ、直接API価格は、公式情報または EvoLink のルート記録に基づいています。


