
Kimi K3 auf EvoLink nutzen: Integrations- und Migrationsleitfaden

Kurzfazit: Kimi K3 ist offiziell veröffentlicht. Moonshot dokumentiert die direkte Modell-ID, Preise, multimodale Eingaben und ein Kontextfenster von 1.048.576 Tokens. Das Modell zielt auf langfristige Softwareentwicklung, komplexe Agenten und umfangreiche Wissensarbeit – nicht auf günstige Standard-Chats.
K3 ist entsprechend teuer: Moonshot berechnet direkt ¥20 pro Million nicht gecachter Eingabe-Tokens und ¥100 pro Million Ausgabe-Tokens. Für typische Workloads liegt der Listenpreis ungefähr drei- bis viermal über Kimi K2.6. K3 sollte daher als Premium- oder Eskalationsroute getestet werden.
kimi-k3 verfügbar. Aktuelle Preise und Workload-Empfehlungen stehen auf der Kimi-K3-Modellseite; das aktuelle Anfrageschema ist in der EvoLink API-Dokumentation beschrieben.Bestätigte Kimi-K3-Fakten
| Bereich | Offiziell bestätigt | Bedeutung |
|---|---|---|
| Direkte Modell-ID | kimi-k3 | Gilt für Moonshot, nicht automatisch für EvoLink |
| Größe | 2,8 Billionen gesamt, 104 Milliarden aktiv | Sparse Aktivierung verbessert die Recheneffizienz, die vollständigen Expertengewichte bleiben jedoch groß |
| Architektur | Kimi Delta Attention + Attention Residuals | Fokus auf Effizienz und lange Aufgaben |
| Kontext | 1.048.576 Tokens | Große Repositories und Dokumentbestände |
| Eingaben | Text, Bild und Video | Multimodale Analyse möglich |
| Reasoning | Immer aktiv | Höhere Kosten und Latenz bei einfachen Aufgaben möglich |
| Reasoning-Steuerung | reasoning_effort: low, high, max; Standard ist max | Qualität, Latenz und Ausgabekosten lassen sich abstufen |
| Agent-Funktionen | Tool Calling, tool_choice, dynamische Tools | Geeignet für große Werkzeugkataloge |
| Open Weights | Rund 1,56 TB unter der Kimi K3 License | Self-Hosting ist lizenzabhängig möglich, bleibt aber Clusterbetrieb |
Modell-IDs und Zugriffskanäle
| Kanal | Modell-ID | Kontext und Zugriff |
|---|---|---|
| Moonshot Open Platform | kimi-k3 | Direkte API mit bis zu 1.048.576 Tokens |
| Kimi Code | k3 | Moderato: 256K; Allegretto und höher: bis zu 1M |
| Kimi Code Standard | kimi-for-coding | K2.7 Code, nicht K3 |
| Kimi Code Highspeed | kimi-for-coding-highspeed | K2.7 Code Highspeed, Allegretto oder höher |
| EvoLink | kimi-k3 | Verifizierte Produktionsroute mit dokumentiertem Request-Verhalten |
kimi-k3 gehört zur direkten Moonshot-API, k3 zu Kimi Code. Ein 256K-Limit oder 401-Fehler in Kimi Code kann vom Tarif abhängen. Beim Modellwechsel sollte eine neue Sitzung gestartet werden, da der vorherige Kontext-Cache nicht übernommen wird.
Direkte Preise und Kosten
| Token-Kategorie | Moonshot-Preis pro 1M Tokens |
|---|---|
| Gecachte Eingabe | ¥2 |
| Nicht gecachte Eingabe | ¥20 |
| Ausgabe | ¥100 |
| Beispiel | Ohne Eingabe-Cache | Mit Eingabe-Cache |
|---|---|---|
| 20K Eingabe + 5K Ausgabe | ¥0,90 | ¥0,54 |
| 100K Eingabe + 20K Ausgabe | ¥4,00 | ¥2,20 |
| 500K Eingabe + 50K Ausgabe | ¥15,00 | ¥6,00 |
| 1M Eingabe + 100K Ausgabe | ¥30,00 | ¥12,00 |
Für wen lohnt sich ein Test?
| Workload | Priorität | Begründung |
|---|---|---|
| Coding Agents für große Repositories | Hoch | 1M Kontext und langfristige Aufgaben passen direkt |
| Recherche über viele Dokumente | Hoch | Weniger manuelle Segmentierung |
| Agenten mit vielen Tools | Hoch | Dynamisches Laden reduziert Prompt-Größe und Fehlwahl |
| Multimodale Prüfungen | Mittel bis hoch | Text, Bilder und Video werden unterstützt |
| Support-Chat und Klassifikation | Niedrig | Immer aktives Reasoning kann unnötig teuer sein |
| Self-Hosting | Selektiv prüfen | Gewichte und Lizenz sind veröffentlicht; Moonshot empfiehlt für effiziente Inferenz 64+ Beschleuniger |
Technische Migrationspunkte
reasoning_effort statt des K2.x-Parameters thinking. In mehrstufigen Gesprächen müssen Anwendungen die vollständige Assistant-Nachricht einschließlich reasoning_content und Tool Calls zurückgeben. Nur den Modellnamen auszutauschen reicht deshalb nicht.tool_choice und dynamische Tool-Definitionen. Ein sinnvoller Agentenablauf ist:- Nur Tool-Suche und wenige Kernwerkzeuge bereitstellen.
- Das passende Tool suchen lassen.
- Nur die benötigte Definition dynamisch laden.
- Ergebnisse mit der korrekten Tool-Call-ID zurückgeben.
- Die vollständige Assistant-Nachricht im Verlauf behalten.
Produktionsprüfung vor dem Routing
Erstellen Sie 20–50 reale Aufgaben aus Repository-Analyse, Multi-File-Änderungen, Dokument-Synthese, strukturierten Ausgaben und Tool-Nutzung. Vergleichen Sie Erfolgsrate, Latenz, Tokenverbrauch, Wiederholungen und Review-Aufwand mit Ihrer aktuellen Route.
Noch nicht bestätigt
- unabhängige Benchmark-Ergebnisse unter vergleichbaren Harnesses;
- praktische Auswirkungen der Kimi K3 License auf das eigene Produkt;
- reale Kosten und Leistung der gewählten Clusterkonfiguration;
- reale 1M-Kontextqualität;
- Abrechnung fehlgeschlagener Anfragen;
- workloadspezifische Produktionskosten auf der EvoLink-Route.
Kimi K3 weiter bewerten
| Nächste Entscheidung | Leitfaden |
|---|---|
| Mit wiederverwendbaren, quellenbelegten Aufgaben starten | Kimi K3 Prompts und Anwendungsfälle |
| K3 mit OpenAIs Spitzenroute für Coding vergleichen | Kimi K3 vs GPT-5.6 Sol |
| K3 mit Anthropics Premiumroute für lange Aufgaben vergleichen | Kimi K3 vs Claude Opus 4.8 |
| Latenz, Ausgabe, Cache und Kosten pro erfolgreicher Aufgabe messen | Kimi K3 Token-Effizienz |
FAQ
Ist Kimi K3 offiziell veröffentlicht?
Ja. Moonshot listet K3 seit dem 16. Juli 2026 in Modell-, Preis- und API-Dokumentation.
Wie groß ist das Kontextfenster?
Moonshot dokumentiert 1.048.576 Tokens.
Kann K3 ohne Reasoning laufen?
reasoning_effort unterstützt low, high und max, wobei max der Standard ist.Was kostet Kimi K3?
Direkt bei Moonshot: ¥2/MTok für gecachte Eingabe, ¥20/MTok für nicht gecachte Eingabe und ¥100/MTok für Ausgabe.
Ist Kimi K3 Open Source?
Moonshot veröffentlicht die vollständigen K3-Gewichte unter der benutzerdefinierten Kimi K3 License. „Open Weights unter der Kimi K3 License“ ist präziser als eine pauschale Open-Source-Aussage.
Ist Kimi K3 auf EvoLink verfügbar?
kimi-k3 am 17. Juli 2026. Aktuelle Preise stehen auf der Modellseite. Beim Vergleich mit xAIs nächstem Modell dient Grok 4.6 vs. Kimi K3 dazu, K3 als aufrufbare Produktionsbasis zu behalten.Ist kimi-for-coding Kimi K3?
k3 verwendet.

