Seedance 2.5 ist jetzt auf EvoLink verfügbarSeedance 2.5 testen
Kimi-K3-Datenhochhaus für lange Kontexte, Code, Dokumente, Werkzeuge, Bilder und Video
Review

Kimi K3 auf EvoLink nutzen: Integrations- und Migrationsleitfaden

EvoLink Team
EvoLink Team
Product Team
16. Juli 2026
Aktualisiert am 27. Juli 2026
6 Min. Lesezeit

Kurzfazit: Kimi K3 ist offiziell veröffentlicht. Moonshot dokumentiert die direkte Modell-ID, Preise, multimodale Eingaben und ein Kontextfenster von 1.048.576 Tokens. Das Modell zielt auf langfristige Softwareentwicklung, komplexe Agenten und umfangreiche Wissensarbeit – nicht auf günstige Standard-Chats.

K3 ist entsprechend teuer: Moonshot berechnet direkt ¥20 pro Million nicht gecachter Eingabe-Tokens und ¥100 pro Million Ausgabe-Tokens. Für typische Workloads liegt der Listenpreis ungefähr drei- bis viermal über Kimi K2.6. K3 sollte daher als Premium- oder Eskalationsroute getestet werden.

Kimi K3 ist jetzt auf EvoLink als verifizierte Produktionsroute kimi-k3 verfügbar. Aktuelle Preise und Workload-Empfehlungen stehen auf der Kimi-K3-Modellseite; das aktuelle Anfrageschema ist in der EvoLink API-Dokumentation beschrieben.

Bestätigte Kimi-K3-Fakten

BereichOffiziell bestätigtBedeutung
Direkte Modell-IDkimi-k3Gilt für Moonshot, nicht automatisch für EvoLink
Größe2,8 Billionen gesamt, 104 Milliarden aktivSparse Aktivierung verbessert die Recheneffizienz, die vollständigen Expertengewichte bleiben jedoch groß
ArchitekturKimi Delta Attention + Attention ResidualsFokus auf Effizienz und lange Aufgaben
Kontext1.048.576 TokensGroße Repositories und Dokumentbestände
EingabenText, Bild und VideoMultimodale Analyse möglich
ReasoningImmer aktivHöhere Kosten und Latenz bei einfachen Aufgaben möglich
Reasoning-Steuerungreasoning_effort: low, high, max; Standard ist maxQualität, Latenz und Ausgabekosten lassen sich abstufen
Agent-FunktionenTool Calling, tool_choice, dynamische ToolsGeeignet für große Werkzeugkataloge
Open WeightsRund 1,56 TB unter der Kimi K3 LicenseSelf-Hosting ist lizenzabhängig möglich, bleibt aber Clusterbetrieb
Wenn Open Weights zur Evaluation gehören, zeigt der Leitfaden zur lokalen Ausführung von Kimi K3 die Hardwareanforderungen, Lizenzgrenzen und Gesamtbetriebskosten vor einer Clusterentscheidung.

Modell-IDs und Zugriffskanäle

KanalModell-IDKontext und Zugriff
Moonshot Open Platformkimi-k3Direkte API mit bis zu 1.048.576 Tokens
Kimi Codek3Moderato: 256K; Allegretto und höher: bis zu 1M
Kimi Code Standardkimi-for-codingK2.7 Code, nicht K3
Kimi Code Highspeedkimi-for-coding-highspeedK2.7 Code Highspeed, Allegretto oder höher
EvoLinkkimi-k3Verifizierte Produktionsroute mit dokumentiertem Request-Verhalten
Die IDs sind nicht austauschbar. kimi-k3 gehört zur direkten Moonshot-API, k3 zu Kimi Code. Ein 256K-Limit oder 401-Fehler in Kimi Code kann vom Tarif abhängen. Beim Modellwechsel sollte eine neue Sitzung gestartet werden, da der vorherige Kontext-Cache nicht übernommen wird.
Kimi-K3-API-Zugriffskanäle mit direkter API, Coding-Clients, Kontextkapazität, Werkzeugen und verifizierter EvoLink-Gateway-Route
Kimi-K3-API-Zugriffskanäle mit direkter API, Coding-Clients, Kontextkapazität, Werkzeugen und verifizierter EvoLink-Gateway-Route

Direkte Preise und Kosten

Token-KategorieMoonshot-Preis pro 1M Tokens
Gecachte Eingabe¥2
Nicht gecachte Eingabe¥20
Ausgabe¥100
BeispielOhne Eingabe-CacheMit Eingabe-Cache
20K Eingabe + 5K Ausgabe¥0,90¥0,54
100K Eingabe + 20K Ausgabe¥4,00¥2,20
500K Eingabe + 50K Ausgabe¥15,00¥6,00
1M Eingabe + 100K Ausgabe¥30,00¥12,00
Das sind direkte Moonshot-Preise, keine EvoLink-Preise. Wichtiger als der reine Tokenpreis ist der Preis pro erfolgreicher Aufgabe: Erstversuch-Erfolg, akzeptierte Codeänderungen, Tool-Genauigkeit, Cache-Treffer, Ausgabe-Tokens und menschlicher Prüfaufwand.

Für wen lohnt sich ein Test?

WorkloadPrioritätBegründung
Coding Agents für große RepositoriesHoch1M Kontext und langfristige Aufgaben passen direkt
Recherche über viele DokumenteHochWeniger manuelle Segmentierung
Agenten mit vielen ToolsHochDynamisches Laden reduziert Prompt-Größe und Fehlwahl
Multimodale PrüfungenMittel bis hochText, Bilder und Video werden unterstützt
Support-Chat und KlassifikationNiedrigImmer aktives Reasoning kann unnötig teuer sein
Self-HostingSelektiv prüfenGewichte und Lizenz sind veröffentlicht; Moonshot empfiehlt für effiziente Inferenz 64+ Beschleuniger

Technische Migrationspunkte

K3 verwendet reasoning_effort statt des K2.x-Parameters thinking. In mehrstufigen Gesprächen müssen Anwendungen die vollständige Assistant-Nachricht einschließlich reasoning_content und Tool Calls zurückgeben. Nur den Modellnamen auszutauschen reicht deshalb nicht.
K3 unterstützt tool_choice und dynamische Tool-Definitionen. Ein sinnvoller Agentenablauf ist:
  1. Nur Tool-Suche und wenige Kernwerkzeuge bereitstellen.
  2. Das passende Tool suchen lassen.
  3. Nur die benötigte Definition dynamisch laden.
  4. Ergebnisse mit der korrekten Tool-Call-ID zurückgeben.
  5. Die vollständige Assistant-Nachricht im Verlauf behalten.

Produktionsprüfung vor dem Routing

Erstellen Sie 20–50 reale Aufgaben aus Repository-Analyse, Multi-File-Änderungen, Dokument-Synthese, strukturierten Ausgaben und Tool-Nutzung. Vergleichen Sie Erfolgsrate, Latenz, Tokenverbrauch, Wiederholungen und Review-Aufwand mit Ihrer aktuellen Route.

Auf EvoLink sollte K3 nicht automatisch jedes Modell ersetzen. Sinnvolle Rollen sind Premium-Modell, Spezialroute für große Kontexte oder Eskalation nach einem fehlgeschlagenen günstigeren Modell. Der EvoLink-Modellkatalog hilft bei der Auswahl von Fallback-Routen.

Noch nicht bestätigt

  • unabhängige Benchmark-Ergebnisse unter vergleichbaren Harnesses;
  • praktische Auswirkungen der Kimi K3 License auf das eigene Produkt;
  • reale Kosten und Leistung der gewählten Clusterkonfiguration;
  • reale 1M-Kontextqualität;
  • Abrechnung fehlgeschlagener Anfragen;
  • workloadspezifische Produktionskosten auf der EvoLink-Route.

Kimi K3 weiter bewerten

Nächste EntscheidungLeitfaden
Mit wiederverwendbaren, quellenbelegten Aufgaben startenKimi K3 Prompts und Anwendungsfälle
K3 mit OpenAIs Spitzenroute für Coding vergleichenKimi K3 vs GPT-5.6 Sol
K3 mit Anthropics Premiumroute für lange Aufgaben vergleichenKimi K3 vs Claude Opus 4.8
Latenz, Ausgabe, Cache und Kosten pro erfolgreicher Aufgabe messenKimi K3 Token-Effizienz

FAQ

Ist Kimi K3 offiziell veröffentlicht?

Ja. Moonshot listet K3 seit dem 16. Juli 2026 in Modell-, Preis- und API-Dokumentation.

Wie groß ist das Kontextfenster?

Moonshot dokumentiert 1.048.576 Tokens.

Kann K3 ohne Reasoning laufen?

Nein. Reasoning ist immer aktiv; reasoning_effort unterstützt low, high und max, wobei max der Standard ist.

Was kostet Kimi K3?

Direkt bei Moonshot: ¥2/MTok für gecachte Eingabe, ¥20/MTok für nicht gecachte Eingabe und ¥100/MTok für Ausgabe.

Ist Kimi K3 Open Source?

Moonshot veröffentlicht die vollständigen K3-Gewichte unter der benutzerdefinierten Kimi K3 License. „Open Weights unter der Kimi K3 License“ ist präziser als eine pauschale Open-Source-Aussage.

Ja. EvoLink startete die verifizierte Route kimi-k3 am 17. Juli 2026. Aktuelle Preise stehen auf der Modellseite. Beim Vergleich mit xAIs nächstem Modell dient Grok 4.6 vs. Kimi K3 dazu, K3 als aufrufbare Produktionsbasis zu behalten.

Ist kimi-for-coding Kimi K3?

Nein. Laut Kimi-Code-Dokumentation ist dies K2.7 Code. Für K3 wird in unterstützten Kimi-Code-Clients k3 verwendet.

Quellen

Bereit, Ihre KI-Kosten um 89 % zu senken?

Starten Sie noch heute mit EvoLink und erleben Sie die Vorteile intelligenter API-Routing.