Kimi K3 Preise erklärt: Pläne und API-Kosten

8 Min. Lesezeit2026-07-25
Kimi K3 Preise

Kimi K3 ist das weltweit erste offene Modell der 3T-Klasse, ein Flaggschiff-Modell mit 2,8 Billionen Parametern, das für Spitzenintelligenz bei langfristigem Coding, Wissensarbeit und Reasoning entwickelt wurde, mit nativer Bildverarbeitung und einem Kontextfenster von 1 Mio. Tokens. Es ist über Kimi.com, Kimi Work, Kimi Code und die Kimi API verfügbar. Im Folgenden finden Sie einen Überblick über die Kimi-Mitgliedschaftspläne und die Kimi K3 API-Preise, damit Sie den passenden Zugangsweg wählen können.

Kimi K3 Mitgliedschaftspläne & Nutzungsstufen

Der einfachste Weg, Kimi K3 zu nutzen, ist über eine Kimi-Mitgliedschaft. Kimi bietet gestaffelte Pläne, die mit Ihren Anforderungen skalieren, von gelegentlicher täglicher Nutzung bis hin zu intensiven agentischen Workflows. Höhere Stufen schalten mehr Agent-Guthaben, höhere Nebenläufigkeit und eine extra-lange Chat-Kapazität von bis zu 1 Mio. Tokens frei, angetrieben von Kimi K3.

AdagioModeratoAllegrettoAllegroVivace
Jährliche Abrechnung (effektiv monatlich)0 $ / Monat15 $ / Monat31 $ / Monat79 $ / Monat159 $ / Monat
Gleichzeitige Agent-Aufgaben1 Aufgabe2 Aufgaben2 Aufgaben4 Aufgaben4 Aufgaben
Prioritäts-Warteschlange für Agents×4-fache Geschwindigkeit4-fache Geschwindigkeit4-fache Geschwindigkeit4-fache Geschwindigkeit
K3 Extra-langer Chat-Speicher (bis zu 1 Mio. Token)×××
Anpassbares Dashboard
Geplante Aufgaben2 Aufgaben10 Aufgaben15 Aufgaben20 Aufgaben25 Aufgaben
Widget-Aufgabe2 Aufgaben10 Aufgaben15 Aufgaben20 Aufgaben25 Aufgaben
PluginsÜber 15 Typen unterstütztÜber 15 Typen unterstütztÜber 15 Typen unterstütztÜber 15 Typen unterstütztÜber 15 Typen unterstützt
Swarm×
Swarm-Ausführung von Teilaufgaben×2 Subagenten4 Subagenten8 Subagenten8 Subagenten
Dream Memory×
Selbstentwickelnde Skills×
Ziel××
Kimi Claw (Web, Android, PC)××
Gruppenchat mit Claw××10 Gruppenchats10 Gruppenchats10 Gruppenchats
Eine Website mit Datenbank bereitstellen×

Alle oben genannten Preise beziehen sich auf jährliche Abrechnung. Monatliche Abrechnung ist ebenfalls verfügbar, zu 19 $, 39 $, 99 $ bzw. 199 $ pro Monat. Allegro und Vivace schalten die extra-lange Chat-Kapazität von K3 frei und unterstützen bis zu 1 Mio. Tokens Kontext für sehr lange Konversationen, große Codebasen und dokumentenintensive Recherchen. Aktuelle Details zu den Plänen finden Sie auf der offiziellen Mitgliedschaftsseite.

Kimi K3 API-Preise

Die Kimi K3 API-Preise basieren auf einem token-basierten Modell, bei dem die Nutzung pro 1 Mio. Tokens (1.000.000 Tokens) sowohl für Eingabe- als auch für Ausgabeverarbeitung abgerechnet wird, was eine klare und vorhersehbare Kostenkontrolle ermöglicht.

ModellEinheitEingabepreis (Cache-Treffer)Eingabepreis (Cache-Fehltreffer)AusgabepreisKontextfenster
kimi-k31 Mio. Token$0.30$3.00$15.001.048.576 Token

Kimi K3 ist Kimis Flaggschiff-Modell für langfristiges Coding und durchgängige Wissensarbeit. Es denkt stets im Reasoning-Modus, wobei der Reasoning-Aufwand über das Top-Level-Feld reasoning_effort festgelegt wird. Das Modell unterstützt automatisches Context-Caching, Tool-Aufrufe, den JSON-Modus, strukturierte Ausgaben und ein vollständiges Kontextfenster von 1 Mio. Tokens in einer einzigen Anfrage.

Wie die Kimi K3 API-Abrechnung funktioniert

Die Kimi K3 API verwendet für jede Anfrage ein token-basiertes Preismodell, bei dem jede Interaktion mit dem Modell Tokens verbraucht, die je nach Typ abgerechnet werden. Innerhalb dieses Modells werden Tokens grundsätzlich in drei Typen unterteilt: Input-Tokens, gecachte Input-Tokens und Output-Tokens.

Input-Tokens

Input-Tokens umfassen alles, was an das Modell gesendet wird, einschließlich:

  • Nutzer-Prompts

  • Systemanweisungen

  • Konversationsverlauf oder Kontext Diese Tokens bestimmen, wie viel Kontext das Modell verarbeiten muss, bevor es eine Antwort generiert. Mit einem Kontextfenster von 1 Mio. Tokens kann Kimi K3 ganze Codebasen, lange Dokumente und umfangreiche Mehrfach-Interaktionsverläufe in einer einzigen Anfrage aufnehmen.

Gecachte Input-Tokens

Gecachte Input-Tokens entstehen, wenn zuvor verarbeiteter Kontext wiederverwendet wird.

  • Wird derselbe oder ein ähnlicher Kontext wiederverwendet, wird er mit 0,30 $ pro 1 Mio. Tokens statt 3,00 $ abgerechnet, eine Reduzierung um 90 %

  • Dies verbessert die Effizienz bei wiederkehrenden Workflows erheblich

  • Es ist besonders nützlich bei Anwendungen mit langem Kontext und Mehrfach-Interaktionen, bei denen ein großer gemeinsamer Kontext wiederholt gesendet wird

Output-Tokens

Output-Tokens werden vom Modell als Antwort auf eine Anfrage generiert. Sie stellen den tatsächlich vom KI generierten Inhalt dar, wie zum Beispiel:

  • Textantworten

  • Code-Generierung

  • Strukturierte Ausgaben Da die Erzeugung von Ausgaben zusätzliche Rechenleistung erfordert, ist sie in der Regel teurer als Input-Tokens.

Fazit

Kimi K3 bietet flexible Preise für Alltagsnutzer und Entwickler gleichermaßen: Mitgliedschaftspläne für das vollständige Kimi-Erlebnis und eine token-basierte API mit automatischem Context-Caching, das die Eingabekosten um 90 % senkt. Wählen Sie den Weg, der zu Ihrem Workflow passt, und starten Sie noch heute mit Kimi K3.

FAQ

Wie werden die API-Preise für Kimi K3 berechnet?
Die API-Preise für Kimi K3 basieren auf der Token-Nutzung und werden pro 1 Mio. Token (1.000.000 Token) abgerechnet. Eingabe-Token werden bei einem Cache-Fehltreffer mit 3,00 $ pro 1 Mio. Token berechnet, bei einem Cache-Treffer mit 0,30 $ pro 1 Mio. Token. Ausgabe-Token werden mit 15,00 $ pro 1 Mio. Token berechnet. Alle Preise verstehen sich zzgl. anfallender Steuern, die beim Checkout je nach Abrechnungsregion berechnet werden.
Wie viel kann ich durch Kontext-Caching sparen?
Wenn zuvor verarbeiteter Kontext wiederverwendet wird, werden zwischengespeicherte Eingabe-Token mit 0,30 $ pro 1 Mio. Token statt 3,00 $ abgerechnet – eine Reduzierung der Eingabekosten um 90 %. Das ist besonders nützlich bei Anwendungen mit langem Kontext und mehrstufigen Interaktionen, bei denen derselbe Kontext wiederholt gesendet wird.
Sollte ich die API oder ein Kimi-Mitgliedschaftspaket nutzen?
Nutzen Sie ein Kimi-Mitgliedschaftspaket, wenn Sie direkt im Kimi-Workspace auf Kimi K3 zugreifen möchten, inklusive Agent-Funktionen und extra-langem Chat-Speicher. Nutzen Sie die API, wenn Sie eigene Tools, Agents oder Produktionsanwendungen entwickeln, die programmatischen Zugriff und eine feingranulare Kontrolle über den Token-Verbrauch erfordern.
Wie viele Tokens unterstützt Kimi K3 pro Anfrage?
Kimi K3 unterstützt ein Kontextfenster von 1 Mio. Token (1.048.576 Token) und kann so ganze Codebasen, lange Dokumente und komplexe mehrstufige agentenbasierte Aufgaben in einer einzigen Anfrage verarbeiten.
Welche Mitgliedschaftspläne enthalten die extra-lange Chat-Kapazität von K3?
Die Pläne Allegro und Vivace schalten die extra-lange Chat-Kapazität von K3 frei und unterstützen Konversationen mit bis zu 1 Mio. Tokens Kontext. Alle anderen Mitgliedschaftsfunktionen, wie Agent-Aufgaben und Swarm, skalieren über die Stufen hinweg, wie in der Plan-Vergleichstabelle dargestellt.
Das könnte Ihnen auch gefallen
Kimi Work Dashboard: Personalisiertes KI-Dashboard und Widgets
Kimi Work Dashboard: Personalisiertes KI-Dashboard und Widgets
2026-07-23
Kimi Code: KI-Coding-Agent der nächsten Generation für Terminal & IDE
Kimi Code: KI-Coding-Agent der nächsten Generation für Terminal & IDE
2026-07-27
Kimi Claw: OpenClaw-Cloud-Bereitstellung per Klick & 24/7 AI Agent
Kimi Claw: OpenClaw-Cloud-Bereitstellung per Klick & 24/7 AI Agent
2026-07-22
Multi-Agent-System erklärt: Definition, Vorteile und Einsatzbereiche
Multi-Agent-System erklärt: Definition, Vorteile und Einsatzbereiche
2026-07-22
Parallele Agenten erklärt: Architektur, Muster und Anwendungsfälle
Parallele Agenten erklärt: Architektur, Muster und Anwendungsfälle
2026-07-22