Kimi K3 ist das weltweit erste offene Modell der 3T-Klasse, ein Flaggschiff-Modell mit 2,8 Billionen Parametern, das für Spitzenintelligenz bei langfristigem Coding, Wissensarbeit und Reasoning entwickelt wurde, mit nativer Bildverarbeitung und einem Kontextfenster von 1 Mio. Tokens. Es ist über Kimi.com, Kimi Work, Kimi Code und die Kimi API verfügbar. Im Folgenden finden Sie einen Überblick über die Kimi-Mitgliedschaftspläne und die Kimi K3 API-Preise, damit Sie den passenden Zugangsweg wählen können.
Kimi K3 Mitgliedschaftspläne & Nutzungsstufen
Der einfachste Weg, Kimi K3 zu nutzen, ist über eine Kimi-Mitgliedschaft. Kimi bietet gestaffelte Pläne, die mit Ihren Anforderungen skalieren, von gelegentlicher täglicher Nutzung bis hin zu intensiven agentischen Workflows. Höhere Stufen schalten mehr Agent-Guthaben, höhere Nebenläufigkeit und eine extra-lange Chat-Kapazität von bis zu 1 Mio. Tokens frei, angetrieben von Kimi K3.
| Adagio | Moderato | Allegretto | Allegro | Vivace | |
|---|---|---|---|---|---|
| Jährliche Abrechnung (effektiv monatlich) | 0 $ / Monat | 15 $ / Monat | 31 $ / Monat | 79 $ / Monat | 159 $ / Monat |
| Gleichzeitige Agent-Aufgaben | 1 Aufgabe | 2 Aufgaben | 2 Aufgaben | 4 Aufgaben | 4 Aufgaben |
| Prioritäts-Warteschlange für Agents | × | 4-fache Geschwindigkeit | 4-fache Geschwindigkeit | 4-fache Geschwindigkeit | 4-fache Geschwindigkeit |
| K3 Extra-langer Chat-Speicher (bis zu 1 Mio. Token) | × | × | × | ✓ | ✓ |
| Anpassbares Dashboard | ✓ | ✓ | ✓ | ✓ | ✓ |
| Geplante Aufgaben | 2 Aufgaben | 10 Aufgaben | 15 Aufgaben | 20 Aufgaben | 25 Aufgaben |
| Widget-Aufgabe | 2 Aufgaben | 10 Aufgaben | 15 Aufgaben | 20 Aufgaben | 25 Aufgaben |
| Plugins | Über 15 Typen unterstützt | Über 15 Typen unterstützt | Über 15 Typen unterstützt | Über 15 Typen unterstützt | Über 15 Typen unterstützt |
| Swarm | × | ✓ | ✓ | ✓ | ✓ |
| Swarm-Ausführung von Teilaufgaben | × | 2 Subagenten | 4 Subagenten | 8 Subagenten | 8 Subagenten |
| Dream Memory | × | ✓ | ✓ | ✓ | ✓ |
| Selbstentwickelnde Skills | × | ✓ | ✓ | ✓ | ✓ |
| Ziel | × | × | ✓ | ✓ | ✓ |
| Kimi Claw (Web, Android, PC) | × | × | ✓ | ✓ | ✓ |
| Gruppenchat mit Claw | × | × | 10 Gruppenchats | 10 Gruppenchats | 10 Gruppenchats |
| Eine Website mit Datenbank bereitstellen | × | ✓ | ✓ | ✓ | ✓ |
Alle oben genannten Preise beziehen sich auf jährliche Abrechnung. Monatliche Abrechnung ist ebenfalls verfügbar, zu 19 $, 39 $, 99 $ bzw. 199 $ pro Monat. Allegro und Vivace schalten die extra-lange Chat-Kapazität von K3 frei und unterstützen bis zu 1 Mio. Tokens Kontext für sehr lange Konversationen, große Codebasen und dokumentenintensive Recherchen. Aktuelle Details zu den Plänen finden Sie auf der offiziellen Mitgliedschaftsseite.
Kimi K3 API-Preise
Die Kimi K3 API-Preise basieren auf einem token-basierten Modell, bei dem die Nutzung pro 1 Mio. Tokens (1.000.000 Tokens) sowohl für Eingabe- als auch für Ausgabeverarbeitung abgerechnet wird, was eine klare und vorhersehbare Kostenkontrolle ermöglicht.
| Modell | Einheit | Eingabepreis (Cache-Treffer) | Eingabepreis (Cache-Fehltreffer) | Ausgabepreis | Kontextfenster |
|---|---|---|---|---|---|
| kimi-k3 | 1 Mio. Token | $0.30 | $3.00 | $15.00 | 1.048.576 Token |
Kimi K3 ist Kimis Flaggschiff-Modell für langfristiges Coding und durchgängige Wissensarbeit. Es denkt stets im Reasoning-Modus, wobei der Reasoning-Aufwand über das Top-Level-Feld reasoning_effort festgelegt wird. Das Modell unterstützt automatisches Context-Caching, Tool-Aufrufe, den JSON-Modus, strukturierte Ausgaben und ein vollständiges Kontextfenster von 1 Mio. Tokens in einer einzigen Anfrage.
Wie die Kimi K3 API-Abrechnung funktioniert
Die Kimi K3 API verwendet für jede Anfrage ein token-basiertes Preismodell, bei dem jede Interaktion mit dem Modell Tokens verbraucht, die je nach Typ abgerechnet werden. Innerhalb dieses Modells werden Tokens grundsätzlich in drei Typen unterteilt: Input-Tokens, gecachte Input-Tokens und Output-Tokens.
Input-Tokens
Input-Tokens umfassen alles, was an das Modell gesendet wird, einschließlich:
Nutzer-Prompts
Systemanweisungen
Konversationsverlauf oder Kontext Diese Tokens bestimmen, wie viel Kontext das Modell verarbeiten muss, bevor es eine Antwort generiert. Mit einem Kontextfenster von 1 Mio. Tokens kann Kimi K3 ganze Codebasen, lange Dokumente und umfangreiche Mehrfach-Interaktionsverläufe in einer einzigen Anfrage aufnehmen.
Gecachte Input-Tokens
Gecachte Input-Tokens entstehen, wenn zuvor verarbeiteter Kontext wiederverwendet wird.
Wird derselbe oder ein ähnlicher Kontext wiederverwendet, wird er mit 0,30 $ pro 1 Mio. Tokens statt 3,00 $ abgerechnet, eine Reduzierung um 90 %
Dies verbessert die Effizienz bei wiederkehrenden Workflows erheblich
Es ist besonders nützlich bei Anwendungen mit langem Kontext und Mehrfach-Interaktionen, bei denen ein großer gemeinsamer Kontext wiederholt gesendet wird
Output-Tokens
Output-Tokens werden vom Modell als Antwort auf eine Anfrage generiert. Sie stellen den tatsächlich vom KI generierten Inhalt dar, wie zum Beispiel:
Textantworten
Code-Generierung
Strukturierte Ausgaben Da die Erzeugung von Ausgaben zusätzliche Rechenleistung erfordert, ist sie in der Regel teurer als Input-Tokens.
Fazit
Kimi K3 bietet flexible Preise für Alltagsnutzer und Entwickler gleichermaßen: Mitgliedschaftspläne für das vollständige Kimi-Erlebnis und eine token-basierte API mit automatischem Context-Caching, das die Eingabekosten um 90 % senkt. Wählen Sie den Weg, der zu Ihrem Workflow passt, und starten Sie noch heute mit Kimi K3.