Comment choisir : K2.6 / K3 / K3 Cluster, intensité de réflexion et Agent
Kimi décide automatiquement d’utiliser ou non Internet selon votre question : vous n’avez donc pas à l’activer manuellement. Ce que vous devez choisir, en revanche, ce sont le modèle et l’intensité de réflexion ; pour les tâches complexes, vous pouvez également utiliser Agent et Agent Cluster.
Trois options de modèle
Utilisez le sélecteur de modèle au-dessus de la zone de saisie pour choisir :
| Modèle | Intensité de réflexion | Idéal pour | Crédits |
|---|---|---|---|
| K2.6 | Standard / Avancé | Conversations et questions-réponses rapides, avec des réponses plus véloces | Aucun crédit d’abonnement utilisé |
| K3 | Standard / Avancé / Extrême | Conversations et tâches Agent, avec les meilleures capacités globales | Décompté des crédits |
| K3 Cluster | Standard / Avancé / Extrême | Recherche à grande échelle, traitement par lots et réalisation en une seule fois de tâches volumineuses | Décompté des crédits |
- K3 peut produire de bout en bout des documents modifiables, comme des fichiers
.pptx,.docx,.xlsxet.pdf; K2.6 est optimisé pour les questions-réponses rapides et génère uniquement du texte, par exemple des plans de PPT, du corps de texte Word, du code, etc. - Pour la génération d’images / de vidéos / d’audio, cliquez sur « + » → Plugins, puis choisissez la fonctionnalité pertinente et utilisez-la avec K3.
Intensité de réflexion : Standard / Avancé / Extrême
Plus l’intensité de réflexion est élevée, plus le modèle raisonne en profondeur et, en général, plus le résultat est pertinent — mais il consomme aussi davantage de tokens.
- Si vous privilégiez la rapidité et une moindre consommation de crédits → choisissez Standard ;
- Si vous avez besoin d’un raisonnement plus poussé pour une analyse complexe ou des problèmes difficiles → choisissez Avancé ou Extrême (Extrême est pris en charge par K3 / K3 Cluster).
Agent et Agent Cluster
- Agent polyvalent : planifie et réalise automatiquement des tâches, notamment la génération de sites web, la création de PPT, Deep Research (recherche approfondie), ainsi que le traitement de documents et de feuilles de calcul.
- Agent Cluster : prend en charge plus de 4 000 appels d’outils en parallèle et peut coordonner de manière autonome jusqu’à 300 sous-agents (Sub-agents) en parallèle. Il est idéal pour les tâches à grande échelle telles que la recherche à grande échelle, la rédaction longue et le traitement par lots.
Que choisir selon le scénario
- Questions-réponses rapides et conversations du quotidien → K2.6 (n’utilise pas de crédits).
- Conversations complexes, rédaction de documents / création de PPT et de feuilles de calcul / tâches en plusieurs étapes → K3.
- Recherche à grande échelle, traitement par lots et rédaction très longue → K3 Cluster.
- Pour économiser des crédits → utilisez K2.6 ou réglez l’intensité de réflexion sur « Standard ».
FAQ
Le « Thinking Mode » n’est-il plus disponible ?
Kimi a fusionné « conversation » et « Agent » dans une seule expérience : ce ne sont donc plus des modes distincts. La « réflexion » se règle désormais en choisissant le modèle et l’intensité de réflexion — par exemple, utiliser K3 avec une intensité de réflexion plus élevée permet d’obtenir un raisonnement plus approfondi.
Quelle est la différence entre K2.6 et K3 ?
K2.6 est optimisé pour les questions-réponses rapides, répond plus vite et n’utilise pas les crédits d’abonnement. K3 offre les meilleures capacités globales, excelle dans les conversations complexes et les tâches Agent, peut produire de bout en bout des documents modifiables et est décompté des crédits.
Quelle est la différence entre K3 et K3 Cluster ?
K3 convient aux conversations ordinaires et aux tâches Agent. K3 Cluster s’appuie sur un parallélisme à grande échelle — des milliers d’appels d’outils et des centaines de sous-agents — pour gérer des tâches volumineuses comme la recherche à grande échelle, le traitement par lots et la rédaction très longue.
Quelle quantité de contenu peut être traitée en un seul tour ?
K2.6 prend en charge environ 128K tokens de contexte sur un seul tour (environ 50 000 à 60 000 caractères chinois) ; K3 offre une fenêtre de contexte d’un million de tokens (nécessite l’avantage d’abonnement de niveau le plus élevé). Consultez Que faire si une conversation dépasse 200 000 caractères chinois ? pour plus de détails.