Comment choisir : K2.6 / K3 / K3 Cluster, intensité de réflexion et Agent
Kimi décide automatiquement, selon votre question, s’il doit utiliser Internet : vous n’avez donc pas à l’activer vous-même. En revanche, vous devez choisir le modèle et l’intensité de réflexion ; pour les tâches complexes, vous pouvez également utiliser Agent et Agent Cluster.
Trois options de modèle
Utilisez le sélecteur de modèle situé au-dessus de la zone de saisie pour choisir :
| Modèle | Intensité de réflexion | Idéal pour | Crédits |
|---|---|---|---|
| K2.6 | Standard / Avancé | Conversations rapides et questions-réponses, avec des réponses plus rapides | Aucun crédit d’abonnement consommé dans Chat |
| K3 | Standard / Avancé / Extrême | Conversations et tâches Agent, avec les meilleures capacités globales | Décompté des crédits |
| K3 Cluster | Standard / Avancé / Extrême | Recherche à grande échelle, traitement par lots et exécution en une seule fois de tâches très volumineuses | Décompté des crédits |
- K3 peut produire de bout en bout des documents modifiables, comme des fichiers
.pptx,.docx,.xlsxet.pdf; K2.6 est optimisé pour les questions-réponses rapides et ne génère que du texte, par exemple des plans de PPT, du corps de texte Word, du code, etc. - Pour la génération d’images, de vidéos ou d’audio, cliquez sur « + » → Plugins, puis choisissez la fonctionnalité correspondante et utilisez-la avec K3.
La gratuité de K2.6 et l’absence de consommation de crédits ne s’appliquent que dans Chat (le sélecteur de modèle au-dessus de la zone de saisie). Utilisé comme Agent K2.6 dans Kimi Work, il consomme tout de même des crédits d’abonnement.
Intensité de réflexion : Standard / Avancé / Extrême
Plus l’intensité de réflexion est élevée, plus le modèle raisonne en profondeur et, en général, plus le résultat est pertinent — mais il utilise aussi davantage de tokens.
- Si vous privilégiez la rapidité et une consommation réduite de crédits → choisissez Standard ;
- Si vous avez besoin d’un raisonnement plus poussé pour une analyse complexe ou un problème difficile → choisissez Avancé ou Extrême (Extrême est pris en charge par K3 / K3 Cluster).
Agent et Agent Cluster
- Agent polyvalent : planifie et exécute automatiquement des tâches, notamment la génération de sites web, la création de PPT, Deep Research (recherche approfondie), ainsi que le traitement de documents et de feuilles de calcul.
- Agent Cluster : prend en charge plus de 4 000 appels d’outils en parallèle et peut coordonner de manière autonome jusqu’à 300 sous-agents (Sub-agents) en parallèle. Il est idéal pour les tâches à grande échelle comme la recherche à grande échelle, la rédaction longue et le traitement par lots.
Que choisir selon le cas d’usage
- Questions-réponses rapides et conversations du quotidien → K2.6 (aucun crédit consommé dans Chat).
- Conversations complexes, rédaction de documents / création de PPT et de feuilles de calcul / tâches en plusieurs étapes → K3.
- Recherche à grande échelle, traitement par lots et rédaction très longue → K3 Cluster.
- Pour économiser des crédits → utilisez K2.6, ou réglez l’intensité de réflexion sur « Standard ».
FAQ
« Thinking Mode » n’est-il plus disponible ?
Kimi a intégré la « conversation » et « Agent » dans une même expérience : il ne s’agit donc plus de modes séparés. La « réflexion » se règle désormais en choisissant le modèle et l’intensité de réflexion — par exemple, utiliser K3 avec une intensité de réflexion plus élevée permet d’obtenir un raisonnement plus approfondi.
Quelle est la différence entre K2.6 et K3 ?
K2.6 est optimisé pour les questions-réponses rapides, répond plus vite et ne consomme pas de crédits d’abonnement dans Chat. K3 offre les meilleures capacités globales, excelle dans les conversations complexes et les tâches Agent, peut produire de bout en bout des documents modifiables et est décompté des crédits.
Quelle est la différence entre K3 et K3 Cluster ?
K3 convient aux conversations courantes et aux tâches Agent. K3 Cluster s’appuie sur un parallélisme à grande échelle — des milliers d’appels d’outils et des centaines de sous-agents — pour traiter des tâches volumineuses comme la recherche à grande échelle, le traitement par lots et la rédaction très longue.
Quelle quantité de contenu peut être traitée en un seul tour ?
K2.6 prend en charge environ 128K tokens de contexte sur un seul tour (soit à peu près 50 000 à 60 000 caractères chinois) ; K3 offre une fenêtre de contexte de 1 million de tokens (nécessite l’avantage d’abonnement du niveau le plus élevé). Pour en savoir plus, consultez Que faire si une conversation dépasse 200 000 caractères chinois ?.