Documentation

Modèles & IA

Quels modèles sont dans le catalogue, ce que fait Auto, et ce que ça coûte.

Mis à jour le 10 septembre 2026

Kaivo envoie tes messages vers des modèles gratuits (Groq, OpenRouter, Gemini, Mistral…). Tu paies en crédits Kaivo, pas une facture OpenAI ou Claude.

Mode Auto

En Auto, Kaivo lit le message et choisit un modèle free qui tient la route. Sur l’agent, c’est le palier Flash, Pro ou Lite qui décide du moteur.

Parcours d’un message

  1. Tu envoies le message (effort, images, workspace éventuel).
  2. Kaivo vérifie la session et débite les crédits.
  3. Le run part vers Groq / OpenRouter / autre provider free.
  4. Si erreur ou quota, un fallback free est tenté.
  5. La réponse stream arrive dans le chat ou l’IDE.

Coûts de base (Chat, indicatif)

ModèleBase
Llama 3.1 8B (Groq)1 cr.
GPT-OSS 20B3 cr.
Llama 3.3 70B6 cr.
GPT-OSS 120B7 cr. (parfois restreint)
Kaivo Chat (forfait)9 cr. hors effort

Limites pratiques

  • ~20 messages / minute / compte
  • Contexte selon le modèle (souvent 8k–128k)
  • Images : nombre limité par message

KaivoIA by Klizeny · Documentation officielle

Modèles & IA · Docs