Skip to content

Mammouth Code

Mammouth Code est l'agent de code de Mammouth AI dans votre terminal.

➡️ Obtenez votre clé API — nécessaire pour utiliser Mammouth Code.

Ce projet est open source et disponible sur GitHub.

Installation

Exécutez l'une des commandes suivantes dans votre terminal.

bash
curl -fsSL "https://code.mammouth.ai/install.sh" | bash
powershell
irm "https://code.mammouth.ai/install.ps1" | iex

Utilisation dans votre terminal

Tapez mammouth

Modèle par défaut

Lors de la première configuration de Mammouth Code, le modèle par défaut est mammouth-recommended — un raccourci qui pointe toujours vers le modèle que Mammouth considère actuellement comme offrant le meilleur rapport qualité-prix. Voir Mammouth Recommended pour plus de détails.

Utilisation dans votre IDE

Pour une expérience optimale, ouvrez Mammouth Code dans le terminal intégré de votre IDE (VS Code, Cursor, WebStorm, etc.) :

  1. Ouvrez le terminal intégré de votre IDE
  2. Naviguez vers le répertoire de votre projet
  3. Exécutez : mammouth

C'est tout — Mammouth Code démarrera une session interactive directement dans votre terminal.

Reprendre une session précédente

Il y a 2 façons de reprendre une session précédente :

  • Lancez mammouth comme d'habitude, puis utilisez la commande /sessions pour basculer vers une ancienne session.
  • Lancez mammouth -c pour reprendre la dernière session utilisée dans le dossier actuel.

Mise à jour

Pour mettre à jour Mammouth Code vers la dernière version :

bash
mammouth upgrade

Cela récupérera et installera la dernière version, remplaçant l'ancienne tout en conservant vos configurations et sessions.

Désinstallation

Pour supprimer complètement Mammouth Code de votre système :

bash
mammouth uninstall

Cela supprimera Mammouth Code ainsi que ses configurations et sessions.

Consommation de tokens dans Mammouth Code

Mammouth Code injecte dynamiquement des prompts système selon ce que vous lui demandez — ce qui explique les ~10k tokens supplémentaires que vous pourriez remarquer.

Ce qui pourrait ressembler à des prompts "lourds" économise en réalité des tokens sur les grands projets : ils permettent au LLM de lire uniquement les fichiers pertinents, plutôt que de charger tout votre codebase dans le contexte. Cette surcharge semble importante lorsque vous travaillez sur un seul fichier, mais le véritable objectif est de diriger la requête vers le bon outil pour la tâche à accomplir.

Une règle simple :

  • 📁 Utilisez Mammouth Code si votre projet compte plus de 10 fichiers, ou si vous travaillez avec un contexte long — ce qui couvre la plupart des projets de programmation réels.
  • 💬 Utilisez l'interface Mammouth standard si vous traitez un contexte gérable : deux ou trois fichiers, ~500 lignes maximum (ex. essayer de comprendre une fonction spécifique — sauf si vous êtes plongé dans des classes OOP à triple héritage 😄).

Suivi de la consommation

Veuillez noter que l'estimateur de coût et de consommation affiché dans Mammouth Code n'est pas nécessairement exact en temps réel. Pour suivre votre consommation réelle de l'API, veuillez consulter la page mammouth.ai/app/account/api.

Note sur Claude Haiku : Ce modèle plus petit est actuellement utilisé pour générer les titres de session. Cela sera configurable dans une prochaine mise à jour.

Niveaux d'effort du modèle

Lorsque vous utilisez Mammouth Code, vous pouvez changer de variante de modèle en appuyant sur Ctrl+P et en sélectionnant Switch model variant (ou Ctrl+T pour parcourir rapidement les variantes). Cela vous permet de choisir un niveau d'effort pour les modèles pris en charge.

Qu'est-ce que les niveaux d'effort ?

Les niveaux d'effort contrôlent la réflexion étendue — le temps et les tokens que le modèle consacre au raisonnement avant de répondre.

NiveauRaisonnementIdéal pour
DefaultDésactivéTâches standards, réponse la plus rapide, coût en tokens minimal
LowActivé (minimal)Tâches simples qui bénéficient d'un léger raisonnement
MediumActivé (modéré)La plupart des tâches — bon équilibre entre vitesse et profondeur
HighActivé (maximal)Problèmes complexes, décisions d'architecture, bugs difficiles

Un effort plus élevé signifie un raisonnement plus approfondi, mais des réponses plus lentes et une consommation de tokens plus importante.

INFO

Tous les modèles ne prennent pas en charge les niveaux d'effort. La réflexion étendue n'est disponible que sur certains modèles. Pour les modèles qui ne la prennent pas en charge, cette option ne sera pas disponible.

Quand utiliser chaque niveau

  • 🟢 Default — Modifications rapides, questions simples, navigation dans les fichiers
  • 🔵 Low — Refactoring, ajouts de petites fonctionnalités
  • 🟡 Medium — Tâches multi-étapes, débogage, revues de code
  • 🔴 High — Algorithmes complexes, décisions architecturales, bugs difficiles à reproduire