Aller au contenu

Les cinq premières étapes portent sur ce qu’on connecte au modèle, les deux dernières sur ce qu’il faut pour l’exécuter chez soi. Les deux moitiés se lisent indépendamment.

Les étapes

11 étapes · environ 71 min de lecture

Commencer par « Interface de programmation (API) »

  1. Le point d'accès réseau élémentaire pour envoyer du texte à un modèle distant et récupérer ses prédictions.

    6 min de lecture

  2. Appel d'outilsÉcosystème

    La brique logicielle qui permet au modèle d'émettre des requêtes structurées pour faire exécuter du code par l'application hôte.

    6 min de lecture

  3. Le verrouillage d'échantillonnage qui garantit à 100 % le respect des schémas JSON et des formats de données sans aucune erreur de syntaxe.

    6 min de lecture

  4. Un modèle ne connaît que ses données d'entraînement. Le RAG est la façon la plus répandue de lui donner accès à autre chose.

    7 min de lecture

  5. Les documents ne suffisent pas toujours : il faut parfois appeler un vrai outil. MCP est le protocole qui standardise ces branchements.

    7 min de lecture

  6. Agent (IA)Écosystème

    Avec des outils vient l'envie de laisser le modèle décider quand s'en servir. C'est la définition d'un agent, et c'est là que sont ses limites.

    7 min de lecture

  7. Mamba, modèles à espace d'états et réseaux récurrents modernes : les structures qui tentent de dépasser le Transformeur sur les très longs contextes.

    6 min de lecture

  8. QuantificationOptimisation

    Changement de sujet : faire tourner tout ça. La quantification réduit la place que prennent les poids, et le simulateur montre ce qu'on y perd.

    7 min de lecture

  9. Tailler dans le vif du modèle : supprimer les connexions et les couches inutiles pour accélérer l'exécution.

    6 min de lecture

  10. GGUFOptimisation

    Le format qui emballe un modèle quantifié pour le faire tourner sur un ordinateur portable.

    7 min de lecture

  11. La révolution de l'IA embarquée : pourquoi les modèles compacts de moins de 4B sur NPU transforment les usages sans passer par le cloud.

    6 min de lecture