Ton IA en local

Un modèle libre et remplaçable, qui tourne chez toi. Attention à l’honnêteté : un LLM local performant demande un GPU.

Ce que « local » veut dire

Le modèle tourne sur une machine que tu contrôles, pas chez une plateforme. Tes échanges ne sortent pas. En échange, tu fournis le matériel.

La contrainte matérielle (à dire clairement)

  • Sans GPU : un petit modèle peut suffire pour des tâches simples, mais pas pour de la qualité « assistant ».
  • Avec GPU : la VRAM (mémoire du GPU) détermine la taille du modèle que tu peux charger.
  • [À COMPLÉTER : ta configuration matérielle réelle et ses limites]

Quand choisir le local

  • Données sensibles que tu ne veux pas envoyer ailleurs.
  • Usage intensif où l’abonnement à une API coûterait cher.
  • Envie d’apprendre et de garder le contrôle.

Sinon : une API remplaçable

Si le local n’est pas réaliste pour toi, tu utilises une API — mais via un routeur qui te laisse changer de modèle sans réécrire ton système. C’est l’objet de OpenRouter.

Questions fréquentes

Un LLM local, c’est gratuit ?

Le logiciel est souvent libre, mais un modèle performant demande du matériel (GPU, VRAM) et de l’électricité. [À COMPLÉTER : chiffres réels si tu en as]

Puis-je faire tourner un gros modèle sur un petit serveur ?

Non. Sans GPU, un modèle local performant est irréaliste. On adapte la taille du modèle au matériel. [À COMPLÉTER : repères matériels]