Je vais vous montrer quelque chose que je fais dans mes conférences et qui surprend toujours les dirigeants : on peut faire tourner un modèle de langage localement, sur un Mac, sans internet, sans compte, sans licence, sans rien payer... et ça prend littéralement trois commandes. Et bien c'est ça, l'IA locale, et c'est beaucoup plus simple que ce que la plupart des DSI imaginent.

Le matériel : vous avez peut-être déjà tout

Si vous avez un Mac récent avec une puce Apple Silicon, un M1, M2, M3 ou M4, et bien vous avez déjà ce qu'il faut. La mémoire unifiée d'Apple, c'est un GPU gratuit, on n'y pense pas assez : la mémoire qui sert à votre système sert aussi au modèle, il n'y a pas besoin d'acheter une carte graphique séparée. Et puis si vous voulez passer à l'échelle, un serveur avec un GPU de 16 à 24 Go de VRAM, ça coûte entre 2 000 et 15 000 euros selon ce que vous choisissez... une RTX 4090, une L40S, ou un GPU de data center d'occasion.

Et pour tester avant d'investir le moindre euro, et bien même un Raspberry Pi 5 avec 8 Go de RAM peut faire tourner un petit modèle quantifié. J'en ai un sur mon bureau, il fait du résumé de texte, de l'extraction d'informations, de la classification... les mêmes tâches que des entreprises paient à l'API chaque jour, pour chaque employé, à chaque requête. Sur la Pi, ça ne coûte rien.

Le logiciel : Ollama, gratuit

Côté logiciel, il vous faut Ollama, c'est un runtime qui sert les modèles open source via une API locale, et il est gratuit. Et puis il vous faut un modèle, et là aussi c'est gratuit : Llama de Meta, Mistral, Qwen... tous ces modèles sont open source, quantifiés, téléchargeables. Vous les téléchargez une fois, après ils sont sur votre machine, personne ne peut vous couper l'accès, personne ne peut changer le prix.

Étape 1 : installer Ollama

curl -fsSL https://ollama.com/install.sh | sh # une commande. c'est installé.

Et bien voilà, Ollama est installé. Pas de compte à créer, pas de licence à accepter, pas de cloud à configurer... une commande et c'est fait.

Étape 2 : télécharger un modèle

ollama pull qwen2.5:3b # 2 Go. téléchargé une fois. après c'est local.

Le modèle est sur votre machine. Il fait 2 Go, il a été téléchargé une fois, et maintenant il est là, il reste là, et il ne partira pas. C'est un point que je veux souligner parce qu'il est fondamental : vous ne dépendez plus d'un serveur distant, d'une connexion internet, ou d'une décision d'une entreprise américaine de maintenir l'accès.

Étape 3 : interroger l'API locale

curl localhost:11434/api/generate \ -d '{"model":"qwen2.5:3b", "prompt":"Résume ce texte"}' # API locale. pas de token. pas de facture.

L'API tourne sur localhost, c'est-à-dire sur votre machine. Les données ne quittent jamais votre réseau, le coût est zéro, et vous pouvez couper le wifi, mettre l'ordinateur en mode avion, et bien ça continue à tourner... je le fais en démo dans mes conférences, et à chaque fois les dirigeants sont surpris de voir que ça marche sans réseau.

Ce que vous n'avez pas eu à faire

Et c'est là que je veux qu'on prenne un instant pour réaliser ce qu'il ne s'est pas passé : vous n'avez pas eu à demander l'autorisation à un fournisseur, négocier un contrat, attendre une validation, envoyer vos données quelque part, signer une clause de confidentialité, vérifier la conformité RGPD d'un transfert hors UE... rien de tout ça. Et bien c'est ça, la souveraineté technique, et elle est accessible à n'importe quelle entreprise qui a un Mac ou un serveur.

Après l'achat : de l'électricité

Une fois que vous avez le matériel et le modèle, ce que ça coûte, c'est de l'électricité. Pas de token, pas d'abonnement par utilisateur, pas de surprise en fin de mois, pas de facture qui triple en 30 jours. La barrière technique, elle est plus basse qu'on ne le pense... c'est la barrière mentale qui est plus haute, et c'est celle qu'il faut faire tomber en premier.

Si vous voulez voir ça tourner sur votre machine et que vous ne savez pas par où commencer, et bien c'est exactement le genre de chose que je montre dans mes ateliers, et je suis à votre disposition pour en organiser un.