Rédaction en français correcte dès la variante 2b.
Commande à taper
ollama pull gemma2:9b
5.1 Go à télécharger · 6,6 Go de mémoire estimés
Spécialisé code, utilisable hors ligne pendant une coupure réseau.
Commande à taper
ollama pull qwen2.5-coder:7b
4.4 Go à télécharger · 5,7 Go de mémoire estimés
Bon niveau en français pour sa taille ; la variante 0.5b tient sur presque toutes les machines.
Commande à taper
ollama pull qwen2.5:7b
4.4 Go à télécharger · 5,7 Go de mémoire estimés
Mistral 7B
Mistral AI · Apache 2.0
Plus grande variante qui tient : 7b
Modèle francophone sous licence permissive, référence pour 8 Go de RAM.
Commande à taper
ollama pull mistral:7b
4.1 Go à télécharger · 5,3 Go de mémoire estimés
Décrit une image et lit un document simple, sans envoyer le fichier sur Internet.
Commande à taper
ollama pull llava:7b
3.8 Go à télécharger · 5 Go de mémoire estimés
Plus grande variante qui tient : 3.8b
Licence MIT et faible empreinte ; français plus faible que Qwen ou Mistral.
Commande à taper
ollama pull phi3.5:3.8b
2.0 Go à télécharger · 2,6 Go de mémoire estimés
Conçu pour les petites configurations ; licence communautaire, pas une licence libre.
Commande à taper
ollama pull llama3.2:3b
1.9 Go à télécharger · 2,4 Go de mémoire estimés
Nomic Embed Text
Nomic AI · Apache 2.0
Plus grande variante qui tient : latest
Vectorisation pour une recherche documentaire locale ; très léger.
Commande à taper
ollama pull nomic-embed-text:latest
262 Mo à télécharger · 0,3 Go de mémoire estimés
Tailles lues dans les manifestes publics du registre Ollama au moment de la consultation, majorées de 30 % pour l’exécution. Une estimation de mémoire ne dit rien de la vitesse obtenue : sur processeur seul, un modèle qui tient peut rester lent. La licence reste celle du producteur et doit être lue avant tout usage professionnel.