Un Modelfile est le plan utilisé par Ollama pour créer un modèle personnalisé. Il référence un modèle de base et peut fixer un message système, des paramètres, un template ou un adaptateur.
Créer une configuration minimale
Créez un fichier nommé Modelfile :
FROM gemma3
PARAMETER temperature 0.2
PARAMETER num_ctx 4096
SYSTEM Tu es un assistant technique francophone. Réponds avec concision et signale tes incertitudes.FROM est obligatoire. Utilisez un nom et un tag de modèle explicites pour rendre la construction reproductible. Une température basse réduit la variabilité sans garantir l’exactitude.
Construire et exécuter
ollama create assistant-technique -f ./Modelfile
ollama run assistant-techniqueInspectez la configuration générée :
ollama show --modelfile assistant-techniqueChoisir les instructions
Les directives principales sont :
FROMpour le modèle de base ou un fichier GGUF ;PARAMETERpour le contexte, la température ou les limites de génération ;SYSTEMpour le comportement général ;TEMPLATEpour le format exact du prompt ;ADAPTERpour appliquer un adaptateur LoRA compatible ;LICENSEetMESSAGEpour documenter la licence ou fournir des exemples de conversation.
Ne remplacez pas le template fourni par le modèle sans raison : les tokens spéciaux varient entre familles et un template incorrect dégrade fortement les réponses.
Tester la personnalisation
Préparez des prompts couvrant le comportement attendu, les refus, une demande ambiguë et un contexte long. Comparez le modèle dérivé au modèle de base. Vérifiez aussi que num_ctx reste compatible avec votre mémoire disponible.
Versionner sans copier les poids
Commitez le Modelfile, les prompts d’évaluation et le nom exact du modèle de base, mais pas les poids téléchargés. Notez la version minimale d’Ollama avec REQUIRES si vous dépendez d’une fonction récente.
Un Modelfile rend une configuration partageable ; il ne remplace ni un fine-tuning ni une évaluation. Gardez-le court et mesurable afin de savoir quelle instruction améliore ou dégrade le résultat.