Faire tourner des LLM à poids ouverts localement derrière une API simple — de l’inférence privée sans coût au token. Derrière LiteLLM, c’est mon défaut pour l’inférence locale : classification, résumés, batch et tâches d’arrière-plan. Adopt pour ce rôle : les API de pointe gagnent encore sur le raisonnement difficile, alors je route par tâche — local par défaut, frontière quand le problème le mérite.
Ollama en Adopt — Confirmé par une pratique réelle ; mon choix par défaut dans le bon contexte.
Trajectoire
- AdoptPremière apparition