Selfhosting

Introduction à llama.cpp avec CLI et Serveur

Introduction à llama.cpp avec CLI et Serveur

Comment installer, configurer et utiliser OpenCode

Je reviens sans cesse à llama.cpp pour l’inférence locale : il vous offre un contrôle que Ollama et d’autres solutions abstraissent, et il fonctionne simplement. Il est facile d’exécuter des modèles GGUF de manière interactive avec llama-cli ou d’exposer une API HTTP compatible OpenAI avec llama-server.

Frontends LLM

Frontends LLM

« Il n’y en a pas tant à choisir, mais quand même… »

Lorsque j’ai commencé à expérimenter avec les LLM, leurs interfaces utilisateur étaient en plein développement et aujourd’hui, certaines d’entre elles sont vraiment excellentes.