Self-Hosting

Comment Ollama gère les requêtes parallèles

Comment Ollama gère les requêtes parallèles

Comprendre la concurrence et la mise en file d'attente dans Ollama, et comment ajuster OLLAMA_NUM_PARALLEL pour des requêtes parallèles stables.

Ce guide explique comment Ollama gère les requêtes parallèles (concurrence, mise en file d’attente et limites de ressources), et comment l’optimiser à l’aide de la variable d’environnement OLLAMA_NUM_PARALLEL (et des paramètres associés).

Test de Deepseek-R1 sur Ollama

Test de Deepseek-R1 sur Ollama

« Comparaison de deux modèles deepseek-r1 avec deux modèles de base »

DeepSeek’s première génération de modèles de raisonnement avec des performances comparables à celles d’OpenAI-o1, incluant six modèles denses distillés à partir de DeepSeek-R1 basés sur Llama et Qwen.

Démarrage rapide de PyInstaller

Démarrage rapide de PyInstaller

Combiner un programme Python en un seul fichier

Utilisez PyInstaller pour empaqueter des programmes Python en exécutables autonomes. Il fonctionne sous Linux, Windows et Mac.

Ce n’est pas la méthode la plus efficace, mais elle est utilisable.