Ollama

L'enshittification di Ollama: i primi segnali

L'enshittification di Ollama: i primi segnali

La mia opinione sullo stato attuale dello sviluppo di Ollama

Ollama è rapidamente diventato uno dei strumenti più popolari per eseguire LLM in locale. La sua semplice CLI e la gestione snella dei modelli lo hanno reso l’opzione preferita dagli sviluppatori che desiderano lavorare con i modelli AI al di fuori del cloud.

Interfacce di chat per istanze locali di Ollama

Interfacce di chat per istanze locali di Ollama

Panoramica rapida delle interfacce utente più prominenti per Ollama nel 2025

Locally hosted Ollama consente di eseguire modelli linguistici di grandi dimensioni sul proprio computer, ma l’utilizzo tramite riga di comando non è particolarmente utente-friendly. Ecco diversi progetti open-source che forniscono interfacce simili a ChatGPT che si connettono a un Ollama locale.

Come Ollama gestisce le richieste parallele

Come Ollama gestisce le richieste parallele

Comprendere la concorrenza di Ollama, l'implementazione delle code (queueing) e come ottimizzare OLLAMA_NUM_PARALLEL per garantire richieste parallele stabili.

Questa guida spiega come Ollama gestisce le richieste parallele (concorrenza, code di attesa e limiti delle risorse) e come ottimizzarlo utilizzando la variabile d’ambiente OLLAMA_NUM_PARALLEL (e le relative impostazioni).

Test di Deepseek-R1 su Ollama

Test di Deepseek-R1 su Ollama

Confronto tra due modelli deepseek-r1 e due modelli base

DeepSeek’s prima generazione di modelli di ragionamento con prestazioni paragonabili a quelle di OpenAI-o1, inclusi sei modelli densi distillati da DeepSeek-R1 basati su Llama e Qwen.