Ai

ASIC LLM e chip dedicati all'inferenza (e il perché siano importanti)

ASIC LLM e chip dedicati all'inferenza (e il perché siano importanti)

Gli ASIC e i chip su misura aumentano la velocità e l'efficienza dell'inferenza dei LLM

Il futuro dell’AI non riguarda solo modelli più intelligenti. Riguarda anche un silicio che si adegua al modo in cui tali modelli vengono effettivamente serviti. L’hardware specializzato per l’inferenza LLM segue un percorso che richiama il passaggio del mining di Bitcoin dalle GPU agli ASIC dedicati, ma con vincoli più rigidi poiché i modelli e le tecniche di precisione continuano a evolversi.

DGX Spark vs. Mac Studio: un'analisi al ribasso del supercomputer personale AI di NVIDIA

DGX Spark vs. Mac Studio: un'analisi al ribasso del supercomputer personale AI di NVIDIA

Disponibilità, prezzi reali al dettaglio in sei paesi e confronto con Mac Studio.

NVIDIA DGX Spark è reale, in vendita dal 15 ottobre 2025, ed è rivolto agli sviluppatori CUDA che necessitano di lavori locali con LLM con uno stack NVIDIA AI integrato. Prezzo di listino USA $3.999; il prezzo al dettaglio nel Regno Unito/DE/JP è più alto a causa dell’IVA e dei canali di distribuzione. I prezzi pubblici AUD/KRW non sono ancora ampiamente pubblicati.

L'enshittification di Ollama: i primi segnali

L'enshittification di Ollama: i primi segnali

La mia opinione sullo stato attuale dello sviluppo di Ollama

Ollama è rapidamente diventato uno dei strumenti più popolari per eseguire LLM in locale. La sua semplice CLI e la gestione snella dei modelli lo hanno reso l’opzione preferita dagli sviluppatori che desiderano lavorare con i modelli AI al di fuori del cloud.

Interfacce di chat per istanze locali di Ollama

Interfacce di chat per istanze locali di Ollama

Panoramica rapida delle interfacce utente più prominenti per Ollama nel 2025

Locally hosted Ollama consente di eseguire modelli linguistici di grandi dimensioni sul proprio computer, ma l’utilizzo tramite riga di comando non è particolarmente utente-friendly. Ecco diversi progetti open-source che forniscono interfacce simili a ChatGPT che si connettono a un Ollama locale.

Rilevamento oggetti con Tensorflow

Rilevamento oggetti con Tensorflow

Un po' di tempo fa ho addestrato un riconoscitore oggetti AI

Un freddo giorno d’inverno a luglio… che è in Australia… ho avuto un forte bisogno di addestrare un modello AI per rilevare barre di armatura in calcestruzzo non chiuse…