Ollama
Ollama è un runner LLM locale open-source molto popolare che permette agli sviluppatori di eseguire modelli open-weights di punta come Llama e Gemma completamente offline sull'hardware consumer locale. Fornendo un endpoint API locale pulito, è diventato lo standard d'oro per lo sviluppo di applicazioni AI con la privacy come priorità.