Ollama
Scarica, gestisce ed esegue modelli linguistici in locale con un comando. Pensa a
docker, ma per gli LLM: ollama run llama3 e sei operativo.
Espone anche un'API HTTP così altri programmi possono usarlo.
Gira su Linux, macOS e Windows · CPU o GPU.