Deployment & Inference ★ 118.0k

Ollama

Satu perintah untuk menjalankan LLM di laptop — cara tercepat menampilkan model ke klien.

Ollama menggabungkan bobot model, kuantisasi, dan server lokal dalam satu CLI. Ini langkah pertama standar untuk demo, pilot di jaringan terisolasi, dan mesin developer, meski kebanyakan tim akhirnya pindah ke serving stack khusus untuk traffic nyata.

Cocok untuk: Demo lokal, pilot air-gapped, mesin developer

Deployment: Bisa self-host