Prometheus

Schnellstart für llama.cpp mit CLI und Server

Schnellstart für llama.cpp mit CLI und Server

OpenCode installieren, konfigurieren und verwenden

Ich komme immer wieder auf llama.cpp für lokale Inferenz zurück – es bietet eine Kontrolle, die Ollama und andere abstrahieren, und es funktioniert einfach. GGUF-Modelle lassen sich mit llama-cli interaktiv und mühelos ausführen oder eine OpenAI-kompatible HTTP-API mit llama-server bereitstellen.