Tryb routera Llama-Server – dynamiczne przełączanie modeli bez restartu
Serwuj i przełączaj modele LLM bez restartów.
Przez długi czas llama.cpp miała rażący ograniczenie:
można było obsłużyć tylko jeden model na proces, a przełączanie wymagało ponownego uruchomienia.