Docker

Ollama a vLLM: quando migrare il proprio server LLM locale

Ollama a vLLM: quando migrare il proprio server LLM locale

Quando passare da Ollama a vLLM

Ollama è uno dei modi più semplici per eseguire un modello linguistico locale, ma la comodità può nascondere il momento in cui un esperimento locale diventa un servizio di inferenza condiviso che richiede una migliore pianificazione e osservabilità.

Podman Quadlet vs Docker Compose per i servizi Linux

Podman Quadlet vs Docker Compose per i servizi Linux

Scegli il workflow dei container più adatto.

Docker Compose e Podman Quadlet risolvono problemi sovrapposti ma provengono da centri di progettazione diversi, e la scelta tra i due dipende dal fatto che si pensi in termini di stack di applicazioni o di servizi Linux.

Guida rapida per Vane (Perplexica 2.0) con Ollama e llama.cpp

Guida rapida per Vane (Perplexica 2.0) con Ollama e llama.cpp

Ricerca AI auto-ospitata con LLM locali

Vane è una delle voci più pragmatiche nel settore della “ricerca AI con citazioni”: un motore di risposta ospitato autonomamente che combina il recupero live sul web con LLM locali o cloud, mantenendo l’intera stack sotto il tuo controllo.

Ollama in Docker Compose con GPU e archiviazione persistente dei modelli

Ollama in Docker Compose con GPU e archiviazione persistente dei modelli

Server Ollama con approccio compose-first, GPU e persistenza.

Ollama funziona egregiamente su hardware nudo (bare metal). Diventa ancora più interessante quando lo si tratta come un servizio: un endpoint stabile, versioni bloccate, archiviazione persistente e una GPU che è disponibile o non lo è.

Strumenti per sviluppatori: La guida completa ai flussi di lavoro di sviluppo moderni

Strumenti per sviluppatori: La guida completa ai flussi di lavoro di sviluppo moderni

Lo sviluppo software prevede l’uso di Git per il controllo di versione, Docker per la containerizzazione, bash per l’automazione, PostgreSQL per i database e VS Code per l’editing, oltre a innumerevoli altri strumenti che possono fare o rompere la tua produttività. Questa pagina raccoglie le cheat sheet essenziali, i flussi di lavoro e i confronti di cui hai bisogno per lavorare in modo efficiente su tutto lo stack di sviluppo.