Usuń wszystkie modele routera llama.cpp bez restartowania

Usuń wszystkie modele routera llama.cpp bez restartowania

Darmowa pamięć VRAM bez zabijania llama-server.

Tryb routera w llama.cpp to jedna z najbardziej przydatnych zmian wprowadzonych do llama-server w ciągu ostatnich lat. Wreszcie daje lokalnym operatorom modeli LLM coś w rodzaju zarządzania modelami, do którego są przyzwyczajeni z Ollama, jednocześnie zachowując surową wydajność i kontrolę na niskim poziomie, która sprawia, że warto korzystać z llama.cpp w pierwszej kolejności.

Pobieranie vs. reprezentacja w systemach wiedzy

Pobieranie vs. reprezentacja w systemach wiedzy

Wyszukiwanie nie jest strukturą wiedzy

Większość współczesnych systemów wiedzy optymalizuje wyszukiwanie (retrieval), co jest zrozumiałe. Wyszukiwanie jest widoczne, łatwe do demonstracji i wydaje się magiczne, gdy działa poprawnie. Wpisujesz pytanie, otrzymujesz odpowiedź.

Drugi mózg wyjaśniony dla inżynierów i pracowników wiedzy

Drugi mózg wyjaśniony dla inżynierów i pracowników wiedzy

Notatki to pamięć. Drugi mózg to obliczenia.

Przeladowanie informacyjne ma mniej wspólnego z samą objętością danych, a bardziej z nierozwiązanymi wejściami. Współczesna praca oparta na wiedzy pozostawia po sobie ślad w postaci zakładek, wątków czatowych, dokumentów, zaznaczeń, fragmentów tekstu, transkrypcji, zrzutów ekranu oraz niedopisanych notatek.

Idempotentność w rozproszonych systemach, która naprawdę działa

Idempotentność w rozproszonych systemach, która naprawdę działa

Zatrzymaj duplikujące efekty uboczne

Idempotentność w rozproszonych systemach to cecha, która ratuje Cię, gdy sieć kłamie, kolejka ponawia próby, klient panikuje, a operator wciska odtwarzanie. W systemach produkcyjnych wielokrotne dostarczanie danych jest normalne. Wielokrotne efekty uboczne to błąd.

Sterowanie głosem Hermes z telefonu

Sterowanie głosem Hermes z telefonu

Pozwól, by Hermes rozmawiał z Tobą przez telefon

Już teraz rozmawiasz z agentem Hermes przez telefon za pomocą wiadomości tekstowych. Teraz chcesz rozmawiać z nim bezpośrednio i otrzymywać odpowiedzi w formie mowy. Zazwyczaj jest to słuszny krok, zwłaszcza jeśli już korzystasz z Hermesa jako trwałego, lokalnie hostowanego asystenta. Pisanie długich promptów na małym ekranie jest powolne i podatne na błędy.

Tworzenie umiejętności agenta Hermes — struktura pliku SKILL.md i najlepsze praktyki

Tworzenie umiejętności agenta Hermes — struktura pliku SKILL.md i najlepsze praktyki

Autor Hermes oferuje umiejętności, które ładują się szybko i działają niezawodnie

Hermes Agent traktuje umiejętności (skills) jako domyślny sposób nauczania powtarzalnych procesów. Oficjalna dokumentacja opisuje je jako dokumenty wiedzy dostępne na żądanie, zgodne z otwartym schematem agentskills.io, ładowanymi poprzez stopniową ekspozycję (progressive disclosure), dzięki czemu model widzi najpierw mały indeks i pobiera pełne instrukcje dopiero wtedy, gdy zadanie ich faktycznie wymaga.

Porównanie dostawców pamięci agentów — Honcho, Mem0, Hindsight i pięć innych

Porównanie dostawców pamięci agentów — Honcho, Mem0, Hindsight i pięć innych

Osiem wymiennych backendów do trwałej pamięci agenta.

Współczesne asystenty nadal zapominają wszystko po zamknięciu karty, chyba że dane są utrwalone poza oknem kontekstu. Dostawcy pamięci agentów to usługi lub biblioteki przechowujące fakty i streszczenia między sesjami – często integrowane jako wtyczki, dzięki czemu framework pozostaje lekki, a pamięć skalowalna.

Subskrybuj

Otrzymuj nowe wpisy o systemach, infrastrukturze i inżynierii AI.