Llm

Usuń wszystkie modele routera llama.cpp bez restartowania

Usuń wszystkie modele routera llama.cpp bez restartowania

Darmowa pamięć VRAM bez zabijania llama-server.

Tryb routera w llama.cpp to jedna z najbardziej przydatnych zmian wprowadzonych do llama-server w ciągu ostatnich lat. Wreszcie daje lokalnym operatorom modeli LLM coś w rodzaju zarządzania modelami, do którego są przyzwyczajeni z Ollama, jednocześnie zachowując surową wydajność i kontrolę na niskim poziomie, która sprawia, że warto korzystać z llama.cpp w pierwszej kolejności.

Sterowanie głosem Hermes z telefonu

Sterowanie głosem Hermes z telefonu

Pozwól, by Hermes rozmawiał z Tobą przez telefon

Już teraz rozmawiasz z agentem Hermes przez telefon za pomocą wiadomości tekstowych. Teraz chcesz rozmawiać z nim bezpośrednio i otrzymywać odpowiedzi w formie mowy. Zazwyczaj jest to słuszny krok, zwłaszcza jeśli już korzystasz z Hermesa jako trwałego, lokalnie hostowanego asystenta. Pisanie długich promptów na małym ekranie jest powolne i podatne na błędy.

Tworzenie umiejętności dla Agenta Hermesa — struktura pliku SKILL.md i najlepsze praktyki

Tworzenie umiejętności dla Agenta Hermesa — struktura pliku SKILL.md i najlepsze praktyki

Hermes oferuje szybko ładujące się i niezawodnie działające umiejętności.

Hermes Agent traktuje umiejętności (skills) jako domyślną metodę nauczania powtarzalnych workflow. Oficjalna dokumentacja opisuje je jako dokumenty wiedzy dostarczane na żądanie, zgodne z otwartym formatem agentskills.io, ładowane przez postępującą ekspozycję (progressive disclosure), dzięki czemu model widzi najpierw mały indeks i pobiera pełne instrukcje dopiero wtedy, gdy zadanie ich faktycznie wymaga.

Pamięć systemów AI — trwała wiedza i pamięć agentów

Pamięć systemów AI — trwała wiedza i pamięć agentów

Trwała wiedza wykraczająca poza pojedynczą konwersację.

Ten dział zbiera przewodniki dotyczące trwałej wiedzy i pamięci dla systemów AI — jak asystenci utrzymują fakty, preferencje i skondensowany kontekst między sesjami, bez wciskania każdego tokena do jednego promptu. Pamięć oznacza tutaj celowe utrwalanie (fakty o użytkowniku, streszczenia, magazyny wspierane przez wtyczki), a nie pamięć GPU ani wagi modelu.

Porównanie dostawców pamięci agentów — Honcho, Mem0, Hindsight i pięć innych

Porównanie dostawców pamięci agentów — Honcho, Mem0, Hindsight i pięć innych

Osiem wymiennych backendów do trwałej pamięci agenta.

Współczesne asystenty nadal zapominają wszystko po zamknięciu karty, chyba że dane są utrwalone poza oknem kontekstu. Dostawcy pamięci agentów to usługi lub biblioteki przechowujące fakty i streszczenia między sesjami – często integrowane jako wtyczki, dzięki czemu framework pozostaje lekki, a pamięć skalowalna.

System pamięci agenta Hermes: jak naprawdę działa trwała pamięć sztucznej inteligencji

System pamięci agenta Hermes: jak naprawdę działa trwała pamięć sztucznej inteligencji

Pamięć jest tym, co odróżnia narzędzie od partnera.

Wiesz, jak to działa. Otwierasz czat z agentem AI, opisujesz swój projekt, dzielicz się preferencjami, wykonujesz pewne zadania i zamykasz kartę. Wraca się tydzień później, a rozmowa wygląda tak, jakbyś miał do czynienia z obcą osobą — cały kontekst zniknął, wszystkie preferencje zostały zapomniane, a projekt trzeba wyjaśnić od zera.

Claude Skills i SKILL.md dla deweloperów: VS Code, JetBrains, Cursor

Claude Skills i SKILL.md dla deweloperów: VS Code, JetBrains, Cursor

Twórz Claude Skills, które przetrwają pracę w rzeczywistych warunkach

Większość zespołów błędnie wykorzystuje Claude Skills w jeden z dwóch sposobów. Albo zamieniają SKILL.md w miejsce na składowanie losowych notatek, albo nigdy nie przechodzą do etapu, w którym zastępują ogromne, kopiowane prompty właściwymi strukturami.