AI

System pamięci Hermes Agent: Jak realnie działa trwała pamięć AI

System pamięci Hermes Agent: Jak realnie działa trwała pamięć AI

Pamięć to różnica między narzędziem a partnerem.

Znasz ten scenariusz. Otwierasz czat z agentem AI, tłumaczysz mu swój projekt, dzielisz się swoimi preferencjami, wykonujesz część pracy i zamykasz kartę. Wracasz tydzień później i czujesz się, jakbyś rozmawiał z kimś obcym — cały kontekst zniknął, każda preferencja została zapomniana, a projekt trzeba wyjaśnić od nowa.

Claude Skills i SKILL.md dla deweloperów: VS Code, JetBrains, Cursor

Claude Skills i SKILL.md dla deweloperów: VS Code, JetBrains, Cursor

Twórz Claude Skills, które przetrwają pracę w rzeczywistych warunkach

Większość zespołów błędnie wykorzystuje Claude Skills w jeden z dwóch sposobów. Albo zamieniają SKILL.md w miejsce na składowanie losowych notatek, albo nigdy nie przechodzą do etapu, w którym zastępują ogromne, kopiowane prompty właściwymi strukturami.

Szybki start Vane (Perplexica 2.0) z Ollama i llama.cpp

Szybki start Vane (Perplexica 2.0) z Ollama i llama.cpp

Własna wyszukiwarka AI z lokalnymi modelami LLM

Vane to jeden z bardziej pragmatycznych projektów w przestrzeni „AI-search z cytatami”: samodzielnie hostowany silnik odpowiedzi, który łączy wyszukiwanie na żywej sieci z modelami LLM (lokalnymi lub w chmurze), a jednocześnie pozwala zachować pełną kontrolę nad całym stackiem.

Ollama w Docker Compose z GPU i trwałym magazynowaniem modeli

Ollama w Docker Compose z GPU i trwałym magazynowaniem modeli

Serwer Ollama w stylu Compose-first z obsługą GPU i trwałym zapisem danych.

Ollama świetnie działa na “gołym” metalu (bez warstwy wirtualizacji). Staje się jeszcze ciekawszy, gdy traktujesz go jak usługę: stabilny punkt końcowy, przypięte wersje, trwałe przechowywanie danych oraz GPU, które jest dostępne, lub go nie ma.