AI

Система памяти агента Hermes: как действительно работает персистентная память ИИ

Система памяти агента Hermes: как действительно работает персистентная память ИИ

Память — это то, что отличает инструмент от партнёра.

Вы знаете этот сценарий. Вы открываете чат с ИИ-агентом, объясняете свой проект, делитесь своими предпочтениями, выполняете часть задач и закрываете вкладку. Возвращаетесь через неделю — и это как разговор с посторонним: весь контекст утерян, все предпочтения забыты, проект нужно объяснять заново с нуля.

Claude Skills и SKILL.md для разработчиков: VS Code, JetBrains, Cursor

Claude Skills и SKILL.md для разработчиков: VS Code, JetBrains, Cursor

Создавайте Claude Skills, которые выдерживают реальную работу

Большинство команд неправильно используют Claude Skills одним из двух способов. Либо они превращают SKILL.md в свалку информации, либо так и не переходят от огромных скопированных промптов к чему-то более структурированному.

Плагины OpenClaw — руководство по экосистеме и практические рекомендации

Плагины OpenClaw — руководство по экосистеме и практические рекомендации

Сначала плагины. Кратко об именовании навыков.

Эта статья посвящена плагинам OpenClaw — нативным пакетам шлюза, которые добавляют каналы, провайдеры моделей, инструменты, речевые функции, память, медиа, веб-поиск и другие возможности runtime.

Быстрый старт с Vane (Perplexica 2.0) с использованием Ollama и llama.cpp

Быстрый старт с Vane (Perplexica 2.0) с использованием Ollama и llama.cpp

Самохостинговый ИИ-поиск с локальными LLM

Vane — один из наиболее прагматичных проектов в сегменте «AI-поиск со ссылками на источники»: самохостингуемый движок ответов, который сочетает живой веб-поиск с локальными или облачными LLM, сохраняя при этом полный контроль над всем стеком за вами.

Установка и настройка Claude Code для Ollama и llama.cpp, а также тарифы

Установка и настройка Claude Code для Ollama и llama.cpp, а также тарифы

Агентное кодирование, теперь с локальными моделями

Claude Code — это не просто автодополнение с лучшей маркетинговой упаковкой. Это агентный инструмент для программирования: он анализирует вашу кодовую базу, редактирует файлы, выполняет команды и интегрируется с вашими инструментами разработки.

Ассистент Hermes AI: установка, настройка, рабочий процесс и устранение неполадок

Ассистент Hermes AI: установка, настройка, рабочий процесс и устранение неполадок

Установка и быстрый старт агента Hermes для разработчиков

Hermes Agent — это самовыстраиваемый, не привязанный к конкретной модели ИИ-ассистент, который работает на локальной машине или дешевом VPS, функционирует через терминальные и мессенджер-интерфейсы и со временем совершенствуется, превращая повторяющиеся задачи в переиспользуемые навыки.

TGI — Text Generation Inference: установка, настройка и устранение неполадок

TGI — Text Generation Inference: установка, настройка и устранение неполадок

Установите TGI, развертывайте быстро, отлаживайте ещё быстрее.

Text Generation Inference (TGI) обладает очень специфической энергетикой. Это не самый новый проект на улице инференса, но это тот, который уже научился, как происходит работа в продакшене, —

Ollama в Docker Compose с поддержкой GPU и постоянным хранением моделей

Ollama в Docker Compose с поддержкой GPU и постоянным хранением моделей

Сервер Ollama с приоритетом композиции, поддержкой GPU и сохранением данных.

Ollama отлично работает на «голом железе». Всё становится ещё интереснее, когда вы начинаете относиться к нему как к сервису: стабильный эндпоинт, закреплённые версии, постоянное хранилище данных и GPU, который либо доступен, либо нет.

Ollama за обратным прокси-сервером Caddy или Nginx для потоковой передачи через HTTPS

Ollama за обратным прокси-сервером Caddy или Nginx для потоковой передачи через HTTPS

HTTPS для Ollama без нарушения потоковой передачи ответов.

Запуск Ollama через обратный прокси — самый простой способ обеспечить поддержку HTTPS, опциональный контроль доступа и предсказуемое поведение потоковой передачи данных.