Llm

gstack: стек искусственного интеллекта для разработки ПО

gstack: стек искусственного интеллекта для разработки ПО

«Софтверная фабрика, созданная на основе навыков агентов»

ИИ-агенты для программирования уже способны писать функции, модифицировать репозитории, запускать тесты и создавать pull request’ы. Более сложная задача — заставить агента следовать повторяемому инженерному процессу до, во время и после написания кода.

Самохостинговые системы глубокого исследования: сравнение 12 инструментов

Самохостинговые системы глубокого исследования: сравнение 12 инструментов

Самостоятельно размещаемые агенты, способные к исследованиям за пределами поиска

Deep Research стал самостоятельной категорией программного обеспечения, а не просто моделью, связанной с поисковой строкой. Эта статья сравнивает двенадцать систем для самостоятельного развёртывания (self-hosted) и архитектуры исследований, лежащих в их основе.

Эффективный фронтенд открытых моделей: поиск оптимального баланса в 2026 году

Эффективный фронтенд открытых моделей: поиск оптимального баланса в 2026 году

«Оптимальный размер открытых LLM в 2026 году: около 30 млрд параметров».

В сентябре 2026 года эффективная граница открытых моделей находится в диапазоне от 25 до 34 миллиардов параметров: агентская работа уровня, близкого к передовому, на одном GPU с 24 ГБ памяти, за малую долю стоимости оборудования класса 70B.

Mnemosyne для агента Hermes: быстрое начало работы с локальной памятью

Mnemosyne для агента Hermes: быстрое начало работы с локальной памятью

Локальная память Hermes с контролируемой записью.

Mnemosyne — это локальный провайдер памяти для Hermes Agent, который хранит рабочую память, структурированные факты, временные данные и эпизодическую историю в локальной базе SQLite — без хостинг-сервисов, без обязательных сетевых вызовов и с исключительно детальным контролем записи.

Самоусиливающиеся петли памяти в ИИ-агентах: причины и способы исправления

Самоусиливающиеся петли памяти в ИИ-агентах: причины и способы исправления

«Когда осмысленные выводы превращаются в новые доказательства.»

Персистентная память превращает агента из инструмента, которому каждый раз приходится объяснять контекст, в систему, способную передавать этот контекст дальше. Однако это открывает сценарий сбоя, которого нет в stateless-чат-режиме: интерпретация может стать частью памяти, извлекаться как факт и обосновывать более сильную версию самой себя.

OpenSpec: Отклонённые предложения — конвенция о памяти решений

OpenSpec: Отклонённые предложения — конвенция о памяти решений

Нет состояния отклонения. Вот обходной путь.

Агент, который полгода назад предложил и внедрил «перенос персистентности в общую библиотеку», с удовольствием предложит то же самое в следующем квартале, если только что-то долговечное не сообщит ему, что эта идея уже была исследована и отклонена — а в OpenSpec сегодня нет встроенного состояния для этого.

OpenSpec: быстрая установка, рабочий процесс и частые ошибки

OpenSpec: быстрая установка, рабочий процесс и частые ошибки

Спецификации в виде дельт, а не 40-страничный PRD.

OpenSpec — это бесплатный инструмент командной строки с открытым исходным кодом от Fission AI, который позволяет вам и вашему ИИ-агенту по разработке кода согласовать изменения в формате простого Markdown до начала написания кода, без жесткой фазовой структуры, характерной для более тяжелых спецификационных фреймворков.

Как безопасно выполнить миграцию с OpenClaw на Hermes Agent

Как безопасно выполнить миграцию с OpenClaw на Hermes Agent

Безопасный перевод, выходящий за рамки однострочного импорта

Миграция ИИ-ассистента — это не то же самое, что копирование конфигурации приложения. Сложная часть заключается в сохранении идентичности, памяти, поведения инструментов, запланированных задач и доступа к сообщениям без возникновения ситуации, когда два шлюза (gateway) работают как один и тот же бот.

llama.cpp против Ollama в 2026 году: какой рантайм выбрать?

llama.cpp против Ollama в 2026 году: какой рантайм выбрать?

«Когда llama-server превосходит Ollama»

Ollama и llama.cpp часто сравнивают, будто бы это конкурирующие движки вывода. Настоящий выбор — между управляемым сервисом моделей и набором инструментов, которым вы управляете напрямую.

ROCm и Vulkan для локального запуска LLM на GPU AMD: руководство на 2026 год

ROCm и Vulkan для локального запуска LLM на GPU AMD: руководство на 2026 год

Выберите правильный AMD-бэкенд для каждого движка

ROCm и Vulkan обе ускоряют работу GPU AMD для локального размещения LLM, но они не взаимозаменяемы. Правильный выбор зависит от движка, графического процессора и характера нагрузки.

KV Cache на GPU с 16 ГБ: Как действительно уместить длинный контекст

KV Cache на GPU с 16 ГБ: Как действительно уместить длинный контекст

Почему контекст 128K не работает на 16 ГБ

Модель может заявлять о поддержке контекстного окна в 128K, но проваливаться уже на 40K токенах на видеокарте с 16 ГБ. Архитектурный потолок никогда не обещал, что веса, KV-кэш, вычислительные буферы и системный композитор смогут одновременно уместиться на вашем устройстве.

Что после LLM? Mamba, диффузия и модели мира

Что после LLM? Mamba, диффузия и модели мира

Что последует после LLM? Эпоха посттрансформеров.

Хайп вокруг ИИ следует определённому ритму: примерно раз в три года архитектура, на которую все делают ставку, уступает место чему-то более новому. Следующий сдвиг уже формируется в исследовательских лабораториях.

OpenCode CLI на практике: рабочие процессы, автоматизация и подводные камни

OpenCode CLI на практике: рабочие процессы, автоматизация и подводные камни

«OpenCode из командной строки: на практике»

Командная строка OpenCode разработана для скриптов, CI-конвейеров и автономного запуска агентов. Эта статья представляет собой практическое руководство по её использованию в повседневной работе.

Быстрый старт Superpowers: установка, рабочий процесс и примеры

Быстрый старт Superpowers: установка, рабочий процесс и примеры

Навыки SDD, внедрённые одной командой.

Пакет Superpowers инкапсулирует полноценную методику разработки по спецификациям в устанавливаемые навыки Claude (Claude Skills), навязывая мозговой штурм, планирование, реализацию с помощью субагентов и строгий TDD, вместо того чтобы оставлять формирование этой структуры на ваше усмотрение.

Обзор агента Pi Coding: минималистичный CLI для AI-кодинга с возможностью кастомизации

Обзор агента Pi Coding: минималистичный CLI для AI-кодинга с возможностью кастомизации

«Небольшой агент для программирования, который требует, чтобы вы его настраивали».

Pi Coding Agent — это минималистичный, открытый терминальный каркас для программирования, который поставляется с четырьмя инструментами по умолчанию и оставляет большую часть поведения на усмотрение расширений, навыков и вашего собственного рабочего процесса.

Гравитация данных: реальная стоимость API-first ИИ

Гравитация данных: реальная стоимость API-first ИИ

«Почему ваш AI-стек становится всё более «липким» каждый месяц»

Каждый вызов API кажется простой транзакцией - пока их накопится достаточно много, и ваши данные для дообучения, системы оценки и схемы инструментов не начнут формироваться вокруг одного вендора, после чего смена провайдера перестанет быть простой сменой маршрутизации.