gstack: AI 소프트웨어 엔지니어링 스택
에이전트 스킬로 구축된 소프트웨어 팩토리
AI 코딩 에이전트는 이미 함수 작성, 저장소 수정, 테스트 실행, 그리고 풀 리퀘스트(Pull Request) 생성이 가능합니다. 더 어려운 문제는 코드를 작성하기 전, 중, 후를 아우르는 반복 가능한 엔지니어링 프로세스를 에이전트가 따르도록 만드는 것입니다.
에이전트 스킬로 구축된 소프트웨어 팩토리
AI 코딩 에이전트는 이미 함수 작성, 저장소 수정, 테스트 실행, 그리고 풀 리퀘스트(Pull Request) 생성이 가능합니다. 더 어려운 문제는 코드를 작성하기 전, 중, 후를 아우르는 반복 가능한 엔지니어링 프로세스를 에이전트가 따르도록 만드는 것입니다.
검색을 넘어 연구를 수행하는 셀프호스트 에이전트
Deep Research는 이제 단순히 검색 박스에 적용되는 모델이 아니라, 독자적인 소프트웨어 카테고리가 되었습니다. 이 글에서는 12가지 셀프호스팅 시스템과 그 뒤를支撑하는 리서치 아키텍처를 비교합니다.
2026년 오픈 LLM의 최적 구간: 약 30B
2026년 9월, 오픈 모델의 효율적 프런티어(efficient frontier)는 25B~34B 파라미터 사이에 위치합니다: 24 GB 단일 GPU에서 프런티어에 근접한 에이전틱 작업을 수행할 수 있으면서, 70B급 하드웨어의 일부 비용으로만 가능합니다.
기억된 결론이 새로운 증거가 될 때
지속적 메모리는 에이전트를 매번 설명을 들어야 하는 도구에서 컨텍스트를 유지하며 나아가는 존재로 전환시켜 줍니다. 하지만 이는 무상태(stateless) 채팅이 피하는 실패 모드를 열어젖히기도 합니다. 해석(interpretation)이 메모리가 되어 사실처럼 검색되고, 이를 근거로 자신에 대한 더 강력한 버전의 정당화를 만드는 식입니다.
통제된 쓰기 기능을 갖춘 로컬 Hermes 메모리
Mnemosyne은 Hermes Agent를 위한 로컬 퍼스트(local-first) 메모리 프로바이더입니다. 워킹 메모리, 구조화된 사실, 시간 데이터, 그리고 에피소드적 역사를 로컬 SQLite에 저장하며, 호스팅된 서비스나 필수적인 네트워크 호출 없이도 유독 세밀한 수준의 쓰기(write) 제어를 제공합니다.
거부 상태가 없습니다. 다음은 임시 해결책입니다.
6개월 전 “영속성을 공유 라이브러리로 이동"을 제안하고 배포했던 에이전트는, 그 아이디어가 이미 검토되어 기각되었다는 것을 지속적으로 기록하는 것이 없다면 다음 분기에 같은 것을 다시 제안할 것이다 — 그리고 OpenSpec에는 현재 이를 위한 내장 상태가 없다.
40페이지짜리 PRD가 아닌, 델타(deltas) 형태의 스펙
OpenSpec은 Fission AI가 제공하는 무료 오픈소스 CLI 도구로, 코드가 작성되기 전에 사용자가 코딩 에이전트와 평범한 마크다운으로 변경 사항에 대해 합의할 수 있게 해줍니다. 무거운 스펙 기반 프레임워크의 단계별 복잡한 절차 없이 이를 가능합니다.
한 줄 import를 넘어선 안전한 전환
AI 어시스턴트 마이그레이션은 단순한 애플리케이션 설정 복사와는 다른 문제입니다. 가장 어려운 부분은 두 개의 게이트웨이가 동일한 봇으로 작동하지 않도록 하면서도, 정체성, 기억, 도구 동작, 예약된 작업, 그리고 메시지 접근 권한을 보존하는 것입니다.
“llama-server가 Ollama를 능가할 때”
Ollama와 llama.cpp는 종종 경쟁하는 추론 엔진으로 비교되곤 합니다. 실제 선택은 관리형 모델 서비스와 직접 운영하는 툴킷 사이의 결정에 가깝습니다.
엔진별로 적합한 AMD 백엔드 선택
ROCm과 Vulkan은 모두 로컬 LLM 호스팅을 위해 AMD GPU를 가속화하지만, 서로 대체재가 될 수 없습니다. 올바른 선택은 엔진, GPU, 그리고 워크로드에 따라 달라집니다.
16GB에서 128K 컨텍스트가 실패하는 이유
모델은 128K 컨텍스트 윈도우를 광고하면서도 16 GB GPU에서 40K 토큰에서 실패할 수 있습니다. 아키텍처 상한은 웨이트, KV 캐시, 컴퓨트 버퍼, 데스크톱 컴포지터가 모두 동시에 해당 카드에 들어맞겠다는 약속을 한 적이 없습니다.
LLM 이후의 시대: 트랜스포머 이후
AI 열풍에는 일정한 리듬이 있다: 대략 3년마다, 모두가 베팅하고 있는 아키텍처가 더 새로운 것으로 대체된다. 다음 전환은 이미 연구실에서 형성되고 있다.
명령줄에서 OpenCode를 실제로 사용해 보기
OpenCode의 커맨드 라인 인터페이스(CLI)는 스크립팅, CI 파이프라인, 그리고 무인 에이전트 실행을 위해 설계되었습니다. 이 글은 일상 업무에서 CLI를 활용하는 실무 가이드입니다.
10개의 명령으로 강제되는 SDD 스킬
Superpowers는 뇌暴(brainstorming), 계획 수립, 서브에이전트 기반 구현, 엄격한 TDD(Test-Driven Development)를 강제하는 스펙 기반 개발 방법론 전체를 설치 가능한 Claude 스킬 패키지로 묶어 제공합니다.
사용자가 직접 형태를 만들어야 하는 작은 코딩 에이전트
Pi Coding Agent는 기본 도구 4개를 갖추고 있으며, 대부분의 동작을 확장, 스킬 및 사용자 자체 워크플로에 맡기는 최소한의 오픈소스 터미널 코딩 하네스입니다.
AI 스택이 매월 더욱 강하게 고정되는 이유
모든 API 호출은 단순한 거래처럼 느껴집니다. 하지만 그 수가 쌓이면, 파인튜닝 데이터, 평가 하네스, 도구 스키마가 모두 하나의 벤더 주위에 형성되어, 벤더 전환이 더 이상 단순한 라우팅 변경이 아닌 상황이 됩니다.