Llm

Enrutamiento de modelos: deja de usar un solo modelo para todo

Enrutamiento de modelos: deja de usar un solo modelo para todo

«El modelo adecuado para la tarea adecuada».

Ejecutar un modelo de 70 mil millones de parámetros para resumir un correo electrónico de 200 palabras es un desperdicio. Ejecutar un modelo de 3 mil millones de parámetros para revisar código en producción es imprudente. La mayoría de los sistemas se encuentran en algún punto intermedio, y ahí es donde entra la enrutación de modelos.

Sistemas de memoria en asistentes de IA

Sistemas de memoria en asistentes de IA

Memoria de trabajo, estructurada y de recuperación para asistentes.

La memoria transforma a los asistentes de reactivos a persistentes, pero también es donde muchos sistemas se deterioran silenciosamente. Los análisis argumentan que la división entre memoria a corto y largo plazo ya no es suficiente para la memoria de agentes modernos; los SDK de OpenAI y LangGraph apuntan a un stack más simple: memoria de trabajo, estado durable y recuperación.

LLM Wiki: Conocimiento compilado que el RAG no puede reemplazar

LLM Wiki: Conocimiento compilado que el RAG no puede reemplazar

Conocimiento compilado para sistemas de IA

La premisa es simple: el conocimiento compilado es más reutilizable que los fragmentos recuperados. RAG se convirtió en la respuesta predeterminada a una pregunta directa: ¿cómo proporciono a un LLM acceso a conocimiento externo?

Creación de habilidades para Hermes Agent — Estructura y mejores prácticas de SKILL.md

Creación de habilidades para Hermes Agent — Estructura y mejores prácticas de SKILL.md

Habilidades del autor Hermes que cargan rápido y funcionan de forma confiable

Hermes Agent trata las habilidades como la forma predeterminada para enseñar flujos de trabajo repetibles. La documentación oficial las describe como documentos de conocimiento bajo demanda alineados con el formato abierto de agentskills.io, cargados mediante divulgación progresiva, de modo que el modelo ve primero un índice pequeño y solo recupera las instrucciones completas cuando una tarea realmente las necesita.