Blog ARVANTTI LABS
Ideas para construir sistemas digitales confiables.
Explora nuestras notas sobre inteligencia artificial, agentes y ciberseguridad.
Publicaciones
Últimos artículos
Ingeniería de harnesses para agentes de IA
La capa operativa que conecta objetivos, herramientas, memoria y controles para hacer gobernable un agente.
Arquitectura y operaciónLeer artículoLoop engineering: ciclos confiables para agentes de IA
Un ciclo explícito de plan, acción y evaluación evita que la autonomía se convierta en repetición improductiva.
Arquitectura y operaciónLeer artículoContext engineering: información correcta en el momento correcto
Seleccionar, estructurar y actualizar contexto relevante mejora precisión, coste y trazabilidad de los agentes.
Contexto y memoriaLeer artículoTool engineering: herramientas que un agente puede usar con seguridad
Las herramientas no son extensiones neutrales: requieren contratos, validación y resultados interpretables.
Herramientas y controlesLeer artículoMemory engineering: memoria útil sin acumular ruido
La memoria de un agente necesita políticas de escritura, recuperación, retención y olvido.
Contexto y memoriaLeer artículoOrquestación de sistemas multiagente
La coordinación convierte agentes especializados en un sistema que puede dividir, verificar e integrar trabajo complejo.
Arquitectura y operaciónLeer artículoGuardrails y permisos para agentes de IA
La autonomía es útil cuando las políticas, permisos y límites se aplican antes de una acción.
Herramientas y controlesLeer artículoEvaluación de agentes de IA: de demos a evidencia operativa
Evaluar un agente implica revisar resultado, proceso, seguridad y coste bajo escenarios representativos.
Calidad y observabilidadLeer artículoHuman-in-the-loop: supervisión que mejora decisiones
La revisión humana funciona cuando se inserta en el punto de riesgo correcto, con evidencia y opciones accionables.
Arquitectura y operaciónLeer artículoObservabilidad y tracing: hacer visible la autonomía
Trazas, métricas y eventos conectan cada resultado con la ejecución que lo produjo.
Calidad y observabilidadLeer artículoMCP explicado: cómo conecta asistentes de IA con herramientas y datos
MCP ofrece una forma común de conectar aplicaciones de IA con servidores que exponen herramientas y datos. Comprender sus componentes ayuda a separar lo que define el protocolo de los riesgos de cada implementación.
Seguridad MCPLeer artículoDónde está realmente el riesgo: cliente, servidor, agente, permisos e integraciones
La evaluación de MCP no se limita al protocolo. La superficie real incluye quién ejecuta cada componente, qué puede ver y qué acciones puede realizar.
Seguridad MCPLeer artículoPrompt injection indirecta: cómo una respuesta externa puede manipular a un agente
Un agente puede interpretar como instrucciones contenido que llegó como dato. La defensa requiere separar autoridad, limitar capacidades y controlar acciones.
Seguridad MCPLeer artículoTool poisoning: cuando una herramienta aparentemente confiable esconde instrucciones
Una herramienta puede incluir descripciones o resultados que orienten al modelo hacia acciones no esperadas. La revisión debe cubrir comportamiento, capacidades y cambios.
Seguridad MCPLeer artículoRug pull: qué pasa cuando una herramienta cambia después de ser aprobada
Aprobar una herramienta no debería equivaler a confiar indefinidamente en todas sus versiones futuras. El control de cambios cierra esa brecha.
Seguridad MCPLeer artículoPermisos excesivos: aplicar mínimo privilegio a servidores MCP
El mínimo privilegio reduce cuánto puede hacer una integración si una instrucción, configuración o componente falla.
Seguridad MCPLeer artículoTokens, OAuth y “confused deputy”: evitar accesos no autorizados
Cuando un servidor actúa en nombre de una persona frente a otro servicio, debe preservar la identidad, el consentimiento y el alcance de cada autorización.
Seguridad MCPLeer artículoSSRF y servidores MCP locales: riesgos de red y defensa frente a DNS rebinding
Un servidor local o una herramienta que busca URLs puede abrir rutas de acceso inesperadas. La defensa combina límites de red, validación y controles de transporte.
Seguridad MCPLeer artículoInyección de comandos y validación de entradas: proteger herramientas que ejecutan acciones
Los parámetros propuestos por un modelo deben tratarse como entrada no confiable. La seguridad depende de validar el tipo, el alcance y el efecto de cada operación.
Seguridad MCPLeer artículoCadena de suministro y servidores MCP no aprobados: dependencias, instalación y shadow IT
Cada servidor MCP suma código, configuración y dependencias a la cadena de suministro de una organización. Un proceso de aprobación proporcional vuelve esa superficie visible.
Seguridad MCPLeer artículoFuga de información por contexto, respuestas y logs
La información puede filtrarse antes, durante o después de una llamada: desde el contexto que recibe el modelo hasta las respuestas de herramientas y los registros.
Seguridad MCPLeer artículoChecklist de seguridad MCP: guía central para desarrolladores y organizaciones
Esta guía reúne controles para evaluar servidores MCP antes y después de integrarlos. Úsala junto a los artículos de la serie para profundizar en cada tema.
Seguridad MCPLeer artículoDark factories: qué revela un experimento sobre agentes y arquitectura
Automatizar la escritura y las pruebas no automatiza por sí solo el criterio arquitectónico. Un caso reportado por HumanLayer ayuda a entender dónde conviene mantener revisión humana.
Ingeniería agénticaLeer artículoFlujo de 4 puertas: reducir incertidumbre antes de programar con agentes
Separar problema, investigación, arquitectura y slices convierte una petición amplia en decisiones revisables antes de generar un diff extenso.
Ingeniería agénticaLeer artículoContexto para agentes: mantener el foco con compactación deliberada
Una ventana de contexto grande no garantiza que un agente utilice toda la información con la misma eficacia. La selección y el resumen deben conservar evidencia y estado útil.
Ingeniería agénticaLeer artículo12 Factor Agents: patrones para agentes que llegan a producción
Los 12 factores de HumanLayer proponen agentes compuestos de software explícito, herramientas estructuradas, estado controlado y pausas humanas cuando hacen falta.
Ingeniería agénticaLeer artículo