Lo que le dije a NIST sobre la seguridad de agentes de IA
Evidencia enviada al NIST: las amenazas de agentes IA son conductuales. 7 modos de fallo, defensa de 3 capas y brechas de frameworks en 60 sesiones.
AI & TechnologyPensamientos sobre diseno, desarrollo, infraestructura de IA y creacion de productos.
Evidencia enviada al NIST: las amenazas de agentes IA son conductuales. 7 modos de fallo, defensa de 3 capas y brechas de frameworks en 60 sesiones.
AI & TechnologyKarpathy identificó las 'Claws' como una nueva capa arquitectónica. Así es como lucen 84 hooks, 43 skills y 19 agentes como sistema de orquestación en producción.
AI & TechnologyUn agente autónomo publicó afirmaciones fabricadas en 8 plataformas durante 72 horas. La seguridad de la fase de entrenamiento falló en el límite de publicación. Aquí está la solución.
AI & TechnologyLas constituciones en tiempo de ejecución imponen la gobernanza de agentes de IA donde falla la alineación en la fase de entrenamiento. Verificaciones de competencia, controles de salida y cuatro subsistemas mantienen seguros a los agentes.
AI & Technology15.800 notas de Obsidian en el espacio de embeddings revelan tres topologías del conocimiento. Cada una tiene fallas que puedes diagnosticar y corregir con notas puente.
AI & TechnologyLos LLM pierden un 39 % de precisión en más de 200 000 sesiones de varios turnos. Tres mecanismos provocan el colapso y ninguno se resuelve ampliando la ventana de contexto.
AI & TechnologyCinco grupos de investigación publicaron sobre el mismo problema esta semana: los agentes de IA producen código más rápido de lo que los desarrolladores pueden comprenderlo. La deuda está en su cabeza.
AI & TechnologyIngeniería de contexto para agentes de IA a lo largo de una jerarquía distribuida de 650 archivos y siete capas. Tres fallos en producción, presupuestos reales de tokens y el sistema que los sobrevivió.
AI & TechnologyLa mayoría de instrucciones de agentes definen comportamiento. La capa faltante enseña autoevaluación: un marco metacognitivo basado en nueve meses de producción y 95 hooks.
AI & TechnologyLa deliberación multi-agente detecta fallos que los sistemas de un solo agente pasan por alto. Aquí está la arquitectura, los callejones sin salida y lo que realmente vale la pena construir.
AI & TechnologyMi agente Claude Code heredó cada hábito humano descuidado a velocidad de máquina. Construí 3 filosofías, más de 150 controles de calidad y 95 hooks. Esto es lo que funcionó.
AI & TechnologyXcodeBuildMCP y el MCP de Xcode de Apple le dan a Claude Code acceso estructurado a las compilaciones, pruebas y depuración de iOS. Configuración, resultados reales y lecciones honestas.
AI & TechnologyEscritura tecnica en Introl
Recomendaciones de hardware completas y análisis de costos para ejecutar grandes modelos de lenguaje localmente.
Guía de selección de GPU comparando los últimos aceleradores de datacenter de NVIDIA para diferentes cargas de trabajo de IA.
Análisis técnico profundo de la evolución de la Tensor Processing Unit de Google desde TPUv1 hasta TPUv5.
Estrategias de compartición de recursos para clústeres GPU en entornos containerizados.
Guía para construir y gestionar computación de IA distribuida con el framework Ray.
Análisis de la economía de LLM de código abierto y el posicionamiento competitivo de DeepSeek.
Requisitos de energía futuros de centros de datos y hoja de ruta de GPU de próxima generación de NVIDIA.
Soluciones de reactores modulares pequeños para alimentar la infraestructura de IA de próxima generación.
Análisis técnico de las innovaciones de arquitectura Multi-Head Compression de DeepSeek.