O Agente Invisível: Por Que Você Não Pode Governar o Que Não Consegue Ver
A Anthropic instalou uma VM de 10GB nos Macs dos usuários. Observabilidade de agentes exige três camadas: medição, políticas e auditoria em execução.
AI & TechnologyReflexões sobre design, desenvolvimento, infraestrutura de IA e criação de produtos.
A Anthropic instalou uma VM de 10GB nos Macs dos usuários. Observabilidade de agentes exige três camadas: medição, políticas e auditoria em execução.
AI & TechnologyUma página web maliciosa injetou instruções nos metadados da URL. O agente buscou a página, leu o veneno e exfiltrou a chave de API. Sem erro. Sem log.
AI & Technology49.746 chunks, 83 MB, zero chamadas de API: como BM25, busca vetorial e fusão RRF em um só arquivo SQLite tornam 16.894 notas do Obsidian consultáveis.
AI EngineeringQuais padrões de AGENTS.md realmente mudam o comportamento do agente: anti-padrões, padrões que funcionam e a matriz de compatibilidade de 8 ferramentas.
AI DevelopmentConstrua uma skill de revisao de codigo do zero. Estrutura de diretorios, campos frontmatter, matching LLM, orcamentos de contexto e auto-ativacao.
AI Development118 funções com lentidão de 3x a 446x em dois PRs do Claude Code. Agentes de IA otimizam para correção, não para performance. Os dados do porquê.
AI EngineeringEngenharia de contexto é a habilidade de maior impacto em agentes. Três camadas de compressão transformam uma janela de 200K tokens em vantagem.
AI & TechnologyA Anthropic analisou 9.830 conversas. O refinamento iterativo dobra os marcadores de fluência, e saídas polidas suprimem a avaliação do usuário.
AI EngineeringUse a documentação oficial para configuração; use a referência do Blake para arquitetura, segurança, extensibilidade e 36 resultados de duelos cegos.
AI DevelopmentSete modos de falha nomeados a partir de mais de 500 sessões autônomas de agentes. Cada um com sinal de detecção, exemplo real e correção concreta.
AI EngineeringTrês discussões no HN sobre Claude Code convergem: a arquitetura CLI-first é mais barata, rápida e componível que fluxos de agentes em IDEs.
AI & TechnologyUm modelo 7B com acesso esparso a especialistas iguala agentes 50x maiores. Trabalho rotineiro para modelos pequenos, julgamentos para frontier.
AI & TechnologyRedação técnica em Introl
Recomendações abrangentes de hardware e análise de custos para executar modelos de linguagem grandes localmente.
Guia de seleção de GPU comparando os mais recentes aceleradores de datacenter da NVIDIA para diferentes cargas de trabalho de IA.
Análise técnica aprofundada da evolução da Unidade de Processamento Tensor do Google, do TPUv1 ao TPUv5.
Estratégias de compartilhamento de recursos para clusters de GPU em ambientes containerizados.
Guia para construir e gerenciar computação de IA distribuída com o framework Ray.
Análise da economia de LLMs de código aberto e do posicionamento competitivo da DeepSeek.
Requisitos futuros de energia para datacenters e o roteiro de GPUs de próxima geração da NVIDIA.
Soluções de reatores modulares pequenos para alimentar a infraestrutura de IA de próxima geração.
Análise técnica das inovações da arquitetura Multi-Head Compression da DeepSeek.