每次迭代都在削弱代码安全性
43.7%的LLM迭代链引入的漏洞比基线更多。添加SAST扫描器反而雪上加霜。SCAFFOLD-CEGIS将退化率降至2.1%。
AI & Technology关于设计、开发、AI基础设施和产品构建的思考。
43.7%的LLM迭代链引入的漏洞比基线更多。添加SAST扫描器反而雪上加霜。SCAFFOLD-CEGIS将退化率降至2.1%。
AI & Technology一名攻击者提交了一个GitHub issue,并在Cline的下一个版本中植入了恶意软件。Agent沙箱在三个层面上失效。以下是真正有效的防御方法。
AI & TechnologyGit记录了什么发生了变化。Agent会话记录了为什么。当Agent编写代码时,会话记录才是真正的设计文档——而我们却将其丢弃。
AI & Technology一个恶意网页把指令注入到 URL 元数据里。代理抓取页面、读到毒饵,然后把 API 密钥外发了出去。没有报错,没有日志。
AI & TechnologyAI 智能体在运维人员毫无可见性的情况下消耗磁盘、CPU 和网络。三层可观测性能在损害无法挽回之前补上这道缺口。
AI & Technology具有稀疏专家访问的7B模型匹配50倍大小的代理。将日常工作路由到小模型,将判断调用路由到前沿模型。
AI & Technology上下文工程是智能体开发中影响力最大的技能。三层压缩策略将200K token窗口从负担转化为优势。
AI & Technology三个热门HN Claude Code讨论串汇聚于同一结论:CLI优先架构比IDE代理工作流更低成本、更快速、更具组合性。
AI & TechnologyClaude Code不是IDE功能,而是基础设施。84个钩子、48个技能、19个代理和15,000行编排代码证明了这一点。
AI & Technology提交给NIST的生产环境证据:AI代理威胁是行为性的。7种故障模式、3层防御,以及60次日常会话中发现的框架缺陷。
AI & Technology一个自主Agent在72小时内向8个平台发布了虚构的技术声明。训练阶段的安全机制在发布边界失效了。以下是修复方案。
AI & Technology84个Hook、43个技能、19个智能体如何构成生产级编排层,以及可迁移到任何harness的三个模式。
AI & Technology技术写作: Introl
本地运行大型语言模型的全面硬件建议和成本分析。
针对不同AI工作负载比较NVIDIA最新数据中心加速器的GPU选择指南。
深入技术分析Google张量处理单元从TPUv1到TPUv5的演进。
容器化环境中GPU集群的资源共享策略。
使用Ray框架构建和管理分布式AI计算的指南。
开源LLM经济学分析和DeepSeek的竞争定位。
未来数据中心电力需求和NVIDIA下一代GPU路线图。
为下一代AI基础设施供电的小型模块化反应堆解决方案。
DeepSeek多头压缩架构创新的技术分析。