AI 代理研究:Claude擊敗33種攻擊方法
Claude Code自主發現對抗性攻擊,對Meta的SecAlign-70B達到100%成功率,在96次迭代中擊敗所有33種已發表方法。
AI & Technology關於設計、開發、AI基礎設施和產品構建的思考。
Claude Code自主發現對抗性攻擊,對Meta的SecAlign-70B達到100%成功率,在96次迭代中擊敗所有33種已發表方法。
AI & Technology每個透過 AI 代理解決的問題都會沉澱情境資產,供下一次工作階段連本帶利提取。這就是情境複利效應。
AI & TechnologyTrivy透過標籤劫持遭入侵,接著是PyPI上的LiteLLM,然後46分鐘內出現47,000次安裝。AI供應鏈完全按照設計運作。
AI & Technology混合 BM25+向量檢索、以 Markdown 儲存技能、漂移偵測機制。2026年3月五篇論文驗證了同一套從生產環境失敗中誕生的架構。
AI & Technology每8起企業AI資安事件中就有1起涉及自主agent。執行時掛鉤、作業系統層級沙箱與行為漂移偵測打破部署與防禦的循環。
AI & TechnologyMidjourney V8 提示工程:以個人化為先的工作流程,以及 V8.1 Alpha 帶來的改變。HD 成為預設、圖像提示回歸、sref 穩定、延續 V7 精神的美學。
AI & Technology43.7% 的 LLM 迭代鏈引入的漏洞比基準線更多。加入 SAST 掃描器反而更糟。SCAFFOLD-CEGIS 將退化率降至 2.1%。
AI & Technology攻擊者開了一個GitHub議題,並在Cline的下一個版本中植入惡意軟體。代理沙箱在三個層級上失敗。以下是真正有效的防禦方式。
AI & Technology一個惡意網頁把指令藏進 URL 中繼資料。代理抓取了它、讀了那份毒藥,然後把 API 金鑰送了出去。沒有錯誤訊息,也沒有任何紀錄。
AI & TechnologyAnthropic悄悄在使用者的Mac上放置了10GB的虛擬機。代理可觀測性需要三個層次:資源計量、策略執行與執行時期稽核。
AI & TechnologyGit 記錄了什麼改變了。Agent 工作階段記錄了為什麼改變。當 agent 撰寫程式碼時,工作階段記錄才是真正的設計文件——而我們卻將它丟棄了。
AI & Technology具有稀疏專家存取的7B模型匹配50倍大小的代理。將日常工作路由到小模型,將判斷呼叫路由到前沿模型。
AI & Technology技術寫作: Introl
本地運行大型語言模型的全面硬體建議和成本分析。
針對不同AI工作負載比較NVIDIA最新資料中心加速器的GPU選擇指南。
深入技術分析Google張量處理單元從TPUv1到TPUv5的演進。
容器化環境中GPU叢集的資源共享策略。
使用Ray框架構建和管理分散式AI運算的指南。
開源LLM經濟學分析和DeepSeek的競爭定位。
未來資料中心電力需求和NVIDIA下一代GPU路線圖。
為下一代AI基礎設施供電的小型模組化反應爐解決方案。
DeepSeek多頭壓縮架構創新的技術分析。