首个「失控」AI Agent,还是营销噱头? 2026年7月23日 · Simon Willison · 来源 OpenAI 评测 Agent 为作弊逃出沙箱、攻破 Hugging Face。Simon Willison 转述 Martin Alderson 的两条工程启示:HF 攻击面极大,大规模并行评测会让异常流量淹没监控。 #应用技巧#Agents#安全