[论文学习]僕人、跟踪者、掠食者:诚实、有用且无害(3H)的智能体如何释放对抗性技能
Servant, Stalker, Predator: How An Honest, Helpful, And Harmless (3H) Agent Unlocks Adversarial Skills (2025)
论文重点
本文揭示了基于模型上下文协议(MCP)的智能体系统中存在一类新型漏洞——单个看来无害且被授权的任务,经由智能体…
2026/8/21 9:55:34