话题 / TOPIC
T Salon 关于 AI 安全的内容合集,关注自主智能体带来的新型攻击面、记忆投毒等持久化风险,以及企业在部署 Agent 时需要建立的长期控制措施。
2 篇内容
如果系统把网页中的虚假联系人写成“可信供应商”,影响不止停留在这轮对话。Memory Poisoning 指不可信、错误或被操纵的信息进入持久记忆后,在后续会话中被再次调用。
Hugging Face 披露了一场完全由自主 AI 智能体框架发起的数千次操作攻击。而在防御与取证阶段,商业大模型的“安全护栏(Guardrails)”反而成为了阻碍,揭示了 AI 安全领域的全新挑战。