跳到正文
原文
Hugging Face Blog·· 2026-06-19AI 评分41

Hugging Face 提出 MosaicLeaks:深度研究智能体能否守住秘密?

MosaicLeaks: Can your research agent keep a secret?

AI 导读

Hugging Face 发布 MosaicLeaks,用 1001 条多跳研究链评测深度研究智能体的隐私泄露风险,测试模型普遍泄露私有信息,且只训练任务性能会加剧泄露。其提出的 Privacy-Aware Deep Research(PA-DR)强化学习方法将严格链成功率从 48.7% 提升至 58.7%,同时把答案/全信息泄露从 34.0% 降至 9.9%。

来源:Hugging Face Blog · huggingface.co