Hugging Face Blog·· 2026-06-19AI 评分41
Hugging Face 提出 MosaicLeaks:深度研究智能体能否守住秘密?
MosaicLeaks: Can your research agent keep a secret?
AI 导读
Hugging Face 发布 MosaicLeaks,用 1001 条多跳研究链评测深度研究智能体的隐私泄露风险,测试模型普遍泄露私有信息,且只训练任务性能会加剧泄露。其提出的 Privacy-Aware Deep Research(PA-DR)强化学习方法将严格链成功率从 48.7% 提升至 58.7%,同时把答案/全信息泄露从 34.0% 降至 9.9%。
来源:Hugging Face Blog · huggingface.co