Hugging Face Blog·· 2024-01-26AI 评分38
Hugging Face 推出 AI Secure LLM Safety Leaderboard
An Introduction to AI Secure LLM Safety Leaderboard
AI 导读
Hugging Face 发布 LLM Safety Leaderboard,基于 DecodingTrust 对 LLM 安全性进行评估,该平台曾获 NeurIPS 2023 杰出论文奖。评估覆盖毒性、刻板印象偏见、对抗鲁棒性、OOD 鲁棒性、隐私、机器伦理和公平性等八个可信度维度,并提供针对各维度的红队测试算法。用户可将模型权重转为 safetensors 格式后通过排行榜提交评估。
来源:Hugging Face Blog · huggingface.co