Hugging Face Blog·· 2024-11-20AI 评分38
让大模型辩论:首届多语言 LLM 辩论赛 FlagEval Debate 举办
Letting Large Models Debate: The First Multilingual LLM Debate Competition
AI 导读
BAAI 推出 FlagEval Debate 辩论平台,让大模型直接对抗,目前支持英语、中文、阿拉伯语和韩语四种语言的辩论赛。平台采用专家评审与用户投票的双重评估机制,并提供开发者自定义功能,可调整模型参数、策略与对话风格。2024 年 Q3 的实验显示,当前大多数模型都能参与辩论。
来源:Hugging Face Blog · huggingface.co