Hugging Face Blog·· 2024-04-19AI 评分36
Hugging Face 发布 Open Medical-LLM Leaderboard:医疗大模型基准评测
The Open Medical-LLM Leaderboard: Benchmarking Large Language Models in Healthcare
AI 导读
Hugging Face 推出 Open Medical-LLM Leaderboard,用统一平台评测大语言模型在医疗任务上的表现,以准确率为主要指标,覆盖 MedQA、MedMCQA、PubMedQA 及 MMLU 的医学与生物学子集。
来源:Hugging Face Blog · huggingface.co