跳到正文

全部动态

今日 2 条
6月20日周四
6月18日周二
6月6日周四
5月24日周五
  1. Hugging Face Blog38

    Meta 发布 CyberSecEval 2:面向大语言模型网络安全风险与能力的综合评测框架

    Meta 发布 CyberSecEval 2,从代码不安全实践、提示词注入、网络攻击协助、代码解释器滥用和自动化攻击能力五个维度评测 LLM 的网络安全风险。相比 2023 年 12 月的首版,LLM 协助网络攻击的平均合规率从 52% 降至 28%。提示词注入仍是未解难题,代码解释器滥用风险突出,评测代码已全部开源。

5月5日周日
4月23日周二
4月22日周一
4月20日周六
4月19日周五
4月16日周二
3月20日周三
  1. Hugging Face Blog62

    Cosmopedia:如何为 LLM 预训练构建大规模合成数据

    Hugging Face 发布 Cosmopedia,一个由 Mixtral-8x7B-Instruct-v0.1 生成的合成数据集,包含超 3000 万个文件、250 亿 token,用于从零预训练大语言模型,目标是复现 Phi-1.5 的训练数据。

    推荐理由:Hugging Face 公开了从提示词设计到去污染、训练评估的完整合成数据流水线,可迁移到自建预训练数据。

3月15日周五
  1. Hugging Face Blog40

    Hugging Face 发布 WebSight 数据集,用 VLM 将网页截图转为 HTML 代码

    Hugging Face 推出 WebSight 数据集,用于训练视觉语言模型将网页截图转换为 HTML 代码。该数据集从 v0.1 的 823,000 对截图/HTML 样本扩展至 v0.2 的 200 万例,改用真实截图和 Tailwind CSS。基于该数据集微调的模型 Sightseer 可将网页截图转为可用的 HTML 代码,并还原截图中的图像。

3月5日周二
  1. Hugging Face Blog36

    Hugging Face 发布 ConTextual:评测多模态模型在文本密集场景中的图文联合推理能力

    加州大学洛杉矶分校研究者推出 ConTextual,一个包含 506 条指令的文本密集视觉推理数据集,覆盖时间阅读、购物、导航、信息图等 8 类真实场景,并同步上线排行榜。初步评测 13 个模型显示,GPT-4V 表现最佳,在抽象推理上超过人类,但在时间相关任务上落后;开源模型在多个领域表现不佳,用 OCR 加 caption 增强 LLM 的方案人类通过率仅 17.2%。

2月23日周五
2月20日周二
2月2日周五
1月31日周三
1月29日周一
1月26日周五
  1. Hugging Face Blog38

    Hugging Face 推出 AI Secure LLM Safety Leaderboard

    Hugging Face 发布 LLM Safety Leaderboard,基于 DecodingTrust 对 LLM 安全性进行评估,该平台曾获 NeurIPS 2023 杰出论文奖。评估覆盖毒性、刻板印象偏见、对抗鲁棒性、OOD 鲁棒性、隐私、机器伦理和公平性等八个可信度维度,并提供针对各维度的红队测试算法。用户可将模型权重转为 safetensors 格式后通过排行榜提交评估。

12月14日周四
12月6日周三
12月1日周五
  1. Hugging Face Blog34

    Open LLM Leaderboard 的 DROP 基准深度排查

    Open LLM Leaderboard 新增的 DROP 基准出现异常:绝大多数模型 f1-score 低于 10。Hugging Face 排查发现,归一化步骤在数字后跟非空格空白字符时无法匹配正确答案,且以 . 作为停止词会截断浮点答案、让高质量模型生成过多内容反而拉低 f1。改用 \n 作为停止词重新计算后,分数与整体表现的相关性明显改善。

6月12日周一
5月31日周三
  1. OpenAI News62

    OpenAI 用过程监督提升数学推理能力

    OpenAI 训练了一个模型,通过奖励每一步正确推理(过程监督)而非只奖励最终正确答案(结果监督),在数学问题求解上取得新的 SOTA。除性能提升外,过程监督还带来对齐收益:直接训练模型产出人类认可的思维链。

    推荐理由:OpenAI 用过程监督替代结果监督提升数学推理,并给出对对齐的额外收益,可了解训练方法差异。

5月9日周二
3月17日周五
1月11日周三
  1. OpenAI News42

    OpenAI 与乔治城大学、斯坦福互联网天文台联合研究:语言模型如何被用于虚假信息宣传及如何降低风险

    OpenAI 联合乔治城大学安全与新兴技术中心及斯坦福互联网天文台,研究大语言模型可能被用于虚假信息宣传的方式,并发布了一份基于一年多研究的联合报告。报告梳理了语言模型若被用于增强虚假信息宣传会对信息环境构成的威胁,并提出了一套分析潜在缓解措施的框架。

10月19日周三
  1. Hugging Face Blog62

    Hugging Face 发布 MTEB:大规模文本嵌入基准

    Hugging Face 发布 MTEB(Massive Text Embedding Benchmark),用于在多种嵌入任务上衡量文本嵌入模型性能,包含 56 个数据集、8 类任务,覆盖最多 112 种语言,榜单已汇总超过 2000 条结果。

    推荐理由:MTEB 把 56 个数据集、8 类任务和 112 种语言汇总成统一榜单,读者可据此理解文本嵌入模型的评测口径与选型依据。

9月26日周一
6月23日周四
  1. OpenAI News74

    OpenAI 用视频预训练让神经网络学会玩 Minecraft

    OpenAI 提出 Video PreTraining(VPT)方法,在大量无标注的人类玩 Minecraft 视频上训练神经网络,仅使用少量承包商标注数据。经微调后,模型能学会制作钻石工具,这一任务通常需要熟练人类花费 20 多分钟、约 24000 次操作。模型直接使用键盘按键和鼠标移动这类原生人类交互接口,具有较强通用性,是迈向通用计算机使用智能体的一步。

    推荐理由:OpenAI 用少量标注数据加海量无标注视频训练出能玩 Minecraft 的模型,可了解视频预训练在通用计算机智能体上的早期尝试。

6月13日周一
  1. OpenAI News62

    OpenAI 训练批评写作模型,帮助人类发现摘要缺陷

    OpenAI 训练了批评写作模型,用于描述摘要中的缺陷。人类评估者在看到模型给出的批评后,发现摘要缺陷的频率明显提高。研究还发现,模型越大自批评能力越强,规模对批评写作的提升大于对摘要写作的提升,这为用 AI 系统辅助人类监督 AI 系统提供了可能。

    推荐理由:OpenAI 用批评写作模型辅助人类发现摘要缺陷,并给出模型规模与自批评能力的关系。

5月23日周一
2月2日周三
12月16日周四
10月29日周五
  1. OpenAI News70

    OpenAI 训练数学应用题求解系统,准确率约为微调 GPT-3 的两倍

    OpenAI 训练了一个求解小学数学应用题的系统,准确率约为微调 GPT-3 模型的两倍。该系统能解出约 90% 的题目数量,在一组 9-12 岁儿童样本上,儿童在同一数据集测试中得分 60%,该系统得分为 55%。

    推荐理由:读者可了解该数学应用题求解系统与微调 GPT-3 及小学生的准确率对比,判断其能力位置。

9月23日周四
7月15日周四
  1. Hugging Face Blog62

    Hugging Face 提出 DeDLOC:40 名志愿者协作预训练孟加拉语模型 sahajBERT

    Hugging Face 联合 Yandex Research 等机构提出 DeDLOC 协作式分布式训练方法,可自适应参与者的网络与硬件条件,并通过 40 名志愿者在互联网上预训练出孟加拉语模型 sahajBERT。

    推荐理由:Hugging Face 团队用 40 名志愿者在互联网上预训练出孟加拉语模型,给出了分布式协作训练在真实场景中的可行路径。

6月10日周四