跳到正文

全部动态

今日 36 条
10月23日周三
  1. Hugging Face Blog22

    CinePile 2.0:用对抗式数据集精炼打造更强的长视频问答数据集

    Hugging Face 发布 CinePile 2.0 长视频问答数据集,采用其提出的对抗式数据集精炼方法进行改进。CinePile 初版于 2024 年 5 月推出,包含约 30 万训练样本和 5000 测试样本,人类在该基准上比最好的商业视觉模型高 25%、比开源模型高 65%。CinePile 2.0 与 Hugging Face 合作完成,同时开源了对抗式精炼方法的实现。

10月22日周二
10月21日周一
10月16日周三
  1. Mistral AI71

    Mistral 发布 Ministral 3B 与 8B 两款端侧模型

    Mistral AI 在 Mistral 7B 发布一周年之际推出 Ministral 3B 和 Ministral 8B 两款面向端侧与本地推理的模型,称其在 10B 以下级别刷新了知识、常识、推理、函数调用和效率的表现。

    推荐理由:Mistral 在 7B 发布一周年推出两款端侧小模型,给出定价、上下文长度与基准对比,可据此判断本地推理的选型空间。

10月15日周二
10月10日周四
10月9日周三
10月8日周二
  1. Hugging Face Blog42

    Intel Labs 与 Hugging Face 推出动态推测解码,文本生成最高提速 2.7 倍

    Intel Labs 与 Hugging Face 提出动态推测解码方法,根据助手模型每次预测的置信度动态调整推测前瞻长度,文本生成最高提速 2.7 倍。该方法自 Transformers 4.45.0 起成为辅助生成的默认模式,在 Llama3.1-8B 搭配 Llama3.2-1B 等测试中均优于启发式方法,后者在 codegen-6B-mono 上甚至出现减速。

10月4日周五
  1. Hugging Face Blog34

    Hugging Face 推出 Open FinLLM Leaderboard,面向金融场景评测大语言模型

    Hugging Face 发布 Open FinLLM Leaderboard,专门评测大语言模型在金融任务上的表现,覆盖信息抽取、文本分析、问答、文本生成、风险管理、预测和决策七大类。该榜单采用零样本评测,使用 Accuracy、F1、ROUGE 和 MCC 等指标,数据集聚焦真实金融场景,如信用评分、欺诈检测和股价走势预测。

10月3日周四
10月2日周三
10月1日周二