跳到正文

全部动态

今日 11 条
10月8日周二
  1. Hugging Face Blog42

    Intel Labs 与 Hugging Face 推出动态推测解码,文本生成最高提速 2.7 倍

    Intel Labs 与 Hugging Face 提出动态推测解码方法,根据助手模型每次预测的置信度动态调整推测前瞻长度,文本生成最高提速 2.7 倍。该方法自 Transformers 4.45.0 起成为辅助生成的默认模式,在 Llama3.1-8B 搭配 Llama3.2-1B 等测试中均优于启发式方法,后者在 codegen-6B-mono 上甚至出现减速。

10月4日周五
  1. Hugging Face Blog34

    Hugging Face 推出 Open FinLLM Leaderboard,面向金融场景评测大语言模型

    Hugging Face 发布 Open FinLLM Leaderboard,专门评测大语言模型在金融任务上的表现,覆盖信息抽取、文本分析、问答、文本生成、风险管理、预测和决策七大类。该榜单采用零样本评测,使用 Accuracy、F1、ROUGE 和 MCC 等指标,数据集聚焦真实金融场景,如信用评分、欺诈检测和股价走势预测。

10月3日周四
10月2日周三
10月1日周二
9月30日周一
  1. Hugging Face Blog28

    Hugging Face 教程:如何将顶点着色网格转换为 UV 贴图纹理网格

    Hugging Face 发布教程,介绍如何将 InstantMesh 等生成式 3D 模型输出的顶点着色网格转换为 UV 贴图纹理网格,并提供 InstantTexture 库实现一键转换。该库通过 xatlas 生成 UV 映射,结合重心坐标插值填充纹理,再用修复、中值滤波、高斯模糊和 LANCZOS 降采样消除空洞与噪点,最终输出 .glb 网格。

9月26日周四
9月25日周三
  1. Hugging Face Blog82

    Llama 3.2 发布:多模态与端侧小模型上线 Hugging Face

    Meta 发布 Llama 3.2,共 10 个开放权重模型,包括 5 个多模态模型和 5 个纯文本模型,均已上线 Hugging Face。多模态的 Llama 3.2 Vision 提供 11B 和 90B 两个尺寸,另有可在设备端运行的 1B 和 3B 文本模型,支持 128k 上下文和 8 种语言。

    推荐理由:Hugging Face 与 Meta 合作发布 Llama 3.2,给出多模态与端侧小模型的能力、许可限制和上手方式。

9月24日周二
9月23日周一
  1. Hugging Face Blog22

    Hugging Face Daily Papers 页面功能全解析

    Hugging Face 的 Daily Papers 页面已收录超 3,700 篇论文、订阅者超 12k,作者可一键认领论文并关联到自己的账号。用户还能提交论文、在评论区与作者直接对话,并用 @librarian-bot 获取相似论文推荐。页面支持多语言评论与翻译,并可将论文关联的模型、数据集和 demo 集中展示。

9月20日周五
9月19日周四
9月18日周三
9月17日周二
  1. Mistral AI73

    Mistral AI 发布 Pixtral 12B 多模态模型

    Mistral AI 发布 Pixtral 12B,一个原生多模态模型,采用从零训练的 400M 参数视觉编码器和基于 Mistral Nemo 的 12B 多模态解码器,支持可变图像尺寸与宽高比,128k token 上下文窗口内可处理任意数量图片。

    推荐理由:官方给出架构、评测口径与本地部署方式,可据此判断这一 12B 多模态模型在开源阵营中的位置。

  2. Hugging Face Blog62

    Hugging Face 在 Datasets 上推出 SQL Console

    Hugging Face 在 Hub 的每个数据集页面新增 SQL Console,可直接在浏览器中对数据集运行 SQL 查询。该控制台由 DuckDB WASM 驱动,完全在本地运行,支持完整 DuckDB 语法、结果导出为 parquet,并可通过链接分享公开数据集的查询结果。官方称内存上限约 3GB,DuckDB WASM 尚未支持 hf:// 协议查询数据集。

    推荐理由:官方给出浏览器内 SQL 查询数据集的能力与内存限制,读者可据此判断能否替代本地预处理脚本。

9月16日周一
9月13日周五
9月12日周四