跳到正文

#部署/工程

今日 8 条
11月4日周四
10月26日周二
  1. Hugging Face Blog22

    大语言模型:新的摩尔定律?

    Hugging Face 发文质疑微软与 NVIDIA 发布的 Megatron-Turing NLG 530B 这类超大模型趋势,指出复现该实验需花费近 1 亿美元,且训练 BERT 的碳排放已相当于一次跨美飞行。文章主张改用预训练模型、更小模型(如 DistilBERT 保留 97% 语言理解能力、体积小 40%、速度快 60%)和微调等务实方案。

10月20日周三
10月5日周二
9月14日周二
7月28日周三
7月13日周二
7月8日周四
6月28日周一
5月25日周二
  1. Hugging Face Blog60

    Gradio 2.0 发布:一行代码加载并混用 Hugging Face 模型

    Gradio 2.0 发布,可用一行代码为 Hugging Face 模型加载 GUI,默认调用 Hugging Face 托管的 Inference API,也可本地运行 transformers。该版本支持把多个模型并联对比或串联组合,例如用 3 行代码搭建翻译并摘要芬兰语新闻的应用,安装方式为 pip install gradio。

    推荐理由:原文给出 Gradio 2.0 一行代码加载 Hugging Face 模型并串联、并联组合的方式,读者可据此判断搭建模型演示的成本变化。

4月20日周二
4月16日周五
  1. Hugging Face Blog60

    Hugging Face 发布 Accelerate 库,让原始 PyTorch 训练脚本适配分布式与混合精度

    Hugging Face 发布 Accelerate 库,面向希望完全掌控训练循环、又不愿编写分布式训练和混合精度样板代码的 PyTorch 用户。只需在标准训练脚本中加入约五行代码,即可在单机多卡、多节点、TPU 等分布式环境以及有无混合精度的情况下运行,并自动处理设备放置。

    推荐理由:官方给出五处代码改动即可切换分布式与混合精度的具体做法,便于评估对现有 PyTorch 训练脚本的改造成本。

4月8日周四
3月23日周二
3月18日周四
3月9日周二
2月10日周三
2月9日周二
1月26日周二
1月25日周一
1月19日周二
1月18日周一
11月3日周二
9月10日周四
7月3日周五
1月30日周四
12月6日周三
  1. OpenAI News62

    OpenAI 发布块稀疏 GPU kernel

    OpenAI 发布针对块稀疏权重神经网络的高度优化 GPU kernel,按所选稀疏度可比 cuBLAS 或 cuSPARSE 快数个数量级。OpenAI 表示已用这些 kernel 在文本情感分析和文本、图像生成建模上取得当时的最优结果。

    推荐理由:OpenAI 公开面向块稀疏权重网络的 GPU kernel,并给出相对 cuBLAS 与 cuSPARSE 的加速幅度和落地任务。

6月28日周三
11月15日周二
8月29日周一