跳到正文

#部署/工程

今日 4 条
4月16日周五
  1. Hugging Face Blog60

    Hugging Face 发布 Accelerate 库,让原始 PyTorch 训练脚本适配分布式与混合精度

    Hugging Face 发布 Accelerate 库,面向希望完全掌控训练循环、又不愿编写分布式训练和混合精度样板代码的 PyTorch 用户。只需在标准训练脚本中加入约五行代码,即可在单机多卡、多节点、TPU 等分布式环境以及有无混合精度的情况下运行,并自动处理设备放置。

    推荐理由:官方给出五处代码改动即可切换分布式与混合精度的具体做法,便于评估对现有 PyTorch 训练脚本的改造成本。

4月8日周四
3月23日周二
3月18日周四
3月9日周二
2月10日周三
2月9日周二
1月26日周二
1月25日周一
1月19日周二
1月18日周一
11月3日周二
9月10日周四
7月3日周五
1月30日周四
12月6日周三
  1. OpenAI News62

    OpenAI 发布块稀疏 GPU kernel

    OpenAI 发布针对块稀疏权重神经网络的高度优化 GPU kernel,按所选稀疏度可比 cuBLAS 或 cuSPARSE 快数个数量级。OpenAI 表示已用这些 kernel 在文本情感分析和文本、图像生成建模上取得当时的最优结果。

    推荐理由:OpenAI 公开面向块稀疏权重网络的 GPU kernel,并给出相对 cuBLAS 与 cuSPARSE 的加速幅度和落地任务。

6月28日周三
11月15日周二
8月29日周一