Hugging Face 如何为 API 客户将 Transformer 推理提速 100 倍
Hugging Face 通过组合 Transformers 与 Tokenizers 库的优化方法,为 Accelerated Inference API 客户实现了 100 倍推理提速。
Hugging Face 通过组合 Transformers 与 Tokenizers 库的优化方法,为 Accelerated Inference API 客户实现了 100 倍推理提速。
Hugging Face 发布博客,详解基于 Transformer 的编码器-解码器架构如何建模序列到序列问题,并说明其在推理中的使用方式。文章将架构拆解为编码器与解码器两部分,结合大量图示建立理论与 🤗Transformers 实际推理用法的联系,并回顾神经编码器-解码器模型的历史。
OpenAI 提出 Random Network Distillation(RND),一种基于预测的奖励方法,通过好奇心鼓励强化学习智能体探索环境。该方法首次在 Montezuma's Revenge 上超越人类平均表现。
OpenAI 开发出一种分层强化学习算法,能学习对求解多类任务有用的高层动作,从而快速解决需要数千个 timestep 的任务。在一组导航问题上,该算法发现了向不同方向行走和爬行的高层动作集合,使智能体能够快速掌握新的导航任务。