跳到正文

全部动态

今日 7 条
8月12日周二
8月8日周五
  1. Hugging Face Blog62

    Hugging Face 发布 AI Sheets:用开放 AI 模型处理数据集的无代码工具

    Hugging Face 发布开源无代码工具 AI Sheets,可在本地或 Hub 上部署,通过类似电子表格的界面用提示词新建列来构建、转换和丰富数据集。工具可调用 Hub 上数千个开放模型(含 OpenAI 的 gpt-oss),支持模型对比、提示词迭代、数据分类与合成数据生成,并可导出到 Hub 生成可复用配置,配合 HF Jobs 脚本扩展至更大规模数据生成。

    推荐理由:Hugging Face 官方开源的无代码数据集工具,读者可了解如何用开放模型批量构建、清洗和评测数据。

8月7日周四
  1. OpenAI News85

    OpenAI 在 API 平台推出 GPT-5

    OpenAI 在 API 平台推出 GPT-5,主打高推理性能、面向开发者的新控制项,以及在真实编码任务上的领先结果。

    推荐理由:OpenAI 在 API 平台上线 GPT-5,开发者可据此了解新模型在推理与真实编码任务上的定位。

  2. OpenAI News30

    GPT-5 如何用于医学研究

    OpenAI 发文介绍 GPT-5 在医学研究中的用途。原文未披露具体模型版本参数、benchmark 分数或可用性细节,仅以“了解 GPT-5 如何用于医学研究”概述该主题。

  3. Hugging Face Blog62

    TRL 为视觉语言模型加入 MPO、GRPO、GSPO 对齐支持

    Hugging Face 的 TRL 新增面向视觉语言模型的对齐方法支持,包括 Mixed Preference Optimization(MPO)、Group Relative Policy Optimization(GRPO)和 Group Sequence Policy Optimization(GSPO),并扩展 RLOO 与 Online DPO 到多模态场景。

    推荐理由:TRL 把 MPO、GRPO、GSPO 等对齐方法扩展到视觉语言模型,并给出可直接运行的训练脚本与 notebook。

  4. OpenAI News82

    OpenAI 发布 GPT-5 系统卡,披露统一模型路由机制

    OpenAI 发布 GPT-5 系统卡,说明其通过统一模型路由系统实现快速与智能的响应。该系统使用 gpt-5-main、gpt-5-thinking 以及 gpt-5-thinking-nano 等轻量版本,针对不同任务和开发者用途进行优化。

    推荐理由:系统卡披露 GPT-5 用统一路由在 gpt-5-main、gpt-5-thinking 与轻量版本间分配任务。

  5. OpenAI News85

    OpenAI 发布 GPT-5

    OpenAI 发布 GPT-5,称其为目前最强的 AI 系统,在智能水平上较此前所有模型有显著跃升。GPT-5 在编码、数学、写作、健康、视觉感知等方面达到 SOTA 表现。

    推荐理由:OpenAI 官方公布 GPT-5 的定位与能力覆盖范围,读者可据此了解其相对前代模型的升级方向。

8月6日周三
  1. OpenAI News67

    OpenAI 与 GSA 合作,向美国联邦行政部门全员提供 ChatGPT Enterprise

    OpenAI for Government 宣布与美国总务管理局(GSA)达成合作,未来一年 ChatGPT Enterprise 将以近乎零成本提供给整个联邦行政部门的工作人员。该计划覆盖联邦行政部门的全部员工。

    推荐理由:OpenAI 与美国 GSA 合作,一年内让 ChatGPT Enterprise 覆盖整个联邦行政部门,可观察 AI 进入公共部门的落地方式。

8月5日周二
  1. OpenAI News62

    OpenAI 发布其最强开放权重模型

    OpenAI 发布其能力最强的开放权重模型,称这是让先进 AI 更开放、灵活和可及的重要一步。官方表示,其使命是让尽可能多的人用上 AI,此次发布旨在推动 AI 在全球范围内的普及。

    推荐理由:OpenAI 官方宣布发布其能力最强的开放权重模型,读者可据此了解其开放与可及性主张。

  2. OpenAI News85

    OpenAI 发布 gpt-oss-120b 与 gpt-oss-20b 开放权重模型

    OpenAI 发布 gpt-oss-120b 和 gpt-oss-20b 两款开放权重语言模型,采用 Apache 2.0 许可。官方称这两款模型在推理任务上优于同规模开放模型,具备较强的工具调用能力,并针对消费级硬件的高效部署做了优化。

    推荐理由:OpenAI 开源两款权重模型,给出参数量、许可与部署定位,便于判断本地推理的可用边界。

8月4日周一
8月1日周五
7月31日周四
7月30日周三
  1. Mistral AI62

    Mistral 发布 Codestral 25.08 及企业级编码栈

    Mistral AI 发布 Codestral 25.08,并推出覆盖补全、语义检索与智能体工作流的企业级编码栈。官方称 Codestral 25.08 相比此前版本补全采纳率提升 30%、建议后保留代码增加 10%、失控生成减少 50%,chat 模式下指令遵循与代码能力各提升 5%。

    推荐理由:Mistral 官方给出编码栈各组件的能力数字与私有化部署路径,可据此判断企业自建编码助手的可行边界。

7月29日周二
7月25日周五
7月24日周四
7月23日周三
  1. Hugging Face Blog62

    用 Diffusers 和 PEFT 加速 Flux 的 LoRA 推理

    Hugging Face 发布教程,介绍如何用 Diffusers 和 PEFT 优化 Flux.1-Dev 的 LoRA 推理速度。方案组合 Flash Attention 3、torch.compile 和 FP8 量化,并通过 hotswap 机制避免切换 LoRA 时触发重新编译,在 H100 上相比基线取得 2.23 倍加速。

    推荐理由:原文给出 Flux LoRA 推理的完整优化配方与实测数据,读者可据此在 H100 或 4090 上复现加速效果。