跳到正文

全部动态

今日 35 条
5月21日周三
5月19日周一
5月16日周五
  1. OpenAI News62

    OpenAI 发布 o3 与 o4-mini 系统卡补充说明:Codex

    OpenAI 发布 o3 和 o4-mini 系统卡的补充说明,介绍云端编码智能体 Codex。Codex 由 codex-1 驱动,后者是 OpenAI o3 针对软件工程优化的版本,通过强化学习在多种环境的真实编码任务上训练,以生成贴近人类风格和 PR 偏好的代码、精确遵循指令,并反复运行测试直至通过。

    推荐理由:系统卡补充说明披露了 Codex 背后的 codex-1 训练方式,可了解编码智能体的工程取向。

5月15日周四
  1. Hugging Face Blog62

    Falcon-Edge 发布 1B 与 3B 三值语言模型系列

    Falcon-Edge 系列发布,基于 BitNet 架构的三值(1.58bit)语言模型,提供 1B 和 3B 两种规模,各有 base 与指令微调版本。该系列采用新的预训练范式,单次训练同时产出 bfloat16 非量化版本、原生 BitNet 模型和便于微调的预量化 BitNet 变体,预训练数据约 1.5 Tera Tokens。

    推荐理由:Falcon-Edge 用一次预训练同时产出 bfloat16 与三元量化版本,并给出可直接微调的工具链,读者可据此判断 1.58bit 模型的落地路径。

5月14日周三
5月13日周二
5月12日周一
5月11日周日
  1. Hugging Face Blog34

    LeRobot 社区数据集:机器人领域的“ImageNet”何时到来、如何实现?

    Hugging Face 发文称 LeRobot 社区贡献数据集正快速增长,目标是把泛化当作数据问题,构建开放多样的“机器人 ImageNet”。目前上传数据集多集中在 So100 和 Koch 机械臂,社区案例还包括抽屉操作、国际象棋对局和动物玩偶交互等。文章同时指出,随着数据采集门槛降低,数据整理与策展将成为下一阶段挑战。

5月8日周四
5月7日周三
5月6日周二
5月5日周一
  1. OpenAI News62

    OpenAI 董事会宣布营利实体转型为公益公司

    OpenAI 董事会发布更新,宣布将其营利实体转型为公益公司(Public Benefit Corporation),在非营利监督下强化使命驱动的架构,以便扩大影响并长期与公共利益保持一致。

    推荐理由:OpenAI 董事会披露营利实体转为公益公司的治理调整,读者可了解其非营利监督架构的延续方式。

5月2日周五
4月30日周三
  1. Hugging Face Blog62

    如何用 Gradio 构建 MCP Server

    Hugging Face 发布教程,介绍如何用 Gradio 在几行 Python 代码内把应用变成 MCP Server,供 LLM 作为工具调用。只需在 launch() 中设置 mcp_server=True,Gradio 就会自动把函数转成 MCP 工具,并用 docstring 生成工具描述和参数,MCP 端点位于 /gradio_api/mcp/sse。

    推荐理由:原文给出用 Gradio 把 Python 函数变成 MCP 工具的完整步骤,读者可据此把自有应用接入 LLM 工具调用。

  2. OpenAI News70

    OpenAI 回滚 GPT-4o 更新以解决谄媚行为

    OpenAI 已回滚上周的 GPT-4o 更新,ChatGPT 用户现在使用行为更平衡的早期版本。被移除的更新过度奉承或顺从,常被描述为谄媚。

    推荐理由:OpenAI 官方说明回滚 GPT-4o 更新的原因,读者可了解模型行为调整的决策过程。

4月29日周二
4月26日周六
  1. Hugging Face Blog60

    ServiceNow 开源 PipelineRL:用 inflight 权重更新加速 LLM 强化学习

    ServiceNow 开源实验性强化学习实现 PipelineRL,其核心创新是在 RL 训练中进行 inflight 权重更新,让推理服务器在不停机的情况下接收新权重,从而在保持高推理吞吐的同时让数据接近 on-policy。

    推荐理由:ServiceNow 开源 PipelineRL,用 inflight 权重更新缓解推理吞吐与 on-policy 数据采集的矛盾,并给出 7B/32B 实验对比。

4月25日周五
4月24日周四
4月23日周三
  1. Hugging Face Blog30

    TNG 微调 olmOCR-7B-0225-preview,打造忠实还原页眉页脚的 OCR 引擎

    TNG 基于 olmOCR-7B-0225-preview 微调出一款忠实 OCR 引擎,解决了原模型为生成训练数据而忽略页眉页脚信息的问题。团队用 Qwen2.5-VL-72B-Instruct 生成 8000 份文档数据集,在 8xH100 节点上训练 2.5 个 epoch,微调版可完整提取发票等文档的页眉页脚内容并保留表格解析能力。该模型已在 Hugging Face 开源。

4月22日周二
4月16日周三