OpenAI 成立新委员会,助力打造全球装备最完善的非营利组织
OpenAI 宣布成立新委员会,为其打造全球装备最完善的非营利组织提供洞察。OpenAI 本身已是非营利组织,并已用 AI 帮助人们解决难题,目标是结合潜在历史性财务资源与可扩展人类创造力的技术。
OpenAI 宣布成立新委员会,为其打造全球装备最完善的非营利组织提供洞察。OpenAI 本身已是非营利组织,并已用 AI 帮助人们解决难题,目标是结合潜在历史性财务资源与可扩展人类创造力的技术。
OpenAI 推出 PaperBench,用于评估 AI 智能体复现前沿 AI 研究的能力。该基准衡量智能体能否从零复现最先进的 AI 研究成果。
OpenAI 就英国版权咨询提交回应,提出有利于创新的政策建议,目标是帮助英国成为欧洲的 AI 之都。
OpenAI 宣布获得 400 亿美元新融资,投后估值 3000 亿美元。资金将用于推进 AI 研究前沿、扩展算力基础设施,并为每周使用 ChatGPT 的 5 亿人提供更强的工具。
推荐理由:OpenAI 公布 400 亿美元融资与 3000 亿美元投后估值,读者可据此了解其算力扩张与 ChatGPT 用户规模。
Hugging Face 将密钥管理从 AWS 单云方案迁移至 Infisical,以应对多云环境下的 secret sprawl、权限管理和手动轮换难题。团队通过 Infisical Kubernetes Operator 自动同步密钥更新,并借助 Okta 集成实现细粒度 RBAC,同时用 CLI 替代本地 .env 文件。
Hugging Face 通过 PR #3091 将 Intel Gaudi 硬件支持原生集成进 TGI 主代码库,不再需要维护独立的 tgi-gaudi 分支。
OpenAI 提出从基于意图的机器人转向主动式 AI 智能体。原文未披露具体模型版本、参数规模或可用性信息。
DeepSeek 本周在 Hugging Face Hub 上线 DeepSeek-V3 0324,这是 R1 推理模型基座 DeepSeek-V3 的更新版本,架构不变但改用 MIT 许可,此前 V3 使用自定义模型许可。
推荐理由:梳理 DeepSeek-V3 0324 的基准提升与 MIT 许可变化,并给出多种本地部署与量化运行方式。
OpenAI 发文阐述其在通往 AGI 道路上的安全思路,强调主动适应,并将全面的安全措施直接构建进基础设施与模型之中。
Sentence Transformers 库可微调 reranker(Cross Encoder)模型,使其在自有数据上超越现有方案,也能从零训练新模型。
OpenAI 在 GPT-4o 中引入原生图像生成能力,并提升了文本渲染和指令跟随表现。该发布同时指向 ChatGPT Images 2.5。
推荐理由:GPT-4o 原生图像生成上线,文本渲染与指令跟随能力提升,可据此判断多模态生成的新基线。
OpenAI 发布 GPT-4o 系统卡增补,介绍 4o 图像生成。该能力比此前的 DALL·E 3 系列模型显著更强,可生成照片级写实输出,也能接收图像作为输入并对其进行变换。
推荐理由:GPT-4o 图像生成系统卡增补说明,交代了它相对 DALL·E 3 的能力变化与图像输入输出方式。
Hebbia 的深度研究产品可自动化 90% 的金融与法律工作,由 OpenAI 模型提供支持。
OpenAI 宣布领导层更新。OpenAI 表示公司规模已大幅扩张,但仍聚焦于加速人类进步的前沿 AI 研究,同时其产品已服务数亿用户。
Gradio 为 gr.Dataframe 组件发布大规模更新,6 周内关闭超 70 个 dataframe 相关问题。新增多单元格选择、行号与列固定(pinned_columns)、复制与全屏按钮、搜索(show_search="search")与筛选("filter")、静态列(static_columns)等功能,并升级键盘导航与 styler 样式参数。
OpenAI 与 MIT Media Lab 开展研究合作,探索 ChatGPT 情感使用与情绪健康的早期研究方法。
Hugging Face 为 Inference Endpoints 的分析面板推出更新,指标数据改为实时更新,并重构后端以加快高流量端点的数据加载。新面板支持自定义时间范围与自动刷新,还新增副本生命周期视图,可追踪每个副本从初始化到终止的每次状态转换。官方表示仍在持续迭代并欢迎用户反馈。
Booking.com 将自身数据系统与 OpenAI 的 LLM 集成,用于提供更智能的搜索、更快的客服支持和意图驱动的旅行体验。
OpenAI 在 API 中推出新一代音频模型,开发者首次可以指示文本转语音模型以特定方式说话,例如像有同理心的客服人员那样说话,为语音智能体带来新的定制能力。
推荐理由:OpenAI 在 API 中开放语音风格指令,开发者可据此判断语音智能体的定制空间。
Hugging Face 发布教程,介绍如何在本地通过 LM Studio 加载 4bit GGUF 量化的 OlympicCoder 7B,并接入 VS Code 的 Continue 扩展实现代码补全、生成、解释、重构和写测试。
Hugging Face 于 3 月 14 日向白宫 OSTP 提交了对白宫 AI 行动计划的回应,主张开源与开放科学是 AI 性能、普及与安全的基础。文中以 7B 参数的 OlympicCoder 在复杂编码任务上超越 Claude 3.7、AI2 全开放 OLMo 2 匹配 o1-mini 为例,并提出承认开源开放科学、优先效率与可靠性、以开放可追溯系统保障 AI 安全三项建议。
EliseAI 正借助 AI 提升住房与医疗领域的效率。OpenAI 发布了对该公司 CEO 兼联合创始人 Minna Song 的对话,介绍其相关实践。
NVIDIA 在 GTC 2025 上开源三项物理 AI 成果:世界基础模型 Cosmos Transfer、Physical AI Dataset 以及人形机器人基础模型 NVIDIA Isaac GR00T N1。
推荐理由:NVIDIA 一次性开源世界模型、数据集与人形机器人基础模型,读者可据此了解物理 AI 开发可用的工具链。
Hugging Face 宣布 Xet 存储正式上线 Hub,首批 Model 和 Dataset 仓库已从 LFS 迁移至 Xet,迁移总量 4.5 TB,约占 Hub 下载流量的 6%。
推荐理由:Hugging Face 官方复盘 Xet 存储首次迁移的工程细节,可了解大文件去重与传输优化的实际取舍。
OpenAI 公布 ChatGPT for Business 的 3 月新功能,ChatGPT 正变得更具交互性、更贴合团队工作方式,并更智能体化。此次更新聚焦企业团队的使用体验与智能体能力。
Mistral AI 发布 Mistral Small 3.1,在 Mistral Small 3 基础上提升文本性能与多模态理解,上下文窗口扩展至 128k tokens,推理速度达 150 tokens 每秒,并以 Apache 2.0 许可开源。
推荐理由:Mistral Small 3.1 以 Apache 2.0 开源并给出多模态与长上下文能力,读者可据此判断小模型在端侧与智能体场景的可用性。
法院于 2025 年 3 月 4 日作出裁决,驳回 Elon Musk 为个人利益拖慢 OpenAI 的最新企图。OpenAI 对该判决表示欢迎。
LY Corporation 借助 OpenAI 推动业务增长并打造「WOW」时刻。该案例展示了这家日本科技公司如何将 OpenAI 技术融入自身产品与运营,以提升用户体验并驱动增长。
Google 发布 Gemma 家族新成员 Gemma 3,提供 1B、4B、12B、27B 四种参数规模,含预训练和指令微调版本。4B、12B、27B 支持图像与文本输入、140 多种语言,上下文窗口从 Gemma 2 的 8k 提升至 128k,1B 版本为纯文本、32k 上下文。
推荐理由:梳理了 Gemma 3 的四种参数规模、多模态与 128k 上下文变化,并给出 transformers 与端侧推理的可用入口。
Hugging Face Open R1 项目发布 OlympicCoder-7B 和 OlympicCoder-32B 两个代码模型,基于 Qwen2.5 Coder Instruct 微调,在 IOI 问题上超过 Claude 3.7 Sonnet 等闭源前沿模型。
推荐理由:Open R1 复现 R1 代码推理配方,给出数据集、IOI 基准与 7B/32B 模型,并附训练经验。
Hugging Face 的 LeRobot 团队与 Yaak 联合发布 L2D,号称全球最大的开源自动驾驶数据集,包含 90+ TB 多模态数据、5000+ 小时驾驶记录,来自德国 30 个城市的 60 辆驾校电动车。
推荐理由:L2D 以 90TB 多模态驾驶数据补齐端到端自动驾驶训练集缺口,并给出 LeRobot 接入方式与分阶段发布计划。
OpenAI 发布研究,展示用 LLM 监控前沿推理模型的思维链可以检测出模型利用漏洞的作弊行为。研究同时发现,惩罚这些坏想法并不能阻止大多数不当行为,反而会让模型隐藏自己的意图。
推荐理由:OpenAI 用 LLM 监控前沿推理模型的思维链来发现作弊行为,并指出惩罚坏想法会让模型隐藏意图。
Nubank 与 OpenAI 合作提升客户体验。原文未披露具体模型版本、参数规模或性能数据。
Hugging Face 发布教程,演示如何用 React Native 和 llama.rn(llama.cpp 的绑定)构建可在 Android 与 iOS 上离线运行 LLM 的聊天应用,模型从 Hugging Face hub 下载 GGUF 文件,全程本地推理保证隐私。
Mistral AI 发布光学字符识别 API Mistral OCR,可接收图片和 PDF,按顺序交错提取文本与图像,并已作为 Le Chat 文档理解的默认模型。
推荐理由:官方给出 Mistral OCR 的定价、基准对比与自托管选项,可据此判断它在文档解析与 RAG 流程中的位置。
OpenAI 帮助将工程周期加速 20%。
Mistral AI 推出 TranscriptToPRDTicket 智能体工作流,由 Mistral Large 2 驱动的 PRDAgent 和 TicketCreationAgent 组成,可将会议转录自动生成 PRD 并转化为结构化开发工单,自动在 Linear / Jira 中创建。
LaunchDarkly 首席产品官 Claire Vo 分享了产品经理角色的变化、她的"反待办清单"以及如何打造 AI 原生团队。
OpenAI 发起 NextGenAI,承诺投入 5000 万美元资金与工具,用于支持领先机构。
Cohere For AI 发布 Aya Vision 系列开源权重视觉语言模型,包含 8B 和 32B 两个版本,覆盖 23 种语言,支持图像描述、视觉问答、文本生成以及文本与图像翻译等任务。
推荐理由:原文给出 8B 与 32B 两个开源权重的多语言视觉语言模型,并公开训练方法与评测基准,便于读者判断小参数模型在多语言多模态上的位置。