Hugging Face 发布 transformers 到 mlx-lm 移植 Skill 与测试工具
Hugging Face 发布一个 Skill 和配套测试工具,帮助贡献者把 transformers 中的语言模型移植到 mlx-lm,使模型加入 transformers 后能较快在 MLX 上可用。
推荐理由:Hugging Face 公开了把 transformers 模型移植到 mlx-lm 的 Skill 与测试工具,读者可了解其流程与对评审者的减负设计。
Hugging Face 发布一个 Skill 和配套测试工具,帮助贡献者把 transformers 中的语言模型移植到 mlx-lm,使模型加入 transformers 后能较快在 MLX 上可用。
推荐理由:Hugging Face 公开了把 transformers 模型移植到 mlx-lm 的 Skill 与测试工具,读者可了解其流程与对评审者的减负设计。
Hugging Face 将 RLVE 框架从单轮推理题扩展到多轮、工具增强的电商对话,推出 EcomRLVE-GYM,包含商品发现、替代品、购物车搭建、退货、订单跟踪、政策问答、组合规划、多意图旅程 8 个可验证环境,每个环境配有程序化出题、12 轴难度课程和算法可验证奖励。团队用 DAPO 训练 Qwen 3 8B 模型 300 步,早期结果显示环境扩展与自适应难度可迁移到真实智能体任务。
OpenAI 面向领先安全公司与企业开放 Trusted Access for Cyber,提供 GPT-5.4-Cyber 模型及 1000 万美元 API 资助,用于强化全球网络防御。
Sentence Transformers 现已支持训练和微调多模态嵌入与重排序模型,作者以微调 Qwen/Qwen3-VL-Embedding-2B 做视觉文档检索(VDR)为例演示流程。
Google DeepMind 发布 Gemini 3.1 Flash TTS,称其在可控性、表现力和语音质量上均有提升,在 Artificial Analysis TTS 榜单上取得 1,211 Elo 分数。
推荐理由:官方给出 Elo 1211 与音频标签等具体能力,读者可据此判断语音生成的可控性进展。
Hugging Face 推出 VAKRA,一个面向企业级环境的工具调用可执行基准,用完整执行轨迹评估 AI 智能体的组合式推理能力。VAKRA 提供 8,000+ 本地托管 API、覆盖 62 个领域,任务需 3-7 步推理链,包含 API 链式调用、工具选择、多跳推理等四类任务,模型整体表现不佳。
OpenAI 更新 Agents SDK,新增原生沙箱执行和模型原生 harness,帮助开发者在文件与工具之间构建安全、长时间运行的智能体。
推荐理由:官方给出 Agents SDK 的两项能力变化,读者可据此判断长时运行智能体的构建方式。
HCompany 发布 Chrome 扩展 HoloTab,把其 3 月 31 日推出的计算机操作模型 Holo3 直接接入浏览器,用户描述需求后由智能体在网页内导航界面、填写字段并做决策,无需配置或技术背景。HoloTab 支持例程功能:开始录制后实时捕捉用户在标签页中的点击与口述,录制结束即生成可重复运行或定时调度的例程。该扩展目前免费开放使用。
推荐理由:HCompany 把自家 Holo3 计算机操作模型封装成浏览器扩展,读者可了解录制即生成例程的交互方式。
OpenAI 扩展 Trusted Access for Cyber 计划,向通过审核的防御方开放 GPT-5.4-Cyber,并同步加强安全防护措施。此举正值 AI 网络安全能力持续提升之际。
Google 在 Google Labs 上线研究实验 Vantage,用生成式 AI 构建模拟对话环境,评估高中与大学生的问题解决、协作等未来技能,目前提供英文版并可注册。
Google DeepMind 发布 Gemini Robotics-ER 1.6,这是其推理优先机器人模型的升级版,强化了空间推理与多视角理解,并新增仪表读数能力,可读取压力表、液位计和数字读数。
推荐理由:官方给出与上一代及 Gemini 3.0 Flash 的对比,并说明仪表读数等新能力如何落地机器人巡检。
Cloudflare 将 OpenAI 的 GPT-5.4 和 Codex 引入 Agent Cloud,让企业能够构建、部署并规模化运行面向真实任务的 AI 智能体,兼顾速度与安全。
OpenAI 介绍管理者如何用 ChatGPT 准备沟通、撰写清晰反馈、保持条理并提升团队效能。内容面向管理者日常场景,未披露新模型版本、参数或价格信息。
OpenAI 展示了 ChatGPT、Codex 和 API 等产品在真实场景中的应用方式,覆盖工作、开发与日常任务。内容围绕这些产品如何把 AI 带入实际使用展开,未披露具体版本号、参数规模或性能数据。
OpenAI 介绍客户成功团队如何使用 ChatGPT 管理客户账户、改善沟通、降低流失率,并推动产品采用与续约。
OpenAI 发布面向销售团队的 ChatGPT 实用工作流指南,覆盖客户调研、会议准备、外联触达、销售管道复盘与销售执行等环节。
OpenAI 发布面向财务团队的 ChatGPT 工作流学习内容,覆盖财务分析、报告、规划与决策沟通等实用场景。
OpenAI 介绍营销团队如何使用 ChatGPT 规划营销活动、创作内容、分析效果,并把洞察转化为行动。文章围绕实际 AI 工作流展开,未披露具体模型版本、参数或价格信息。
OpenAI 就 Axios 供应链攻击作出回应,轮换了 macOS 代码签名证书并更新了应用,同时确认没有用户数据遭到泄露。
OpenAI 发布面向初学者的 AI 基础科普内容,讲解 AI 是什么、如何运作,以及 ChatGPT 这类工具如何使用大语言模型。内容定位为清晰易懂的入门指南,帮助读者理解人工智能的基本概念。
OpenAI 发布提示词基础指南,讲解如何写出清晰有效的提示词,从而让 ChatGPT 给出更好、更有用的回答。
OpenAI 介绍如何用 ChatGPT 辅助写作,覆盖起草、修改和润色内容,并强调结构、语气与意图的清晰表达。
OpenAI 介绍在 ChatGPT 中处理文件的实用方法,涵盖查找信息、整理、转换文档以及将文件用于工作流。
OpenAI 发布指南,介绍如何创建和使用 ChatGPT 技能(skills),以构建可复用工作流、自动化重复性任务并保证稳定高质量的输出。
OpenAI 发布面向金融服务机构的 AI 资源,包括提示词包、GPTs、指南和工具,帮助机构安全部署并规模化应用 AI。
ChatGPT 的 projects 功能可用来组织对话、文件与指令,管理持续推进的工作并提升协作效率。该指南介绍了如何借助 projects 归整聊天记录与文件、设置指令,从而更有效地开展协作。
OpenAI 介绍 ChatGPT 的个性化方式:通过自定义指令和记忆功能,让回复更相关、更一致、更贴合个人需求。
ChatGPT 支持通过清晰的提示词生成图像,并可对设计进行迭代优化,在几分钟内产出高质量视觉内容。
OpenAI 介绍如何用 ChatGPT 进行头脑风暴:借助它发散想法、梳理思路,并把粗略概念转化为结构化、可执行的计划。
OpenAI 发布指南,介绍如何用 ChatGPT 的搜索与深度研究(deep research)功能开展研究,以获取最新信息、分析来源并生成结构化洞察。
OpenAI 介绍运营团队如何使用 ChatGPT 简化工作流、改善协作、标准化流程并加快执行速度。
OpenAI 发文介绍临床医生如何使用 ChatGPT 支持诊断、病历记录与患者护理,并强调相关工具具备安全、符合 HIPAA 的合规能力。
OpenAI 介绍如何用 ChatGPT 探索数据集、生成洞察并创建可视化,进而把分析结果转化为可执行的决策。
OpenAI 发布指南,介绍如何用 ChatGPT 做研究:收集来源、分析信息,并生成结构化、带引用的洞察。
OpenAI 发布 AI 负责任与安全使用指南,围绕安全性、准确性和透明度给出最佳实践,适用于 ChatGPT 等工具的使用场景。
Google Research 推出 ConvApparel,一个包含 4000 多组人机多轮对话(近 15000 轮)的服饰购物领域数据集,用于量化 LLM 用户模拟器与真实人类的真实感差距。
Sentence Transformers 发布 v5.4,可在同一套 API 下编码和比较文本、图像、音频与视频,并支持多模态重排模型。新增能力覆盖跨模态相似度、encode_query/encode_document 检索流程以及先检索再重排的 RAG 模式,官方同时列出了 Qwen3-VL、NVIDIA、BGE-VL 等已支持模型。
推荐理由:官方给出 v5.4 多模态嵌入与重排的完整用法和模型清单,可据此评估跨模态检索的落地成本。
Overworld 发布实时视频世界模型 Waypoint-1.5,在 RTX 3090 至 5090 等桌面硬件上可实时生成最高 720p、60 FPS 的环境,并新增面向更广消费级硬件的 360p 版本,后续将支持 Apple Silicon Mac。
推荐理由:Waypoint-1.5 把实时交互世界模型下放到消费级显卡,读者可据此判断本地生成式世界的硬件门槛变化。
CyberAgent 借助 ChatGPT Enterprise 和 Codex 在广告、媒体与游戏业务中安全扩大 AI 应用,提升质量并加快决策。该案例展示了企业如何在多业务线中规模化部署 AI 工具。
Google 发布两个学术智能体框架:PaperVizAgent(原 PaperBanana)从论文文本生成出版级图表,ScholarPeer 则自动完成文献检索与论文评审。