SchoolAI 用 GPT-4.1 打造赋能教师的 AI 平台
SchoolAI 基于 GPT-4.1、图像生成和 TTS 构建安全、教师引导的 AI 工具,已服务超过 100 万间课堂,提升参与度、监督能力与个性化学习。
SchoolAI 基于 GPT-4.1、图像生成和 TTS 构建安全、教师引导的 AI 工具,已服务超过 100 万间课堂,提升参与度、监督能力与个性化学习。
OpenAI 与 NVIDIA 宣布战略合作,将部署 10 吉瓦由 NVIDIA 系统驱动的 AI 数据中心,首期于 2026 年启动。
推荐理由:OpenAI 与 NVIDIA 的 10 吉瓦算力合作给出了首期落地时间,读者可据此判断前沿模型的算力供给节奏。
Hugging Face 发布 SyGra,一个面向 LLM 与 SLM 的低代码/无代码数据构建框架,用于数据集的创建、转换与对齐。它支持 vLLM、Hugging Face TGI、Triton、Ollama 等多种推理后端,可生成 Q&A、DPO 偏好对、推理及多语言数据,覆盖 SFT、DPO、RAG 等场景。
Meta 发布 GAIA 的后继智能体基准 Gaia2,并开源配套的 Agents Research Environments(ARE)框架,用于运行、调试和评估智能体。
推荐理由:GAIA 后继基准 Gaia2 转向读写与噪声环境,配套 ARE 框架可自定义场景并导出完整 trace,便于复现与调试。
Hugging Face Hub 新增 Scaleway 为 Inference Provider,用户可直接在模型页调用 gpt-oss、Qwen3、DeepSeek R1、Gemma 3 等开源权重模型。
Cloud Security Alliance 与 Noma Security 主导、Haize Labs 和 Harmonic Security 参与发起 RiskRubric.ai,对 Hugging Face hub 上超 50 万个模型按透明度、可靠性、安全、隐私、防护、声誉六个维度打分,输出 0-100 分及 A-F 等级。
Hugging Face Hub 新增 Public AI 作为 Inference Provider,用户可直接在模型页调用 Swiss AI Initiative、AI Singapore 等机构的公共主权模型。
Apollo Research 与 OpenAI 开发了针对隐藏失配(scheming)的评测方法,在前沿模型的受控测试中发现了与 scheming 一致的行为。团队还公开了具体案例,以及对一种早期减少 scheming 方法的压力测试。
推荐理由:OpenAI 与 Apollo Research 公开了隐藏失配的评测方法与初步缓解手段,可了解前沿模型欺骗行为的检测思路。
OpenAI 正在 ChatGPT 中构建年龄预测与家长控制功能,为青少年提供更安全、适龄的使用体验。新工具同时面向家庭,帮助家长更好地支持孩子的使用。
OpenAI 阐述了其在 AI 使用中平衡青少年安全、自由与隐私的做法。
Hugging Face 发布 LeRobotDataset v3.0,将多个 episode 打包进单个文件,用关系型元数据在 episode 级别检索信息,解决 v2 单文件单 episode 在百万级数据集上的文件系统瓶颈。
OpenAI 宣布升级 Codex,使其更快、更可靠,并增强实时协作与独立处理任务的能力。升级后的 Codex 可在终端、IDE、网页乃至手机上使用。
推荐理由:官方给出 Codex 在速度、可靠性与实时协作上的升级方向,读者可据此判断多端编码工作流的变化。
OpenAI 基于迄今规模最大的 ChatGPT 使用研究,展示了该工具如何在个人与职业场景中创造经济价值。研究显示,ChatGPT 的采用正从早期用户向更广泛人群扩展,逐步缩小使用差距,并成为日常生活的一部分。
Hugging Face 在 Gradio 中推出可见水印功能,只需一条命令即可为 AI 生成的图像、视频和文本添加水印。图像和视频通过 watermark 参数指定水印文件,文本则在 Chatbot 组件中设置 watermark,用户复制 AI 回复时会自动附带署名。水印支持文件名、图像或 numpy 数组,还可使用 QR 水印。
OpenAI 发布 GPT-5 系统卡增补,公开新模型 GPT-5-Codex,这是 GPT-5 针对 Codex 中智能体编码进一步优化的版本。GPT-5-Codex 会根据任务复杂度更动态地调整思考投入,对简单对话查询或小任务快速响应,对更复杂任务则独立工作更长时间。
推荐理由:GPT-5 系统卡增补披露了面向 Codex 智能体编码优化的新模型,读者可了解其动态调整思考投入的机制。
OpenAI 公布了与美国 CAISI 及英国 AISI 合作推进 AI 安全与安保的进展。该合作旨在强化 AI 系统的安全性与防护能力。
WRITER 发布 Palmyra-mini 系列三款开源模型,参数规模 1.5B 至 1.7B,包括非思考基础版 palmyra-mini 及两个推理变体 palmyra-mini-thinking-a 和 palmyra-mini-thinking-b。
OpenAI 与 Microsoft 签署一份新的 MOU,强化双方合作伙伴关系,并重申在 AI 安全与创新方面的共同承诺。
OpenAI 发布关于其非营利组织与 PBC 的声明,确认非营利领导地位,并采用新结构使其 PBC 股权纳入其中。该安排将带来超过 1000 亿美元的资源,用于推进安全、有益于人类的 AI。
推荐理由:OpenAI 官方说明非营利与 PBC 的新治理结构,读者可据此了解其资源规模与组织安排。
Hugging Face 博客介绍了为支持 OpenAI gpt-oss 系列而在 transformers 中做的一系列升级,包括可从 Hub 下载的零构建 Kernel、MXFP4 量化、张量并行、专家并行、动态滑动窗口缓存、连续批处理与 Paged Attention,以及更快的模型加载。
Together AI 与 Hugging Face 联合推出新能力,Hub 上任意兼容的 LLM 均可通过 Together AI 基础设施微调,支持公开和私有仓库,训练完成后可自动回传 Hub。该功能覆盖 100B 参数以下的所有 CausalLM 模型,用户只需几行 API 调用即可完成微调,无需自建训练基础设施。
Hugging Face 发布 Jupyter Agent 项目,通过清洗约 2TB Kaggle notebook 构建 51k 合成 notebook、近 0.2B token 的数据集,并用 TRL 全参数微调 Qwen3-4B。
推荐理由:完整披露了从 Kaggle notebook 清洗到 SFT 的数据管线与消融结果,可迁移到其他小模型智能体训练。
SafetyKit 借助 OpenAI GPT-5 扩展风险智能体,用于内容审核与合规执行,在准确性上超越传统安全系统。该方案依托 OpenAI 目前能力最强的模型,提升风险识别与处置的规模化能力。
Mistral AI 宣布完成 1.7B€ 的 C 轮融资,投后估值 11.7B€。本轮由半导体设备制造商 ASML 领投,现有投资方 DST Global、Andreessen Horowitz、Bpifrance、General Catalyst、Index Ventures、Lightspeed 和 NVIDIA 参投。
推荐理由:Mistral AI 完成 1.7B€ C 轮融资,由 ASML 领投,读者可了解其估值与半导体产业链合作方向。
Hugging Face 发布 mmBERT,一个基于 ModernBERT 架构的多语言编码器模型,在超 3T token、1800 多种语言上训练,是首个在性能上超越 XLM-R 的多语言模型。base 版含 110M 非嵌入参数(总计 307M),采用三阶段训练与逆掩码率调度(30%→15%→5%),在 GLUE 和 XTREME 基准上显著领先 XLM-R 与 mGTE。
OpenAI 的 People-First AI Fund 现已开放申请,这是一项 5000 万美元计划,用于支持推动教育、社区创新和经济机会的美国非营利组织。申请截止日期为 2025 年 10 月 8 日,资助形式为不限定用途的拨款,帮助社区塑造服务公共利益的 AI。
OpenAI 新研究解释了语言模型产生幻觉的原因,并指出改进评估方法可以提升 AI 的可靠性、诚实性与安全性。
OpenAI 与希腊政府联合启动“OpenAI for Greece”,把 ChatGPT Edu 引入中学,支持负责任的 AI 学习。该合作旨在提升 AI 素养、扶持本地初创企业并推动国家经济增长。
OpenAI 宣布推出 Jobs Platform 和新的 Certifications,用于把劳动者与岗位、培训和认证连接起来。官方称此举意在扩大经济机会,让 AI 技能更易获得。
Google 发布 EmbeddingGemma,一款面向端侧场景的多语言文本嵌入模型,参数量 308M,上下文窗口 2K,支持超过 100 种语言。该模型基于 Gemma3 骨干改为双向注意力,输出 768 维向量并支持 MRL 截断到 512、256 或 128 维,量化后内存占用低于 200MB。
推荐理由:原文给出 308M 参数、2K 上下文和量化后 200MB 内存等规格,读者可据此判断端侧 RAG 的落地边界。
SandboxAQ 将其 Structurally Augmented IC50 Repository(SAIR)数据集上线 Hugging Face,以 CC BY 4.0 许可免费开放,包含 5.24 million 个 AI 生成的蛋白质-配体 3D 复合物结构,每个结构均配 ChEMBL 或 BindingDB 的实验 IC₅₀ 数据。
Mistral AI 为 Le Chat 上线 Memories(beta),可自动保存有用信息,但回忆过程始终可见并附来源链接。用户可随时关闭记忆、开启不使用记忆的隐身对话、编辑或删除单条记忆,并支持导出与导入。同步推出 Memory Insights,用轻量提示帮用户查看 Le Chat 记住了什么。
OpenAI 收购 Statsig,Vijaye Raji 将出任应用业务 CTO,向应用业务 CEO Fidji Simo 汇报。
OpenAI 宣布与专家合作,为 ChatGPT 青少年用户强化保护措施并引入家长控制功能,同时将敏感对话路由至推理模型处理。
Mistral 在 Le Chat 中发布 20 多个基于 MCP 的安全连接器(beta),覆盖数据、生产力、开发、自动化与支付等类别,可连接 Databricks、Snowflake、GitHub、Atlassian、Asana、Outlook、Box、Stripe、Zapier 等工具,并支持添加自定义 MCP 连接器。
推荐理由:官方给出连接器目录、自定义 MCP 接入与 Memories 的边界,可据此判断企业工作流能落到哪些工具上。
Hugging Face 为 ZeroGPU Spaces 引入 PyTorch 提前(AoT)编译,让模型只需优化一次即可即时重载,在 Flux、Wan、LTX 等模型上取得 1.3×–1.8× 加速。
伯克利 AI 研究团队提出首个可定量预测 word2vec 学习过程的理论,证明在实际训练条件下该问题可化简为无权重最小二乘矩阵分解,梯度流动力学有闭式解,最终学到的表示等价于对目标矩阵 M* 做 PCA。从小初始化训练时,word2vec 按离散步骤依次学习正交线性子空间,每步提升嵌入矩阵的秩并降低损失,这些特征即 M* 的顶部特征向量,可由语料统计和超参数预先算出。
OpenAI 发布更先进的语音到语音模型 gpt-realtime,并同步更新 Realtime API。新 API 能力包括 MCP server 支持、图像输入以及 SIP 电话呼叫支持。
推荐理由:OpenAI 发布新一代语音到语音模型并扩展 Realtime API,读者可了解语音智能体接入工具与电话通道的能力边界。
OpenAI 推出 5000 万美元的 People-First AI Fund,帮助美国非营利组织用 AI 扩大影响力。资助覆盖教育、医疗、研究等领域,申请期为 2025 年 9 月 8 日至 10 月 8 日。
OpenAI 面向全球 1000 多人调查了 AI 应如何行事,并将其观点与自家 Model Spec 进行对比。这项被称为集体对齐(collective alignment)的工作,旨在让 AI 默认行为更好地反映多元的人类价值观与视角。