Legora 用 GPT-6 Astra 数分钟审阅 41 份文档
Legora 借助 GPT-6 Astra 在数分钟内完成 41 份文档的审阅,找出了全部四处预设错误,并在该财务审阅工作流中把表现提升近 40%。
Legora 借助 GPT-6 Astra 在数分钟内完成 41 份文档的审阅,找出了全部四处预设错误,并在该财务审阅工作流中把表现提升近 40%。
Hugging Face 发布 funes,一个面向 Claude Code、Codex、pi 和 Hermes 的持久记忆层,从本机已有会话构建索引,一条命令即可接入。
推荐理由:Hugging Face 官方发布的本地记忆层,给出安装命令与检索管线细节,可判断跨 Agent 记忆的落地方式。
Google 推出 Fairwind Program,面向政府机构、关键基础设施运营商和网络安全合作伙伴限量开放其最先进的网络防御能力,首批提供 Gemini 3.8 Flash Cyber 模型与 CodeMender 工具链,用于自主发现、验证并修复漏洞。
推荐理由:Google 把 Gemini 3.8 Flash Cyber 与 CodeMender 组合成受限访问项目,读者可了解前沿模型在漏洞修复上的落地方式与准入条件。
ATV Big Air Tour 使用 ChatGPT Work 加速营销与周边商品业务,将原本 3 天的工作缩短到 3 小时,并在 15 分钟内把商品照片变成库存网站。
Google DeepMind 在 Gemini 3.7 Flash、3.6 Flash 和 3.5 Flash-Lite 上推出智能体视频理解功能,官方称视频分析 token 消耗最多降低 88%、成本最多降低 66%、质量最多提升 7%。
推荐理由:官方给出 token 与成本降幅及准确率变化,并说明在长视频场景下与静态处理的取舍差异。
OpenAI 宣布医疗机构现在可以把 EHR 及其他行业数据接入 ChatGPT,让临床医生安全访问患者上下文、医学研究等信息。原文未披露具体接入方式、可用范围与上线时间。
推荐理由:官方给出 ChatGPT 接入医疗数据的入口,读者可据此判断临床场景中数据接入方式的变化。
澳大利亚律所 Gilbert + Tobin 通过 CEO 主导的投入、严格治理与人工问责机制,在全所范围规模化部署 ChatGPT Enterprise 和 Codex。
Hugging Face 发布 @huggingface/kernels,一个从 Hugging Face Hub 加载并运行优化 WebGPU kernel 的 JavaScript 库,同时上线 207 个 kernel 的初始集合,均以 Apache-2.0 许可发布为独立仓库。
推荐理由:Hugging Face 发布 207 个 WebGPU kernel 及配套加载库与浏览器基准工具,并给出与 ORT WebGPU 的实测对比数据。
Hugging Face 在 Gradio 中推出 gr.Workflow,把多步 AI 流水线描述为带类型的节点图,并直接提供可拖拽画布,每个节点可运行、中间结果可见。
推荐理由:原文给出 gr.Workflow 的节点图、REST 端点和一键部署路径,读者可据此判断多步 AI 流水线如何落地。
Liquid AI 为 LFM2.5 家族的三款模型 LFM2.5-1.2B-Instruct、LFM2.5-2.6B 和 LFM2.5-8B-A1B 发布 DSpark 草稿模型检查点,通过投机解码在不改变输出质量的前提下提升解码速度,GPU 上吞吐最高提升 3.18 倍,端侧最高 2.87 倍。
推荐理由:官方给出三款 LFM2.5 草稿模型的加速数据与 llama.cpp、SGLang 接入方式,可据此评估端侧推理提速的落地成本。
Mistral 发布 Agentic Search,一个让模型在多步检索循环中查找、打开、导航、阅读和验证信息的检索层,通过 Mistral Search Toolkit 提供,并内置于 Studio 和 Vibe 的 Libraries。
推荐理由:原文给出多步检索循环在 FinanceBench 与 OfficeQA Pro 上的准确率、token 与延迟变化,可据此判断它相对一次性 RAG 的取舍。
Replit 推出 Free Mode,由 GPT-5.6 Luna 驱动,让任何人都能把想法变成可运行的软件,无需担心 token 成本。
推荐理由:Replit 推出由 GPT-5.6 Luna 驱动的免费模式,读者可了解软件创建门槛与 token 成本的变化。
Sentence Transformers v6.0 新增第四种模型类型 MultiVectorEncoder,用于 ColBERT 式晚交互检索,PyLate 与 Stanford-NLP ColBERT 检查点可直接加载,colpali-engine 的视觉文档检索模型也可通过同一 API 使用。
推荐理由:Sentence Transformers v6.0 新增多向量编码器,读者可据此判断晚交互检索的接入方式与索引成本。
OpenAI 预览新的 API 服务档 Ultrafast,运行 GPT-5.6 Sol 时最高提速 14 倍。该服务由 Cerebras 提供支持,输出速度最高可达每秒 750 个 token。
Hugging Face 的 OlmoEarth Studio 现已支持计算并导出嵌入向量,用户可通过 UI 或 API 选择区域、时间范围、编码器变体和分辨率,获得 Cloud-Optimized GeoTIFF(COG)输出。
RingCentral 借助 ChatGPT Work 和 Codex 加速 AI 产品开发,并在工程与运营之间集中化运营智能。该实践覆盖从工程到运营的 AI 原生工作流程建设。
Mistral 宣布三项推进 AI 主权的举措:Mistral Regional Endpoints 正式可用,客户可选择推理在欧洲或美国运行;Mistral Priority Tier 进入公开预览,为关键业务负载提供自定义速率限制和带 SLA 的正常运行时间承诺。
推荐理由:Mistral 把区域推理、优先服务层级和第三方开源模型接入放进同一套基础设施,读者可据此判断主权 AI 的落地方式。
NVIDIA 发布 Magpie TTS Multilingual,一个 364M 参数的开源权重语音合成模型,支持 12 种语言,新增现代标准阿拉伯语、韩语和巴西葡萄牙语,并通过更新训练数据提升了多种既有语言的质量。
推荐理由:原文给出 364M 开源权重模型的多语言扩展与 TTFA 实测数据,读者可据此判断自建语音链路的延迟与部署成本。
Model ML 借助 GPT-5.6 Sol 将金融工作从研究与分析一路推进到可编辑、可追溯的 PowerPoint 演示文稿和 Excel 工作簿。
ChatGPT Business 新增 Premium 席位,用量提升至 5 倍,且取消五小时使用上限。该席位提供灵活的席位选项,供团队中每位成员按需选用。
Zapier 企业营销团队使用 ChatGPT Work 减少线索漏斗流失、构建营销活动素材并自动化报告。原文未披露具体模型版本、效率倍数或价格等细节。
Virgin Atlantic 正借助 ChatGPT Work 加速研究、产品规划与决策,帮助团队打通客户旅程中的各类信号。
HSP GRUPPE 借助 ChatGPT Enterprise 提升生产力、改善工作质量,并为税务咨询与客户服务释放更多产能。该案例展示了这家税务咨询机构如何围绕 ChatGPT Enterprise 构建自身的 AI 能力。
Baseten 正式加入 Hugging Face Hub 的 Inference Providers 生态,首批支持对话与文本生成任务,可调用 Kimi K3、DeepSeek V4 Flash、GLM-5.2 等热门开源权重 LLM。
OpenAI 为 ChatGPT Work 和 Codex 推出全新教育插件,面向 K–12 教师、高校教育者与学生,用于学习、教学、研究和构建。
微软研究院发布开源框架 Orchard,核心是 Orchard Env 这一可复用的 Kubernetes 环境服务,支持软件工程、网页导航和个人助理等任务,并可直接在 Codex、OpenClaw、ZeroClaw 等真实部署 harness 中训练智能体。
推荐理由:微软研究院开源 Orchard 框架,公开环境服务、训练流程与数据,读者可据此了解小模型在真实 harness 中训练智能体的路径。
OpenAI 披露其 GPT-Live 实时语音系统的构建过程,该系统采用无轮次(turnless)语音模型与低延迟架构,实现与 AI 的连续语音交互,让对话更快、更自然。
Circles 使用 OpenAI API 和 Codex 打造 AI 原生电信体验,使 ARPU 提升 22%、用户流失率降低 9%,并提升开发效率。
Univé 借助 ChatGPT Enterprise 打造 AI 就绪的员工队伍,做法是结合领导层推动、负责任的治理与员工主导的创新,从而规模化地改变工作方式。
avatarin 基于 OpenAI 的 GPT-Realtime 为山田电机(Yamada Denki)顾客提供 24/7 多语言支持。上线两周内,该智能体被 30,000 人使用,92% 的问卷反馈为正面评价。
OpenAI 宣布向 10 万名学术研究者免费开放 ChatGPT 最先进的 AI 模型,用于加速科学研究、协作与发现。
推荐理由:OpenAI 向学术研究者免费开放 ChatGPT 高级模型,读者可了解其覆盖规模与面向科研的定位。
OpenAI 在 ChatGPT 中推出 Health 功能,符合条件的美国用户可安全连接医疗记录和 Apple Health,获得更个性化的健康洞察并更好地理解自身健康状况。
推荐理由:OpenAI 把医疗记录与 Apple Health 接入 ChatGPT,读者可据此判断个人健康数据会怎样进入对话式助手。
Hugging Face 在 Diffusers 中引入 Nunchaku Lite,可直接用 from_pretrained() 加载 Nunchaku 风格的 4-bit 量化 checkpoint,无需自定义 pipeline 或本地 CUDA 编译。
推荐理由:原文给出 Nunchaku Lite 在 Diffusers 中的加载方式与实测延迟、显存数据,可据此判断消费级 GPU 跑扩散模型的实际门槛。
OpenAI 推出 OpenAI Presence,一个经过验证的企业 AI 智能体平台,帮助组织为客户及内部工作流部署可信的语音和聊天智能体。
NTT DATA Group 借助 ChatGPT Enterprise 和 Codex 推动 9000 名员工实现工作自动化,将事件分析时间缩短至 30 分钟。该集团同时借此扩展安全的 AI 应用落地。
OpenAI 推出 ChatGPT for Small Businesses 计划,帮助创业者建立 AI 技能、自动化工作,并借助 ChatGPT Work 实现增长。
Hugging Face 发布 Grabette,一套开源低成本的手持夹爪数据采集系统,无需机器人即可录制操作演示并自动转为 LeRobot 格式数据集。Grabette 配备广角鱼眼相机和 RGBD 相机,BOM 成本约 490€,配套的机器人端夹爪 Gripette 成本约 120€。
推荐理由:原文给出了一套无需机器人即可采集操作数据的开源硬件与处理流程,读者可据此判断数据采集门槛的变化。
OpenAI 创意团队借助 Codex 构建定制创意工具,用于加速创意构思并更快完成原型开发。Codex 具备上下文感知能力,成为该团队的协作伙伴。
Cars24 借助 OpenAI 的语音与聊天智能体,每月处理超 100 万分钟对话,并挽回 12% 的流失线索。该公司还将智能体工作流推广到全公司各团队。
Google DeepMind 在印度启动 ATL Saathi 试点,这是一款由 Gemini 驱动的 Web 应用,为 Atal Tinkering Labs 教育者提供 24/7 备课与培训助手。该工具基于 NotebookLM 整理 12 个核心模块内容,支持 10 个模块的项目生成,初期覆盖 8 种语言,底层采用 Gemini 3.5 Flash 模型。首批试点覆盖印度 100 所学校。