Hugging Face 与 IISc 合作,推动印度多语言模型构建
Hugging Face 与印度科学研究所(IISc)及 ARTPARK 达成合作,旨在提升印度多模态多语言数据集 Vaani 的可访问性与易用性。Vaani 由 IISc/ARTPARK 与 Google 于 2022 年发起,目标采集超 150,000 小时语音和 15,000 小时转写文本,覆盖全印 773 个地区、100 万人。
Hugging Face 与印度科学研究所(IISc)及 ARTPARK 达成合作,旨在提升印度多模态多语言数据集 Vaani 的可访问性与易用性。Vaani 由 IISc/ARTPARK 与 Google 于 2022 年发起,目标采集超 150,000 小时语音和 15,000 小时转写文本,覆盖全印 773 个地区、100 万人。
OpenAI 发布 deep research 系统卡,说明该功能发布前开展的安全工作,包括外部红队测试、依据 Preparedness Framework 进行的前沿风险评测,以及针对关键风险领域构建的缓解措施概览。
推荐理由:OpenAI 公开 deep research 发布前的安全评估流程,可了解其外部红队与 Preparedness Framework 风险评测的做法。
OpenAI 与 Guardian Media Group 宣布达成内容合作,将 Guardian 的新闻内容引入 ChatGPT。
Fanatics Betting and Gaming 首席财务官 Andrea Ellis 分享了公司如何运用 AI 聚焦大局。这是一场围绕该博彩公司 AI 应用的对话。
Wayfair 首席技术官 Fiona Tan 分享了该公司如何用 AI 塑造零售业的未来。这是一场围绕 Wayfair 的 AI 实践的对话。
OpenAI 与 Schibsted Media Group 宣布达成内容合作,将 Guardian 的新闻与档案内容引入 ChatGPT。
OpenAI 在 Super Bowl 投放首支电视广告,旨在激发人们对 AI 的好奇心。广告传递 AI 能开启新可能、丰富生活并提升生产力的理念,类比此前各类工具对人类社会的推动。
OpenAI 宣布与加州州立大学(CSU)系统合作,将 ChatGPT 提供给 50 万名学生和教职员工,称这是迄今规模最大的一次 ChatGPT 部署。该合作旨在扩大 AI 在教育中的使用,并帮助美国培养具备 AI 能力的劳动力。
推荐理由:OpenAI 与加州州立大学系统合作,把 ChatGPT 铺进 50 万师生,是观察 AI 进校园规模的一个样本。
OpenAI 封禁了一批疑似来自柬埔寨的账号,这些账号利用 AI 翻译和生成恋爱、投资类诈骗对话,用于实施"杀猪盘"骗局。
OpenAI 封禁了一批利用 AI 生成文章、帖子和虚假互动来干预加纳 2024 年总统选举的账号。该行动被定性为隐蔽影响力操作。
OpenAI 封禁了一批疑似中国来源的账号,这些账号利用 AI 起草监控工具推销方案、分析文档并调试代码。
OpenAI 封禁了一批疑似来自柬埔寨的账号,这些账号利用 AI 翻译消息,用于虚假评论招聘诈骗,要求受害者支付费用。
OpenAI 封禁了一批与伊朗关联的账号,这些账号利用 AI 生成与 IUVM 和 STORM-2035 影响行动相关的文章及社交帖子。
OpenAI 封禁了一批疑似中国来源的账号,这些账号利用 AI 生成英文社交帖子和西班牙语文章,开展代号“Sponsored Discontent”的影响力行动。
OpenAI 封禁了一批可能与公开报道的朝鲜(DPRK)关联威胁行为者有关的账号,这些账号利用 AI 研究入侵工具、钓鱼、恶意软件及加密货币攻击目标。
OpenAI 封禁了一批可能被用于协助欺诈性就业计划的账号,该计划具有公开报道中朝鲜相关 IT 工作者活动的特征。
OpenAI 最新一代推理模型将供美国国家实验室的顶尖科学家使用,以推动科学突破。该合作旨在加强美国在 AI 领域的领导地位。
Hugging Face 发起 Open-R1 项目,计划系统重建 DeepSeek-R1 的数据与训练流程,补上官方未公开的数据集和训练代码。项目分三步:从 DeepSeek-R1 蒸馏高质量推理数据集复现 R1-Distill 模型,复现 R1-Zero 所用的纯强化学习流程并整理数学、推理、代码数据集,以及展示从基座模型经 SFT 到 RL 的多阶段训练。
推荐理由:Hugging Face 公开复现 DeepSeek-R1 的三步计划,读者可了解开源推理模型训练链路的缺口与补全路径。
德国全球媒体、服务与教育公司 Bertelsmann 将把 OpenAI 的技术整合到其全球多个品牌中。
OpenAI 宣布 Stargate 项目,原文仅给出项目名称,未披露投资规模、合作方或建设细节。
OpenAI 发布 Stargate Infrastructure 合作征集,面向数据中心基础设施领域的企业寻求合作。征集范围覆盖电力、土地、建设、设备等环节,目标是推进其 AGI 基础设施愿景。
OpenAI 宣布与 Axios 达成合作,进一步扩大其在新闻行业的合作版图。目前已有代表数百家新闻编辑室和内容品牌的出版商通过 OpenAI 的合作与资助计划采用 AI 工具,ChatGPT 用户也可获取来自领先可靠出版物的信息。
Adebayo Ogunlesi 加入 OpenAI 董事会。
OpenAI 发文解释其公司结构必须调整,以推进自身使命,方案是让非营利组织更强,并由营利性业务的成功来支持。
OpenAI 回应马斯克最新法律诉讼,称这是其不到一年内的第四次尝试。OpenAI 指出,2017 年马斯克不仅想要、而且实际创建了营利性实体作为 OpenAI 拟议的新架构。
OpenAI 与全球专业媒体平台 Future 宣布战略合作,将 Future 旗下 200 多个媒体品牌的内容带给 OpenAI 用户。
Morgan Stanley 正借助 AI 评估(AI evals)推动金融服务变革。该机构将 AI 评估用于塑造金融服务的未来,具体做法与成效未在文中展开。
Hugging Face 发布开源开发者指南,解读已正式生效的欧盟《人工智能法案》。该法案按风险分级监管,仅通用目的 AI(GPAI)模型被直接约束,训练算力超 10^25 FLOPs 的模型需按系统性风险处理。指南建议开发者提供模型卡、数据集卡、Gradio 水印及个人数据脱敏等工具以准备合规。
OpenAI 发布文章阐述如何结合人类与 AI 推进红队测试。红队测试通过模拟对抗性攻击来发现模型的安全漏洞与滥用风险,人类专家与 AI 的协作方式成为其探索方向。
Hugging Face 的 Xet 团队采用内容定义分块(CDC)将文件拆分为可变大小的块,仅传输和存储修改过的块,从而提升存储与迭代效率。在 CORD-19 数据集基准测试中,Xet 后端将平均下载时间从 51 分钟降至 19 分钟,上传从 47 分钟降至 24 分钟,存储占用从 8.9 GB 降至 3.52 GB。
Rox 宣布“all in”OpenAI,将商业经验与深厚的大语言模型专业能力同 OpenAI 的模型结合,目标是让每位销售都成为前 1% 的顶尖销售。
OpenAI 在法国开设了其在欧洲大陆的首个办公室。这是 OpenAI 在欧洲大陆的第一处办公据点,此前其欧洲布局仅覆盖英国等地。
OpenAI 与 Lenfest Institute 合作推出 AI Collaborative and Fellowship program,面向新闻行业探索 AI 应用。该项目旨在支持新闻机构与从业者使用 AI 工具,具体参与方式与资助细节尚未在原文中披露。
Hugging Face 宣布与 Protect AI 合作,将后者的 Guardian 扫描器集成进 Hub 的扫描套件,所有公开模型仓库在推送文件后会自动被扫描。Guardian 可检测 pickle 任意代码执行及 Keras Lambda 层等漏洞,前端也新增了扫描结果展示。目前已有超过 100 万个模型仓库、数亿个文件被扫描。
Hugging Face 委托 Trail of Bits 对 Gradio 5 完成独立安全审计,发现的全部安全风险已在 Gradio 5.0 发布前修复并通过验证。
AMD 发布基于 Zen5 架构的第五代服务器级 EPYC CPU(代号 Turin),最高 192 核 384 线程。
OpenAI 与 Hearst 达成内容合作,将 Hearst 旗下品牌精选的生活方式与本地新闻内容引入 OpenAI 产品。
非凡研究 6 月报告显示,全球 1500 家活跃 AI 公司中有 751 家位于中国,其中 103 家已在拓展海外市场。华为、腾讯、阿里聚焦云计算与 AI 基础设施,字节跳动七个月内推出 11 款海外应用,CapCut 月活超 3 亿、截至 2024 年 7 月累计移动端收入 1.25 亿美元。
OpenAI 宣布获得新融资,用于推进让通用人工智能(AGI)惠及全人类的使命,并扩大 AI 带来的收益。
OpenAI 封禁了一批伊朗来源的 STORM-2035 账号,这些账号利用 AI 生成美国和英国选举相关内容并发布到多个网站。