OpenAI 通过网络安全资助计划赋能防御者
OpenAI 公布网络安全资助计划,重点展示网络安全领域的创新研究与 AI 集成。
OpenAI 公布网络安全资助计划,重点展示网络安全领域的创新研究与 AI 集成。
Hugging Face 与 Argilla 合作的 Data Is Better Together 计划已产出 DIBT/10k_prompts_ranked 数据集,由 385 多人参与完成 1 万条合成与人工提示词的质量排序,并被用于训练 SPIN 等新模型。
OpenAI 提出一套构建稳健自然语言分类系统的整体性方法,用于真实场景下的内容审核与不良内容检测。该方法强调从整体视角应对真实世界内容审核需求。
OpenAI 提出 Consistency Models,可在不依赖迭代采样过程的情况下实现快速生成。扩散模型虽推动了图像、音频和视频生成的发展,但其迭代采样过程导致生成速度缓慢。
OpenAI 提出改进的一致性模型(Consistency Models)训练技术。一致性模型是一类新兴生成模型,无需对抗训练即可一步采样出高质量数据。
Prezi 加入 Hugging Face Expert Support Program,将更小更高效的开源模型整合进其 ML 工作流。其旗舰产品 Prezi AI 结合视觉模型、文本模型和 VLM 生成演示文稿,专家建议在检索流程中加入开源 re-ranker 模型,比 LLM 更便宜、更快、更好地匹配图文素材。
Paf 在全公司采用 ChatGPT Enterprise,工程师每天用自定义 GPT 加速日常开发任务,70% 员工活跃使用,覆盖财务、HR、营销和客服等业务团队。Paf 还将 ChatGPT Enterprise 接入 grit:lab 编程学院,让学员从第一天起就以 AI 增强的系统架构思维学习。
Hugging Face 发布 BigCodeBench,包含 1,140 个函数级任务,要求 LLM 调用 139 个库中的多个函数作为工具,每个任务平均含 5.6 个测试用例、分支覆盖率 99%。
Color Health 与 OpenAI 合作推出 Cancer Copilot,利用 GPT-4o 识别缺失的诊断项目并生成个性化检查方案,帮助医疗人员就癌症筛查和治疗做出循证决策,从而加速癌症患者获得治疗。
OpenAI 任命退役美国陆军上将 Paul M. Nakasone 加入董事会,他将同时进入董事会的安全与安保委员会。Nakasone 为这一持续扩大的董事会带来网络安全领域的经验。
Hugging Face Accelerate 在 0.30.0 版本中为 FSDP 加入自动 upcasting,使其在混合精度下与 DeepSpeed 行为对齐。
Stability AI 的 Stable Diffusion 3 Medium(2B 参数)已在 Hugging Face Hub 发布并接入 Diffusers。
推荐理由:原文给出 SD3 Medium 的架构变化与 Diffusers 集成细节,读者可据此判断显存占用与推理速度的取舍。
Hugging Face 在 TRL 中推出 RLOO(REINFORCE Leave One-Out)Trainer,作为 PPO 之外的在线 RLHF 训练算法。
OpenAI 与 Apple 宣布建立合作,将 ChatGPT 集成到 Apple 的各项体验中。
推荐理由:OpenAI 与 Apple 宣布合作,读者可据此了解 ChatGPT 进入 Apple 生态这一商业动作的基本事实。
OpenAI 宣布 Sarah Friar 出任首席财务官(CFO),Kevin Weil 出任首席产品官(CPO)。两人将加入 OpenAI 管理层,具体职责与到任时间未在文中披露。
OpenAI 进一步说明其文本转语音模型 Voice Engine 的技术原理与安全研究。该模型可根据文本生成语音,OpenAI 同时公布了围绕这一技术开展的安全研究工作。
Hugging Face 宣布将重新设计 Transformers 文档,以解决内容割裂、导航困难和过时的问题。新文档将面向构建 AI 产品的开发者,采用代码优先、解决方案导向的方式,并用灵活结构替代 Diátaxis 的刚性框架,让内容自然生长与整合。
Hugging Face Embedding Container for Amazon SageMaker 正式 GA,AWS 客户可在 SageMaker 上部署嵌入模型构建 RAG 等生成式 AI 应用。
Artificial Analysis 推出文生图排行榜与 Image Arena,基于超 45,000 次人类图像偏好投票计算 ELO 分数,覆盖 Midjourney、DALL·E、Stable Diffusion、Playground 等开源与闭源模型。
OpenAI 使用新的稀疏自编码器扩展技术,自动识别出 GPT-4 计算过程中的 1600 万个模式。
Mistral AI 在 la Plateforme 上线模型定制功能,提供三种微调入口:开源微调代码库 mistral-finetune、平台上的 serverless 微调服务,以及面向特定客户的定制训练服务。
推荐理由:Mistral 同时给出开源微调代码库与托管微调服务,读者可据此判断自建与托管两条路径的成本差异。
Mistral AI 于 2024 年 6 月 5 日至 30 日举办线上微调黑客松,参赛项目必须使用其全新微调 API。前三名各获 2500 欧元 Mistral API 额度,入选者可申请 100 美元免费额度,需在 6 月 10 日前提交表单。评审按影响力、技术实现、创意和展示各占 25% 打分,团队最多 4 人。
Hugging Face 发布 NPC-Playground,一个可在浏览器中与 LLM 驱动的 NPC 互动的 3D 演示,由 Cubzh 与 Gigax 联合打造。
Hugging Face 将 assisted generation(基于 Speculative Sampling 的加速解码方法)适配并优化到 Intel Gaudi,现已集成进 Optimum Habana。该方法用草稿模型生成 K 个 token 再由目标模型评估,对大 Transformer 模型通常可带来约 2x 加速,且采样质量与自回归采样相当。
OpenAI 封禁了一批与隐蔽影响力行动相关的账号,并称这些账号未因使用其服务获得显著受众增长。
OpenAI 推出面向大学的平价方案 OpenAI for Education,帮助高校负责任地将 AI 引入校园。该方案主打可负担的定价,具体功能与价格细节尚未在原文中披露。
OpenAI 推出面向非营利组织的 OpenAI for Nonprofits 计划,为这类机构提供 ChatGPT Team 和 Enterprise 的折扣价格,以提升其工具的可及性。
Mistral AI 发布首款代码模型 Codestral,这是一个 22B 开放权重生成式模型,训练数据覆盖 80+ 编程语言,上下文窗口 32k,可通过指令与补全 API 端点使用。
推荐理由:Mistral 首款代码模型给出 22B 开放权重、32k 上下文和 80+ 语言支持,可对照其与既有代码模型的定位差异。
MavenAGI 推出基于 GPT-4 的 AI 客服智能体,Tripadvisor、Clickup 和 Rho 等公司已在使用,以节省时间并更好地服务客户。
Mistral AI 发布非生产许可证 MNPL,允许开发者将技术用于非商业用途并支持研究工作,Codestral 于同日在该许可证下发布。Mistral 表示会继续以 Apache 2.0 发布模型和代码,并逐步整合 Apache 2.0 与 MNPL 两条产品线。该许可证要求基于其成果开展商业业务的开发者以公平可持续的方式与各方合作。
推荐理由:Mistral 推出非生产许可证,读者可据此理解开源模型商业授权收紧对开发者使用边界的影响。
The Atlantic 宣布与 OpenAI 达成内容与产品战略合作,成为 OpenAI 体系内的优质新闻来源。The Atlantic 的文章将可在 ChatGPT 等 OpenAI 产品中被发现,作为合作方,The Atlantic 还将参与塑造未来实时发现产品中新闻的呈现方式。
OpenAI 与 Vox Media 达成一项多层面协议,Vox Media 的内容将用于增强 ChatGPT 的输出。Vox Media 还将基于 OpenAI 的技术开发产品,以更好地服务其受众和广告主。
Hugging Face 发布博客介绍 Text Generation Inference(TGI)配套的 TGI Benchmarking 工具,可在 Hugging Face Space 中部署模型并通过 CLI 运行,同时测量吞吐量与延迟。该工具提供 pre-fill 统计与直方图、吞吐量对延迟散点图,并按 batch size 展示结果,帮助用户在 TTFT 与吞吐之间权衡调优部署。
Hugging Face 发布博客,介绍如何用 Python 库 Sentence Transformers 微调嵌入模型以提升特定任务表现,也可从零训练新模型。
TII 发布 Falcon 2 系列首批模型,包括 11B 基座语言模型和 11B 视觉语言模型(VLM),后者在 LLM 基础上接入 CLIP ViT-L/14 视觉编码器,支持图像问答。
推荐理由:官方给出 Falcon 2 11B 的架构、训练数据与多语言评测,可对照同尺寸开源模型判断其定位。
Meta 发布 CyberSecEval 2,从代码不安全实践、提示词注入、网络攻击协助、代码解释器滥用和自动化攻击能力五个维度评测 LLM 的网络安全风险。相比 2023 年 12 月的首版,LLM 协助网络攻击的平均合规率从 52% 降至 28%。提示词注入仍是未解难题,代码解释器滥用风险突出,评测代码已全部开源。
OpenAI 与 News Corp 宣布建立多年全球合作伙伴关系,将把后者旗下优质新闻内容引入 OpenAI 的生成式 AI 产品与平台。
Hugging Face 宣布用户可从 Hub 直接部署模型到 AWS Inferentia2,覆盖超 10 万个公开模型,新增 albert、bert、roberta、vit 等 14 种模型架构和 text-classification、text-generation 等 6 类任务。
OpenAI 阐述了其安全实践的核心立场:通用人工智能有潜力惠及生活几乎方方面面,因此必须以负责任的方式开发和部署。
Hugging Face 宣布 AMD Instinct MI300 已在其平台实现一等公民级集成,transformers 和 text-generation-inference 无需改代码即可在 Azure ND MI300x V5 上运行。