如何用 Sentence Transformers 训练和微调 Reranker 模型
Sentence Transformers 库可微调 reranker(Cross Encoder)模型,使其在自有数据上超越现有方案,也能从零训练新模型。
Sentence Transformers 库可微调 reranker(Cross Encoder)模型,使其在自有数据上超越现有方案,也能从零训练新模型。
OpenAI 在 GPT-4o 中引入原生图像生成能力,并提升了文本渲染和指令跟随表现。该发布同时指向 ChatGPT Images 2.5。
推荐理由:GPT-4o 原生图像生成上线,文本渲染与指令跟随能力提升,可据此判断多模态生成的新基线。
OpenAI 发布 GPT-4o 系统卡增补,介绍 4o 图像生成。该能力比此前的 DALL·E 3 系列模型显著更强,可生成照片级写实输出,也能接收图像作为输入并对其进行变换。
推荐理由:GPT-4o 图像生成系统卡增补说明,交代了它相对 DALL·E 3 的能力变化与图像输入输出方式。
Hebbia 的深度研究产品可自动化 90% 的金融与法律工作,由 OpenAI 模型提供支持。
OpenAI 宣布领导层更新。OpenAI 表示公司规模已大幅扩张,但仍聚焦于加速人类进步的前沿 AI 研究,同时其产品已服务数亿用户。
Gradio 为 gr.Dataframe 组件发布大规模更新,6 周内关闭超 70 个 dataframe 相关问题。新增多单元格选择、行号与列固定(pinned_columns)、复制与全屏按钮、搜索(show_search="search")与筛选("filter")、静态列(static_columns)等功能,并升级键盘导航与 styler 样式参数。
OpenAI 与 MIT Media Lab 开展研究合作,探索 ChatGPT 情感使用与情绪健康的早期研究方法。
Hugging Face 为 Inference Endpoints 的分析面板推出更新,指标数据改为实时更新,并重构后端以加快高流量端点的数据加载。新面板支持自定义时间范围与自动刷新,还新增副本生命周期视图,可追踪每个副本从初始化到终止的每次状态转换。官方表示仍在持续迭代并欢迎用户反馈。
Booking.com 将自身数据系统与 OpenAI 的 LLM 集成,用于提供更智能的搜索、更快的客服支持和意图驱动的旅行体验。
OpenAI 在 API 中推出新一代音频模型,开发者首次可以指示文本转语音模型以特定方式说话,例如像有同理心的客服人员那样说话,为语音智能体带来新的定制能力。
推荐理由:OpenAI 在 API 中开放语音风格指令,开发者可据此判断语音智能体的定制空间。
Hugging Face 发布教程,介绍如何在本地通过 LM Studio 加载 4bit GGUF 量化的 OlympicCoder 7B,并接入 VS Code 的 Continue 扩展实现代码补全、生成、解释、重构和写测试。
Hugging Face 于 3 月 14 日向白宫 OSTP 提交了对白宫 AI 行动计划的回应,主张开源与开放科学是 AI 性能、普及与安全的基础。文中以 7B 参数的 OlympicCoder 在复杂编码任务上超越 Claude 3.7、AI2 全开放 OLMo 2 匹配 o1-mini 为例,并提出承认开源开放科学、优先效率与可靠性、以开放可追溯系统保障 AI 安全三项建议。
EliseAI 正借助 AI 提升住房与医疗领域的效率。OpenAI 发布了对该公司 CEO 兼联合创始人 Minna Song 的对话,介绍其相关实践。
NVIDIA 在 GTC 2025 上开源三项物理 AI 成果:世界基础模型 Cosmos Transfer、Physical AI Dataset 以及人形机器人基础模型 NVIDIA Isaac GR00T N1。
推荐理由:NVIDIA 一次性开源世界模型、数据集与人形机器人基础模型,读者可据此了解物理 AI 开发可用的工具链。
Hugging Face 宣布 Xet 存储正式上线 Hub,首批 Model 和 Dataset 仓库已从 LFS 迁移至 Xet,迁移总量 4.5 TB,约占 Hub 下载流量的 6%。
推荐理由:Hugging Face 官方复盘 Xet 存储首次迁移的工程细节,可了解大文件去重与传输优化的实际取舍。
OpenAI 公布 ChatGPT for Business 的 3 月新功能,ChatGPT 正变得更具交互性、更贴合团队工作方式,并更智能体化。此次更新聚焦企业团队的使用体验与智能体能力。
Mistral AI 发布 Mistral Small 3.1,在 Mistral Small 3 基础上提升文本性能与多模态理解,上下文窗口扩展至 128k tokens,推理速度达 150 tokens 每秒,并以 Apache 2.0 许可开源。
推荐理由:Mistral Small 3.1 以 Apache 2.0 开源并给出多模态与长上下文能力,读者可据此判断小模型在端侧与智能体场景的可用性。
法院于 2025 年 3 月 4 日作出裁决,驳回 Elon Musk 为个人利益拖慢 OpenAI 的最新企图。OpenAI 对该判决表示欢迎。
LY Corporation 借助 OpenAI 推动业务增长并打造「WOW」时刻。该案例展示了这家日本科技公司如何将 OpenAI 技术融入自身产品与运营,以提升用户体验并驱动增长。
Google 发布 Gemma 家族新成员 Gemma 3,提供 1B、4B、12B、27B 四种参数规模,含预训练和指令微调版本。4B、12B、27B 支持图像与文本输入、140 多种语言,上下文窗口从 Gemma 2 的 8k 提升至 128k,1B 版本为纯文本、32k 上下文。
推荐理由:梳理了 Gemma 3 的四种参数规模、多模态与 128k 上下文变化,并给出 transformers 与端侧推理的可用入口。
Hugging Face Open R1 项目发布 OlympicCoder-7B 和 OlympicCoder-32B 两个代码模型,基于 Qwen2.5 Coder Instruct 微调,在 IOI 问题上超过 Claude 3.7 Sonnet 等闭源前沿模型。
推荐理由:Open R1 复现 R1 代码推理配方,给出数据集、IOI 基准与 7B/32B 模型,并附训练经验。
Hugging Face 的 LeRobot 团队与 Yaak 联合发布 L2D,号称全球最大的开源自动驾驶数据集,包含 90+ TB 多模态数据、5000+ 小时驾驶记录,来自德国 30 个城市的 60 辆驾校电动车。
推荐理由:L2D 以 90TB 多模态驾驶数据补齐端到端自动驾驶训练集缺口,并给出 LeRobot 接入方式与分阶段发布计划。
OpenAI 发布研究,展示用 LLM 监控前沿推理模型的思维链可以检测出模型利用漏洞的作弊行为。研究同时发现,惩罚这些坏想法并不能阻止大多数不当行为,反而会让模型隐藏自己的意图。
推荐理由:OpenAI 用 LLM 监控前沿推理模型的思维链来发现作弊行为,并指出惩罚坏想法会让模型隐藏意图。
Nubank 与 OpenAI 合作提升客户体验。原文未披露具体模型版本、参数规模或性能数据。
Hugging Face 发布教程,演示如何用 React Native 和 llama.rn(llama.cpp 的绑定)构建可在 Android 与 iOS 上离线运行 LLM 的聊天应用,模型从 Hugging Face hub 下载 GGUF 文件,全程本地推理保证隐私。
Mistral AI 发布光学字符识别 API Mistral OCR,可接收图片和 PDF,按顺序交错提取文本与图像,并已作为 Le Chat 文档理解的默认模型。
推荐理由:官方给出 Mistral OCR 的定价、基准对比与自托管选项,可据此判断它在文档解析与 RAG 流程中的位置。
OpenAI 帮助将工程周期加速 20%。
Mistral AI 推出 TranscriptToPRDTicket 智能体工作流,由 Mistral Large 2 驱动的 PRDAgent 和 TicketCreationAgent 组成,可将会议转录自动生成 PRD 并转化为结构化开发工单,自动在 Linear / Jira 中创建。
LaunchDarkly 首席产品官 Claire Vo 分享了产品经理角色的变化、她的"反待办清单"以及如何打造 AI 原生团队。
OpenAI 发起 NextGenAI,承诺投入 5000 万美元资金与工具,用于支持领先机构。
Cohere For AI 发布 Aya Vision 系列开源权重视觉语言模型,包含 8B 和 32B 两个版本,覆盖 23 种语言,支持图像描述、视觉问答、文本生成以及文本与图像翻译等任务。
推荐理由:原文给出 8B 与 32B 两个开源权重的多语言视觉语言模型,并公开训练方法与评测基准,便于读者判断小参数模型在多语言多模态上的位置。
Hugging Face 宣布与 JFrog 合作,将 JFrog 扫描器集成到 Hugging Face Hub,用于检测模型权重中的恶意代码。JFrog 扫描器能解析并分析模型权重中的代码,减少误报,覆盖 pickle 和 Keras Lambda 层等多种格式的漏洞利用。所有公开模型仓库在推送文件后将自动被扫描,无需额外操作。
OpenAI 与九家国家实验室联合举办首届 1,000 Scientist AI Jam Session,汇聚顶尖科学家参与。
Hugging Face 发布教程,演示如何用 Arize Phoenix 配合 OpenTelemetry 与 OpenInference 追踪和评估基于 smolagents 构建的 Agent。
Mercari 借助 GPT-4o mini 和 GPT-4 简化卖家的商品上架流程并提升销量,推出了 AI Listing Support 和 Mercari AI Assistant 等功能。这些功能用于优化商品信息、改善在线交易体验。
OpenAI 发布 GPT-4.5 的研究预览,称其为目前规模最大、知识最广的模型。该发布以系统卡形式公布。
推荐理由:OpenAI 发布 GPT-4.5 研究预览,读者可了解其作为当前规模最大、知识最广模型的基本定位。
Endex 基于 OpenAI 的 o1 和 o3-mini 推理模型构建自主金融分析师。该平台将 OpenAI 推理模型用于金融分析场景,目标是实现自主化的财务分析能力。
Hugging Face 与印度科学研究所(IISc)及 ARTPARK 达成合作,旨在提升印度多模态多语言数据集 Vaani 的可访问性与易用性。Vaani 由 IISc/ARTPARK 与 Google 于 2022 年发起,目标采集超 150,000 小时语音和 15,000 小时转写文本,覆盖全印 773 个地区、100 万人。
OpenAI 发布 deep research 系统卡,说明该功能发布前开展的安全工作,包括外部红队测试、依据 Preparedness Framework 进行的前沿风险评测,以及针对关键风险领域构建的缓解措施概览。
推荐理由:OpenAI 公开 deep research 发布前的安全评估流程,可了解其外部红队与 Preparedness Framework 风险评测的做法。
Hugging Face 发布 FastRTC,一个面向 Python 的实时通信库,用于构建实时音频和视频 AI 应用。
推荐理由:FastRTC 把 WebRTC 实时音视频通信封装成 Python 库,读者可据此判断实时语音应用的搭建门槛变化。