Condé Nast 如何用 Amazon Bedrock 构建多模态视频检索
Condé Nast 联合 AWS 生成式 AI 创新中心,基于 Amazon Bedrock 和 Amazon OpenSearch Service 构建多模态视频检索方案,并选用 TwelveLabs Marengo 嵌入模型联合编码画面、音频与转录文本。
Condé Nast 联合 AWS 生成式 AI 创新中心,基于 Amazon Bedrock 和 Amazon OpenSearch Service 构建多模态视频检索方案,并选用 TwelveLabs Marengo 嵌入模型联合编码画面、音频与转录文本。
Google Research 提出 Retrieve-for-Train 框架,用离线强化学习把奖励对齐的 fan-out 查询编译成监督信号,再蒸馏进一个 53.9M 参数的扩散检索器,实现推理时单次非自回归的查询 fan-out,无需测试时 CoT 推理 token。
Google DeepMind 联合 Kaggle 发布 FACTS Benchmark Suite,在原有 FACTS Grounding 基础上新增 Parametric、Search、Multimodal 三项基准,并将 Grounding 升级至 v2,共 3,513 个公开样本。
Tavily 分享了其构建 SOTA 深度研究智能体的经验,曾因第一版架构假设过时被迫推倒重建。其核心思路是简化编排逻辑、拥抱模型自主性,并借助 Tavily Advanced Search 在工具侧完成上下文工程,只返回最相关内容块以降低幻觉与延迟。团队还提出将工具输出蒸馏为反思、仅在生成最终结果时引入原始信息,以模拟人类研究方式。
Hugging Face 发布 Research Tracker MCP,让 AI 通过自然语言调用研究工具,自动完成论文、代码、模型与数据集的跨平台检索和交叉引用。
《华盛顿邮报》与 OpenAI 达成合作,将其新闻内容整合进 ChatGPT,为用户提供摘要、引语和原文报道的直接链接。
Mistral AI 与法新社(AFP)达成全球合作,其 AI 助手 Le Chat 将接入 AFP 新闻专线内容,让回答基于可靠、最新的信息。Le Chat 将利用 AFP 每日六种语言(法语、英语、西班牙语、葡萄牙语、德语、阿拉伯语)发布的 2300 条新闻专线,覆盖其全球 1700 名记者的报道。该集成将在未来几周内向所有 Le Chat 用户推出。
Mistral AI 为免费生成式 AI 工作助手 le Chat 推出多项 beta 功能:带引用的联网搜索、用于构思与就地编辑和导出的 Canvas、由新多模态模型 Pixtral Large 支持的文档与图像理解、由 Black Forest Labs Flux Pro 支持的图像生成,以及可复用提示词并分享给同事的智能体。
推荐理由:官方列出 le Chat 新增的联网搜索、Canvas、文档图像理解与智能体,并给出与主流助手的逐项对比。
OpenAI 发布 ChatGPT 搜索,可快速给出带相关网页来源链接的及时回答。
推荐理由:OpenAI 官方发布 ChatGPT 搜索,读者可了解其以网页来源链接支撑实时回答的定位。
Indeed 借助 OpenAI 为其全球最大求职网站提供情境化职位匹配,每月服务超 3.5 亿独立访客,连接逾 350 万雇主和超 3200 万个职位,平均每三秒就有一人通过 Indeed 获得录用。
OpenAI 正在测试 SearchGPT,这是新搜索功能的临时原型,可提供快速及时的答案并附上清晰相关的来源。
推荐理由:OpenAI 官方公布搜索功能原型 SearchGPT 的测试消息,可据此了解其搜索产品的方向。
作者用 Sentence Transformers 和 Gradio Blocks 搭建了一个歌单生成器,将歌词按段落切分后生成嵌入向量,再对文本提示词做语义搜索来匹配歌曲。
Hugging Face 展示了如何用 🤗 datasets 的 Image 特征类型结合 sentence_transformers 和 faiss,为图像数据集构建相似度搜索应用。
huggingface_hub 库新增 ModelSearchArguments 和 ModelFilter 类,让用户无需离开 IDE 即可通过 Python API 搜索 Hub 上的模型和数据集。
OpenAI 对 GPT-3 进行微调,使其能借助基于文本的网页浏览器更准确地回答开放式问题。