跳到正文

#产品更新

今日 7 条
今天10月2日周五
  1. TechCrunch · AI42

    Airbnb 秋季更新上线 AI 搜索与更多社交功能

    Airbnb 在秋季产品更新中首次推出 AI 搜索,用户可通过文字或语音提示查找房源,界面会基于偏好显示动态筛选条件,例如输入“baby”会自动给出婴儿床、游乐场、儿童书籍和玩具等选项。平台还用 AI 生成房源亮点摘要,并支持对心愿单房源进行 AI 对比。社交方面,用户可在地图上查看好友过往或即将进行的行程及其入住地点和体验,也可选择不分享自己的行程。

  2. TechCrunch · AI58

    DoorDash 推出可通过短信点餐的 AI 智能体

    DoorDash 宣布推出文本点餐 AI 智能体,用户可通过 Apple Messages 下单,例如发送“order my usual”即可被理解为常点的那份周五晚餐。该智能体支持指定菜品、请求本地推荐、搜索附近餐厅并给出购物车建议,还能发送推荐食物的照片,并在一次订单中处理多人不同的饮食偏好和数量。DoorDash 面向美国用户开放候补名单,同时宣布将在北加州部分餐厅测试配送无人机。

  3. TechCrunch · AI62

    Shopify 推出 Canvas,可通过与 AI 对话搭建网店

    Shopify 发布建站工具 Canvas,商家通过与 AI 智能体 Sidekick 对话即可搭建店铺。Canvas 实时渲染店铺真实代码而非静态预览,商家可测试页面交互与动画,并查看不同屏幕尺寸下的效果;Sidekick 还会截图以便与商家看到同样的画面。Shopify 为此让 Sidekick 直接操作主题文件,并简化了主题架构,产品目前仍处于早期阶段。

10月1日周四
  1. Hugging Face Blog62

    AI2 发布 Olmo-core 3:面向大型 MoE 的开源可扩展训练基础设施

    AI2 发布 Olmo-core 3,这是其大语言模型开发框架的一次重大升级,重新设计了开放的 MoE 训练系统,目标是把 MoE 训练扩展到万亿参数规模并保持计算效率。

    推荐理由:原文给出 MoE 训练栈的吞吐与显存实测数据,读者可据此判断万亿参数 MoE 训练的开源方案成熟度。

  2. The Decoder58

    Anthropic 向美国民事机构推出 Claude for Government

    Anthropic 推出面向美国联邦和州级机构的 Claude for Government,该平台自 7 月起开放测试,运行在 FedRAMP High 环境。由于五角大楼禁用 Claude,该产品主要面向民事机构。机构可获得与企业客户相同的功能,按用量付费并设固定上限,管理员可按部门设置预算和模型访问权限,敏感操作需双人审批,聊天记录保留在机构设备上。

  3. The Decoder71

    Google 在 Gemini 中全球上线 Skills,取代 Gems

    Google 在 Gemini 聊天中面向全球推出 Skills,即针对特定任务的详细提示词,AI 可协助撰写和优化,用户输入“/”加名称即可调用。Skills 格式源自 Anthropic,并作为开放标准提供,支持文本、PDF 和图片作为参考材料,Gemini 还能从历史对话生成 Skills 并在匹配时自动运行。

9月30日周三
  1. The Verge · AI67

    Meta Muse AI 智能体最新动态汇总

    Meta 推出 Muse AI 智能体,称可帮用户发邮件、在线购物等,但需要用户信任 Meta 并交出信用卡信息。发布后 Meta 还宣布了类似 Tamagotchi 的 Muse Charm 设备,并陆续扩展小企业工具、企业平台、Mac 应用和智能眼镜端支持。汇总还提到 Muse 曾把一名 YouTuber 的地址发给陌生人、出现可被攻击者控制智能体的漏洞,以及亚马逊屏蔽该智能体等事件。

  2. Google DeepMind71

    Google DeepMind 推出 SynthID Bio,为 AI 生成蛋白质加水印

    Google DeepMind 发布 SynthID Bio,将水印技术引入合成生物学,把不可感知的签名直接嵌入生物代码,使水印不仅能在数字模型上验证,也能在合成出的实体蛋白质上验证,同时实验室测试显示其生物功能未受影响。

    推荐理由:SynthID 从图像音频扩展到合成生物学,读者可了解水印如何嵌入蛋白质序列与结构而不影响功能。

  3. AWS Machine Learning Blog62

    GPT-6.1 Sol 在 Amazon Bedrock 正式可用

    GPT-6.1 Sol 现已在 Amazon Bedrock 正式可用,面向智能体编码、计算机使用和专业工作负载提供更强的推理能力。据 OpenAI 称,它在 DeepSWE v1.1 上以约五分之一的单任务成本达到 GPT-6 Astra 的水平,并比 GPT-6 Sol 的最佳成绩高出 6.4 个百分点。

    推荐理由:原文给出 GPT-6.1 Sol 在 Bedrock 上的可用范围与成本对比,读者可据此判断智能体编码任务的性价比。

9月29日周二
  1. Microsoft Research62

    微软研究院发布 Quine:面向生物学复杂性的 AI 研究系统

    微软研究院发布 Quine,一个面向生物学复杂性的 AI 研究系统,由生物世界模型和连接模型、科学工具、文献与实验人员的交互式 harness 两部分组成。该系统与 Broad Institute 合作用于胰腺导管腺癌研究,预测并优先排序数千种化合物,最高排名化合物在湿实验中产生了最大的经典态向基底态转变,从缩小化合物搜索空间到选出候选验证仅用一个周末。

    推荐理由:微软研究院公开 Quine 的多模态生物世界模型与实验闭环设计,并给出胰腺癌化合物筛选的湿实验验证结果。

  2. AWS Machine Learning Blog62

    xAI 的 Grok 4.7 上线 Amazon Bedrock

    xAI 的 Grok 4.7 已在 Amazon Bedrock 上线,提供 500K token 上下文窗口和 low、medium、high、xhigh 四档可配置推理强度,通过跨区域推理配置在 bedrock-runtime 端点上提供服务,支持 Responses、Chat Completions 和 Converse API。

    推荐理由:文章给出 Grok 4.7 在 Bedrock 上的接入方式与四档推理强度,读者可据此判断长任务智能体的成本与延迟取舍。

9月28日周一
  1. Simon Willison36

    Simon Willison 用 Opus 5.5 打造 Bluesky 回复机器人检测工具

    Simon Willison 用 Opus 5.5 开发了 Bluesky reply bot checker,可分析账号近期发帖的输入速度、发帖时间、互动模式等行为信号,识别疑似自动回复机器人。工具会展示每项测量与规则,便于验证判断依据,并给出触发信号最多的示例回复。它重点检测秒级跟帖回复、从不发布原创内容或图片链接、只回复高粉丝账号,以及含问号的回复等特征。

9月25日周五
  1. GitHub Blog · AI & ML66

    GitHub Security Lab 发布 Fuzzing Taskflow 智能体,自动完成 C/C++ 模糊测试

    GitHub Security Lab 发布 Fuzzing Taskflow,一个面向 C/C++ 项目的自主模糊测试流水线,只需指向一个 GitHub 仓库,它就会识别入口点、分析构建系统、编写 harness、运行 AFL++、读取覆盖率报告并改进 harness,最后对每个崩溃做分诊并生成漏洞报告。

    推荐理由:GitHub Security Lab 把模糊测试的 harness 编写、覆盖率追踪与崩溃分诊交给 LLM 智能体,读者可据此判断自动化安全测试的边界。

9月24日周四
9月23日周三
9月22日周二
9月21日周一
9月17日周四
9月10日周四
  1. Hugging Face Blog62

    Hugging Face 用 Gradio Workflow 重建 AUTOMATIC1111,73 个节点复刻全部功能

    Hugging Face 发布 Workflow1111,用 Gradio Workflow 把 AUTOMATIC1111 的大部分功能重建为一张工作流画布,由 11 条媒体流水线和 73 个节点组成,覆盖文生图、高清修复、图生图、提示词矩阵、VLM 反推、检测生成 inpaint 掩码、ControlNet 风格标注器、背景移除、PNG Info 与图生视频。

    推荐理由:Hugging Face 用 73 个节点复刻 A1111 全部功能,并给出与 ComfyUI 的路线对比,可看节点式工作流的新形态。

9月8日周二
  1. Google DeepMind78

    Google DeepMind 发布 AlphaGenome Atlas,覆盖人类基因组 90 亿个单核苷酸变异预测

    Google DeepMind 发布 AlphaGenome Atlas,一个包含人类基因组 90 亿个单核苷酸变异效应预测的平台,规模达 1PB,是 AlphaFold Database 的 30 多倍,已通过网站门户免费开放给学术研究使用。

    推荐理由:DeepMind 把 AlphaGenome 的预测预计算成 1PB 全基因组图谱,读者可据此判断变异解读的门槛与规模变化。