跳到正文

全部动态

今日 6 条
今天10月2日周五
  1. TechCrunch · AI42

    Airbnb 秋季更新上线 AI 搜索与更多社交功能

    Airbnb 在秋季产品更新中首次推出 AI 搜索,用户可通过文字或语音提示查找房源,界面会基于偏好显示动态筛选条件,例如输入“baby”会自动给出婴儿床、游乐场、儿童书籍和玩具等选项。平台还用 AI 生成房源亮点摘要,并支持对心愿单房源进行 AI 对比。社交方面,用户可在地图上查看好友过往或即将进行的行程及其入住地点和体验,也可选择不分享自己的行程。

  2. TechCrunch · AI58

    DoorDash 推出可通过短信点餐的 AI 智能体

    DoorDash 宣布推出文本点餐 AI 智能体,用户可通过 Apple Messages 下单,例如发送“order my usual”即可被理解为常点的那份周五晚餐。该智能体支持指定菜品、请求本地推荐、搜索附近餐厅并给出购物车建议,还能发送推荐食物的照片,并在一次订单中处理多人不同的饮食偏好和数量。DoorDash 面向美国用户开放候补名单,同时宣布将在北加州部分餐厅测试配送无人机。

  3. TechCrunch · AI62

    Shopify 推出 Canvas,可通过与 AI 对话搭建网店

    Shopify 发布建站工具 Canvas,商家通过与 AI 智能体 Sidekick 对话即可搭建店铺。Canvas 实时渲染店铺真实代码而非静态预览,商家可测试页面交互与动画,并查看不同屏幕尺寸下的效果;Sidekick 还会截图以便与商家看到同样的画面。Shopify 为此让 Sidekick 直接操作主题文件,并简化了主题架构,产品目前仍处于早期阶段。

10月1日周四
  1. The Decoder58

    Anthropic 向美国民事机构推出 Claude for Government

    Anthropic 推出面向美国联邦和州级机构的 Claude for Government,该平台自 7 月起开放测试,运行在 FedRAMP High 环境。由于五角大楼禁用 Claude,该产品主要面向民事机构。机构可获得与企业客户相同的功能,按用量付费并设固定上限,管理员可按部门设置预算和模型访问权限,敏感操作需双人审批,聊天记录保留在机构设备上。

  2. The Decoder71

    Google 在 Gemini 中全球上线 Skills,取代 Gems

    Google 在 Gemini 聊天中面向全球推出 Skills,即针对特定任务的详细提示词,AI 可协助撰写和优化,用户输入“/”加名称即可调用。Skills 格式源自 Anthropic,并作为开放标准提供,支持文本、PDF 和图片作为参考材料,Gemini 还能从历史对话生成 Skills 并在匹配时自动运行。

9月30日周三
  1. The Verge · AI67

    Meta Muse AI 智能体最新动态汇总

    Meta 推出 Muse AI 智能体,称可帮用户发邮件、在线购物等,但需要用户信任 Meta 并交出信用卡信息。发布后 Meta 还宣布了类似 Tamagotchi 的 Muse Charm 设备,并陆续扩展小企业工具、企业平台、Mac 应用和智能眼镜端支持。汇总还提到 Muse 曾把一名 YouTuber 的地址发给陌生人、出现可被攻击者控制智能体的漏洞,以及亚马逊屏蔽该智能体等事件。

  2. AWS Machine Learning Blog62

    GPT-6.1 Sol 在 Amazon Bedrock 正式可用

    GPT-6.1 Sol 现已在 Amazon Bedrock 正式可用,面向智能体编码、计算机使用和专业工作负载提供更强的推理能力。据 OpenAI 称,它在 DeepSWE v1.1 上以约五分之一的单任务成本达到 GPT-6 Astra 的水平,并比 GPT-6 Sol 的最佳成绩高出 6.4 个百分点。

    推荐理由:原文给出 GPT-6.1 Sol 在 Bedrock 上的可用范围与成本对比,读者可据此判断智能体编码任务的性价比。

9月29日周二
  1. Simon Willison88

    OpenAI DevDay 2026 现场实录:Dots 智能体、GPT-6.1 Sol 与 Ultrafast 发布

    Simon Willison 在旧金山 Fort Mason 现场直播 OpenAI DevDay 2026 主题演讲,OpenAI 发布名为 Dots 的个人智能体,由 Astra 驱动,ChatGPT Pro 和 Enterprise 用户当天可用,并配套推出 ChatGPT Space 供团队协作。

    推荐理由:现场逐条记录 DevDay 发布节奏与演示成败,可对照 OpenAI 在智能体、编码与定价上的产品布局。

  2. AWS Machine Learning Blog62

    xAI 的 Grok 4.7 上线 Amazon Bedrock

    xAI 的 Grok 4.7 已在 Amazon Bedrock 上线,提供 500K token 上下文窗口和 low、medium、high、xhigh 四档可配置推理强度,通过跨区域推理配置在 bedrock-runtime 端点上提供服务,支持 Responses、Chat Completions 和 Converse API。

    推荐理由:文章给出 Grok 4.7 在 Bedrock 上的接入方式与四档推理强度,读者可据此判断长任务智能体的成本与延迟取舍。

9月28日周一
  1. Simon Willison36

    Simon Willison 用 Opus 5.5 打造 Bluesky 回复机器人检测工具

    Simon Willison 用 Opus 5.5 开发了 Bluesky reply bot checker,可分析账号近期发帖的输入速度、发帖时间、互动模式等行为信号,识别疑似自动回复机器人。工具会展示每项测量与规则,便于验证判断依据,并给出触发信号最多的示例回复。它重点检测秒级跟帖回复、从不发布原创内容或图片链接、只回复高粉丝账号,以及含问号的回复等特征。

9月25日周五
  1. GitHub Blog · AI & ML66

    GitHub Security Lab 发布 Fuzzing Taskflow 智能体,自动完成 C/C++ 模糊测试

    GitHub Security Lab 发布 Fuzzing Taskflow,一个面向 C/C++ 项目的自主模糊测试流水线,只需指向一个 GitHub 仓库,它就会识别入口点、分析构建系统、编写 harness、运行 AFL++、读取覆盖率报告并改进 harness,最后对每个崩溃做分诊并生成漏洞报告。

    推荐理由:GitHub Security Lab 把模糊测试的 harness 编写、覆盖率追踪与崩溃分诊交给 LLM 智能体,读者可据此判断自动化安全测试的边界。

9月24日周四
9月23日周三
9月22日周二
9月21日周一
9月17日周四
9月10日周四
  1. Hugging Face Blog62

    Hugging Face 用 Gradio Workflow 重建 AUTOMATIC1111,73 个节点复刻全部功能

    Hugging Face 发布 Workflow1111,用 Gradio Workflow 把 AUTOMATIC1111 的大部分功能重建为一张工作流画布,由 11 条媒体流水线和 73 个节点组成,覆盖文生图、高清修复、图生图、提示词矩阵、VLM 反推、检测生成 inpaint 掩码、ControlNet 风格标注器、背景移除、PNG Info 与图生视频。

    推荐理由:Hugging Face 用 73 个节点复刻 A1111 全部功能,并给出与 ComfyUI 的路线对比,可看节点式工作流的新形态。

9月5日周六
  1. GitHub Blog · AI & ML71

    GitHub 推出 Project HydraFusion:多模型编排实现前沿级编码质量

    GitHub 发布研究预览 Project HydraFusion,在 GitHub Copilot CLI 中通过运行时编排多个提供商的模型,自动选择 Single、Cascade、Critique 三种执行模式来平衡质量、成本与延迟。

    推荐理由:GitHub 官方给出多模型编排的三种执行模式与三项基准的成本质量对比,可据此判断路由式编排在编码任务上的取舍。

9月4日周五
  1. GitHub Blog · AI & ML38

    GitHub Copilot 应用入门:如何同时运行多个智能体

    GitHub Copilot 应用支持同时运行多个智能体会话,每个会话运行在独立的 Git worktree 上,互不干扰且各自保留上下文,可随时切换并从中断处继续。用户可在 sessions 视图中查看各会话标题与任务进度,例如在同一项目中并行完成 funded sort 功能开发、无障碍审查和测试运行。