跳到正文

全部动态

今日 29 条
9月28日周一
  1. Simon Willison36

    Simon Willison 用 Opus 5.5 打造 Bluesky 回复机器人检测工具

    Simon Willison 用 Opus 5.5 开发了 Bluesky reply bot checker,可分析账号近期发帖的输入速度、发帖时间、互动模式等行为信号,识别疑似自动回复机器人。工具会展示每项测量与规则,便于验证判断依据,并给出触发信号最多的示例回复。它重点检测秒级跟帖回复、从不发布原创内容或图片链接、只回复高粉丝账号,以及含问号的回复等特征。

9月26日周六
  1. Ars Technica · AI74

    美国上诉法院裁定五角大楼可因Anthropic拒绝开放Claude功能而将其列入黑名单

    美国哥伦比亚特区巡回上诉法院以2比1裁定,国防部有权因Anthropic拒绝向军方开放Claude的某些AI功能而将其列入黑名单,即使Anthropic并无恶意。法院称此案涉及军事使用强大新技术的难题,并指出国防部长依据《供应链安全法》和宪法未越权,因此驳回Anthropic的复审请求。该法院此前已在4月驳回Anthropic的紧急暂缓执行申请。

9月25日周五
  1. GitHub Blog · AI & ML66

    GitHub Security Lab 发布 Fuzzing Taskflow 智能体,自动完成 C/C++ 模糊测试

    GitHub Security Lab 发布 Fuzzing Taskflow,一个面向 C/C++ 项目的自主模糊测试流水线,只需指向一个 GitHub 仓库,它就会识别入口点、分析构建系统、编写 harness、运行 AFL++、读取覆盖率报告并改进 harness,最后对每个崩溃做分诊并生成漏洞报告。

    推荐理由:GitHub Security Lab 把模糊测试的 harness 编写、覆盖率追踪与崩溃分诊交给 LLM 智能体,读者可据此判断自动化安全测试的边界。

  2. Google DeepMind71

    Google DeepMind 发布 Gemini 3.8 Live with Live Avatar

    Google DeepMind 发布 Gemini 3.8 Live with Live Avatar,在 Gemini 3.8 Live 的基础上为原生实时对话模型加入近实时视觉形象,可同时处理视觉与音频输入并输出带表情和唇形同步的音视频。

    推荐理由:官方披露了实时视频与语音耦合的对话能力、异步工具调用和 97 种语言支持,可据此判断企业级虚拟形象的应用边界。

9月24日周四
  1. Latent Space34

    Foundries vs Navigators:AI 如何降低科学研究的成本

    AI 让写代码和数据分析变得极快,但科学研究的瓶颈仍是需要数天到数周验证的物理实验,"思考变便宜了,动手没有"。生物技术行业由此分化为两类:Foundries 用下一代测序、高通量显微镜和物理自动化把实验测量成本降低一个数量级,差异化资产是实验数据本身;Navigators 则把 AI 嵌入公司日常流程,用更快的决策和流程改进实验迭代,无需专有模型或大规模数据集。

  2. NVIDIA Blog62

    NVIDIA 联合 Google DeepMind 等开放 2800 多种病毒的蛋白复合物预测结构

    NVIDIA 加入由 Google DeepMind、EMBL-EBI 等组成的全球研究联盟,通过 AlphaFold Database 开放 2800 多种病毒的蛋白复合物预测 3D 结构,供任何科学家免费使用。

    推荐理由:NVIDIA 联合 Google DeepMind 等开放 2800 多种病毒的蛋白复合物预测结构,并公开生成流程,读者可了解开放科学在疫情准备中的具体做法。

9月23日周三
  1. Google DeepMind72

    Google DeepMind 发布 Gemini 3.8 Flash TTS 与 Flash-Lite TTS

    Google DeepMind 推出 Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTS 两款文本转语音模型,前者面向角色设计与深度创作控制,后者面向高并发、低成本的配音与语音智能体场景。

    推荐理由:两款 TTS 模型给出语音克隆、逐行表演控制与多语言覆盖的具体能力,可据此判断语音生成工作流的变化。

  2. NVIDIA Blog12

    NVIDIA 验证工程师 Sakeena Fiza:在实验室里为 AI 硬件"破案"

    NVIDIA 验证工程师 Sakeena Fiza 在数据中心系统实验室负责新产品量产前的硬件验证,她回忆 NVIDIA Rubin GPU 首次在系统层面被识别时,全场欢呼,这是全球首次 Rubin GPU 完成系统级枚举。她将验证工作比作破案:一块板卡可能含数万个元件,一个机架接近 50 万个,目标是在客户发现问题之前先发现并复现问题。

  3. Latent Space40

    Radical Numerics CEO Eric Nguyen 谈生物安全:AI 军备竞赛与基因组语言模型

    Radical Numerics 联合创始人兼 CEO Eric Nguyen 认为生物安全正成为 AI 军备竞赛,防御能力需要跟上前沿模型的攻击能力。其团队构建的基因组语言模型(GLM)已能处理 RNA 和蛋白质,并在 aptamer 数据集上展现出类似链式推理的"用 DNA 思考"能力,可自行推演出未见过的高分序列。

  4. Latent Space88

    Anthropic 发布 Claude Opus 5.5,OpenAI 同日推出 GPT-6 Sol 与 Luna 并降价 40-50%

    Anthropic 发布 Claude Opus 5.5,为 Claude 5.5 家族首个模型,官方称多数任务达到 Claude Fable 5.1 水平,运行成本比 Opus 5 低 40%,速度约快 30%,并成为 Claude Code 与 Claude 应用的默认模型。

    推荐理由:同一天两家实验室分别发布新模型并大幅降价,读者可对比能力与每任务成本的实际差异。

  5. Simon Willison8

    Simon Willison 与 Jesse Vincent 将于 10 月 14 日在旧金山举办 Agentic Engineering 交流活动

    Simon Willison 与 Jesse Vincent 将于 10 月 14 日(周三)在旧金山举办一场面向 coding agent 构建者的晚间交流活动,形式为非正式的 agentic show-and-tell。活动鼓励参与者分享正在尝试的项目、经验教训与尚未解决的难题,尤其欢迎未公开讨论过的工作、奇特实验和没有明确市场的不完整项目。活动不设产品推销环节,也无需正式演讲。