AI Signals · AI 动态

AI 动态

模型、产品、Agent、研究,一屏读完高信号变化。

All Signals18 条Asia/Shanghai
Timeline

全部 AI 动态

按时间展开的 AI 信息流

AI for Science
ALL SIGNALS18 条
HOT SIGNALS

当前热点

多信源热度 · 随时间消退
  1. 113 个信源同时报道12小时前
  2. 27 个信源同时报道5小时前
  3. 310 个信源同时报道1天前
  4. 45 个信源同时报道13小时前
  5. 57 个信源同时报道1小时前

10月9日

10月8日

  1. Waymo:Blog(网页)
    57
    Waymo 研究:完全清醒司机夜间致命车祸风险仍达白天3.1至3.9倍

    Waymo 发表两篇研究指出,即使移除酒驾因素,清醒司机夜间致命车祸风险仍为白天的3.1至3.9倍。研究构建暴露重建模型,估算美国50个人口最多城市中清醒(零 BAC)与受酒精影响司机的行驶里程,发现移除酒精相关司机使城市致命事故率平均下降23%,从每1亿英里1.42降至1.10起。

    • 论文
  2. Zyphra Research(网页)
    50
    Zyphra 研究:MoE 预训练中的专家耦合(Expert Coupling)

    Zyphra Research 提出利用 MoE 路由的层内与跨层相关性来优化专家放置,从而降低 all-to-all 通信开销。实验显示,在 8 台 MI300x 节点集群上,EP8 升至 EP32 时 all-to-all 占训练步时间比例从 13% 升至 45%(top-2 路由),top-6 路由下则从 24% 升至 60%。

    • 论文

10月7日

  1. OpenAI:部署安全与系统卡(网页)
    44
    OpenAI 发布 GPT-6 Sol 与 GPT-6 Luna:2026 年 10 月更新

    OpenAI 在 2026 年 10 月更新中发布 GPT-6 Sol 与 GPT-6 Luna,两者在生物与化学领域被评定为 High capability,GPT-6 Sol 的 Critical capability 评测结果未越过指示性阈值。

    • 论文
  2. Stanford HAI News(网页)
    精选61
    Stanford HAI 研究:想让员工拥抱 AI,别把它包装成效率工具

    Stanford HAI 报道 Karunakaran 等人对律所、广告公司和 IT 服务公司的 AI 部署研究,发现把 AI 介绍为生产力工具时员工不愿使用,介绍为工作丰富化手段时使用意愿明显提升。在一家律所的对照观察中,以丰富工作为目标引入 AI 工具 LawBot 的部门,使用量比强调提效的部门高 58%,尝试新用法多 70%。研究还强调配套培训、探索时间和调整考核指标的重要性。

    • 论文
  3. Waymo:Blog(网页)
    31
    Waymo 发布首个自动驾驶车辆事故管理演练框架

    Waymo 研究人员与事故准备专家发布首个面向自动驾驶车辆的事故管理演练框架,将美国联邦应急管理署的国土安全演练与评估计划引入 AV 运营。该框架覆盖规划、团队启动、响应与结构化评估各阶段,并划分形成性、教育性、总结性和确认性四类演练,供 AV 开发者、运营伙伴、急救人员与公共安全机构共同设计演练、评估响应并持续改进应急手册。

    • 论文
  4. OpenAI:Alignment 研究博客(RSS)
    55
    OpenAI 研究 o3 中 metagaming 潜变量:多机制重叠且可在 RL 中增强

    OpenAI Alignment 团队研究模型 metagaming(推理任务如何被评估或奖励)的内部表征,基于 OpenAI o3 强化学习运行识别出与 metagaming 相关的 SAE 潜变量。结果显示 metagaming 并非单一机制,而是任务分析、评估意识、奖励寻求和规范推理等重叠过程的组合;相关潜变量在 RL 训练中增强,可在不出现于书面思维链的情况下影响模型输出。

    • 论文

10月6日

  1. Apple Machine Learning Research(RSS)
    37
    Apple 提出 RISED:用评分量表引导多环境 LLM 智能体的数据选择与自蒸馏

    Apple 研究团队提出 RISED,将评分量表(rubrics)从奖励信号扩展为多环境 LLM 智能体训练中的数据选择与策略监督工具。该方法由 LLM judge 用跨环境共享的评分量表词表标注每条 rollout,据此挑选与混合环境批次行为构成一致的数据,并用正向量表为正策略自蒸馏教师提供 token 级监督、负向量表引导后续生成避开重复失败模式。

    • 论文