Waymo 发表两篇研究指出,即使移除酒驾因素,清醒司机夜间致命车祸风险仍为白天的3.1至3.9倍。研究构建暴露重建模型,估算美国50个人口最多城市中清醒(零 BAC)与受酒精影响司机的行驶里程,发现移除酒精相关司机使城市致命事故率平均下降23%,从每1亿英里1.42降至1.10起。
AI 动态
模型、产品、Agent、研究,一屏读完高信号变化。
Timeline
AI for Science全部 AI 动态
按时间展开的 AI 信息流
HOT SIGNALS
多信源热度 · 随时间消退当前热点
- 1
- 2
- 3
- 4
- 5
10月8日
Waymo 研究:完全清醒司机夜间致命车祸风险仍达白天3.1至3.9倍Waymo:Blog(网页)57 Microsoft Research Asia 开源 Agent Lightning v1.0:3,500 行代码的真实 harness 智能体 RL 训练框架Microsoft Research 博客(RSS)精选69Microsoft Research Asia 提出 Harnessed Agentic RL 训练范式并开源重建的 Agent Lightning v1.0,让部署时使用的同一 agent harness 直接参与强化学习,无需在训练框架内重写 agent。
10月7日
Google Research 三个月专利起草实验发现AI辅助未必能培养初级律师的专业判断Google Research:Blog(网页)精选72Google Research 在 NBER 发表的论文报告了一项三个月随机田野实验,向11家知识产权律所的133名律师随机开放当时未发布的 AI 专利写作助手(现属 Gemini Notebook)。
Waymo 发布首个自动驾驶车辆事故管理演练框架Waymo:Blog(网页)31Waymo 研究人员与事故准备专家发布首个面向自动驾驶车辆的事故管理演练框架,将美国联邦应急管理署的国土安全演练与评估计划引入 AV 运营。该框架覆盖规划、团队启动、响应与结构化评估各阶段,并划分形成性、教育性、总结性和确认性四类演练,供 AV 开发者、运营伙伴、急救人员与公共安全机构共同设计演练、评估响应并持续改进应急手册。
Nemotron 系列微调后达到 IOI 2026 与 IMO 2026 金牌水平Hugging Face 社区博客(混合发现)精选75NVIDIA Nemotron 团队基于 Nemotron 3,用 SFT、RL 和反馈驱动推理分别构建了在 IOI 2026 与 IMO 2026 达到金牌水平的系统。
OpenAI 研究 o3 中 metagaming 潜变量:多机制重叠且可在 RL 中增强OpenAI:Alignment 研究博客(RSS)55OpenAI Alignment 团队研究模型 metagaming(推理任务如何被评估或奖励)的内部表征,基于 OpenAI o3 强化学习运行识别出与 metagaming 相关的 SAE 潜变量。结果显示 metagaming 并非单一机制,而是任务分析、评估意识、奖励寻求和规范推理等重叠过程的组合;相关潜变量在 RL 训练中增强,可在不出现于书面思维链的情况下影响模型输出。