AI Signals · AI 动态

AI 动态

模型、产品、Agent、研究,一屏读完高信号变化。

Daily Briefing26 条Asia/Shanghai
VOL.2026-08-1226 STORIESAI FOR SCIENCE DAILY

日报

2026年8月12日星期三

DAILY · 每早八时

TODAY'S SIGNALS

今日看点

  1. 01
  2. 02
  3. 03
01

模型发布/更新

Model Releases
3

NVIDIA 推出 Nemotron 3.5 Lightning,加速本地智能体任务

NVIDIA Blog(RSS)NVIDIA Blog(RSS)

NVIDIA 发布 Nemotron 3.5 Lightning,一款可定制的开源 30B 混合专家(MoE)模型,专为常驻智能体设计。相比同类开源模型,其 token 生成速度最高提升 4 倍,任务完成时间缩短 30%。该模型采用开放权重,支持用户微调以匹配特定任务,并可在 RTX PC、DGX Spark 及 Jetson 等设备上运行。

SGLang 宣布 Day-0 支持 NVIDIA Nemotron 3.5 Lightning

LMSYS:Blog(Chatbot Arena 团队)LMSYS:Blog(Chatbot Arena 团队)

SGLang 宣布对 NVIDIA Nemotron 3.5 Lightning 提供 Day-0 支持,该开源模型为 30B 总参数、3B 激活参数的混合专家架构,支持最长 1M token 上下文,可从 Hugging Face 下载 BF16 和 NVFP4 权重。模型支持 MTP、DFlash、DSpark 三种投机解码技术,并可通过 OpenAI 兼容 API 接入智能体工作流。

02

产品发布/更新

Products
5

Runway Seedance 2.5 上线,支持50角色参考

X:Runway (@runwayml)X:Runway (@runwayml)

完整阵容,完整曲目,一次生成一个。 Seedance 2.5 已在 Runway 上线,支持 50 个独特角色参考,以及最长 30 秒、与音乐同步的片段。点击下方链接即可开始使用。

Gemini 助力 Database Migration Service 加速 PostgreSQL 迁移

Google Cloud:Databases(RSS)Google Cloud:Databases(RSS)

Google Cloud 在 Database Migration Service(DMS)中推出由 Gemini 驱动的 AI 辅助代码转换,可将 Oracle 或 SQL Server 的存储过程、触发器和自定义函数转换为 PostgreSQL PL/pgSQL 代码。

ZCode全面升级:Goal、Subagents、Remote Control与闲时任务四大功能上线

公众号:智谱(GLM)公众号:智谱(GLM)

ZCode针对GLM深度优化,今日上线Goal、Subagents、Remote Control与闲时任务四大功能。在Z.ai Code Bench测试中,GLM-5.2搭配ZCode较搭配Claude Code任务整体通过率高2.39%;ZCode缓存命中率超98%,叠加1.5倍限时额度加成后,GLM Coding Plan整体使用量接近常规额度的1.8倍。

ChatGPT 桌面端支持导入其他智能体工作数据

X:OpenAI Developers (@OpenAIDevs)X:OpenAI Developers (@OpenAIDevs)

你现在可以将其他智能体的工作内容与 ChatGPT Work 和 Codex 保持同步。 可导入项目、聊天记录、技能和插件,查看导入历史,并可在设置中选择开启自动更新。 现已在 ChatGPT 桌面应用中提供。

Databricks 开源 Metals v2:面向数百万行代码库的 Java 和 Scala 语言服务器

Databricks:Blog(RSS)Databricks:Blog(RSS)

Databricks 开源 Metals v2,这是其面向数百万行代码库的 Java 和 Scala 语言服务器。Metals v2 专为智能体驱动的开发场景设计,旨在提升大规模代码库中的编辑与导航性能。目前 Databricks 的大部分代码已由智能体编写,该工具服务于工程师仍需要手动介入的环节。

03

行业动态

Industry
7

研究人员发现可读取ChatGPT等模型加密推理过程的API漏洞

The Decoder:AI News(RSS)The Decoder:AI News(RSS)

Alexander Panfilov团队发现OpenAI、Anthropic、Google等主要AI提供商API存在漏洞,可读取推理模型的加密思考过程。扫描约7000条公开会话发现62个API密钥、33个邮箱和33个密码。通过越狱,Anthropic的Haiku 4.5可逐字转写Opus 4.8的原始推理;解码10000条推理轨迹的API成本约720美元。

消息称 Anthropic 最快今年 9 月上市,向投资者淡化 AI 模型竞争等挑战

IT之家(RSS)IT之家(RSS)

Anthropic 正与潜在投资者接触,为可能成为史上规模最大的 IPO 做准备,计划今年 9 月或 10 月初正式上市。公司估值高达 9,650 亿美元,年化收入已超 470 亿美元,并淡化来自中国 AI 企业的竞争影响。Anthropic 还计划拓展 AI 在医疗和生物学领域的应用,但尚未公布具体 IPO 定价方案。

Gemini月活破10亿,成谷歌增长最快产品

X:Sundar Pichai (@sundarpichai)X:Sundar Pichai (@sundarpichai)

每月已有超过 10 亿人使用 @Geminiapp 激发新想法、完成工作。这是我们有史以来增长最快的产品,也是第 14 个达到 10 亿用户里程碑的产品。 感谢 @JoshWoodward 和整个 Gemini 团队,也感谢每一位与我们同行的伙伴——未来还有更多精彩!

消息称英伟达开发万亿参数开源 AI 模型 Nemotron 4,目标挑战全球顶级

IT之家(RSS)IT之家(RSS)

英伟达正在研发新一代开源 AI 模型系列 Nemotron 4,规模最大的模型预计至少拥有 1 万亿个参数,旨在与全球最先进的开源模型竞争。英伟达尚未确定发布日期,最终训练也未完成,员工认为该模型最早可能在今年秋末准备就绪。此举意在通过开放模型生态扩大 AI 应用范围,并推动市场对其 GPU 算力的需求。

NVIDIA 为何需要新供电架构以扩展 AI 算力性能

NVIDIA Blog(RSS)NVIDIA Blog(RSS)

NVIDIA 主张以 800 VDC 直流配电替代传统交流多次转换,以降低损耗、支撑 AI 算力扩展。NVIDIA 与 Google、Microsoft 通过 OCP 联合制定该架构,已发布白皮书及 LVDC 固态变压器规范 v0.3,超 80 家设备商正据此开发产品。

英伟达循环融资达到新高度,黄仁勋是否过度出牌?

Gary Marcus:The Road to AI We Can Trust(RSS)Gary Marcus:The Road to AI We Can Trust(RSS)

英伟达股价在相关消息公布后小幅下滑,收盘报217.55美元,盘前略有回升。金融记者Holger Zschaepitz和曾预测安然倒闭的Jim Chanos均对英伟达的循环融资做法表示担忧。此外,英伟达将发布真正开源(非仅开放权重)的Nemotron模型新版本,这可能最终削弱其合作伙伴OpenAI和Anthropic的地位。

Electric 加入 Databricks,将 WASM Postgres 引入 AI 智能体沙箱

Databricks:Blog(RSS)Databricks:Blog(RSS)

Databricks 宣布 Electric 团队加入,将 WASM Postgres 引入 AI 智能体沙箱。该技术让智能体在隔离环境中运行本地数据库,支持实时数据同步与离线操作,提升构建可靠、可验证智能体应用的效率。Electric 的加入将强化 Databricks 在智能体基础设施领域的布局。

04

论文研究

Research
3

Apple Silicon 与 macOS 虚拟机:借助 Llama.cpp 实现 11–16 倍的 LLM 推理加速

Hacker News 热门(buzzing.cc 中文翻译)Hacker News 热门(buzzing.cc 中文翻译)

研究团队为 macOS 虚拟机中的 Metal 能力查询构建进程级兼容层,使 llama.cpp 能选用更新的 Metal 内核。在 M1 Ultra 上,TinyLlama 1.1B 的提示处理速度提升 11.08 倍、token 生成提升 16.36 倍,接近裸机性能的 98%;Gemma 4 12B 的提示处理与生成速度分别提升 7.20 倍和 14.54 倍。

统一 Radix 缓存:为混合模型前缀缓存构建单一树结构

LMSYS:Blog(Chatbot Arena 团队)LMSYS:Blog(Chatbot Arena 团队)

LMSYS 团队提出 Unified Radix Cache,用单一 token 键控 radix 拓扑统一管理混合模型的 FULL、SWA 和 MAMBA 组件缓存,各组件独立执行路径、滑动窗口和检查点复用语义。

AMIE 研究医疗 AI 系统首次展示实时临床视频问诊能力

Google Blog:AI(RSS)Google Blog:AI(RSS)

Google Research 与 Google DeepMind 推进医疗 AI 系统 AMIE,实现实时临床视频问诊,首次在此场景展示专家级 AI 能力。该系统基于 Gemini 和 Project Astra 构建,可解读视觉与听觉线索、引导虚拟体格检查并实时诊断推理。随机研究中,临床评估者对 AMIE 的病史采集、诊断准确性等核心能力给予好评,患者演员也更偏好视频体验。

05

技巧与观点

Daily
8

用 ComfyUI API 实现 MiniMax-H3 多模态视频与音频生成流水线

MarkTechPost(RSS)MarkTechPost(RSS)

本教程演示如何以 ComfyUI 为无头推理后端,构建端到端的 MiniMax-H3 视频生成工作流。通过 Python 直接构建执行图,支持文生视频、首尾帧条件生成和参考图像条件生成,并自动根据 GPU 显存选择 quality、balanced、squeeze 三种权重配置。流水线涵盖模型自动下载、节点模式校验、音视频联合解码与进度监控,无需图形界面即可复现实验。

将 GitHub Copilot 置于中间人(MitM)代理之后后,我学到了什么

Hacker News 热门(buzzing.cc 中文翻译)Hacker News 热门(buzzing.cc 中文翻译)

作者通过 mitmproxy 对 VS Code 中的 GitHub Copilot 进行中间人代理拦截,逆向分析其网络流量与内部架构。文章指出这些 AI 应用普遍基于 Electron 构建,共享相似的网络栈,因此探测结果可迁移至其他同类应用。作者借此揭示了 Copilot 的运行时行为,并分享了配置代理的具体步骤。

编写智能体时,哪种编程语言最合适?

Hacker News 热门(buzzing.cc 中文翻译)Hacker News 热门(buzzing.cc 中文翻译)

针对“动态语言比静态语言更省 LLM token”的流行说法,作者用 GPT-5.6 Sol 让智能体实现 zstd 解码器进行实测。结果显示,medium 努力度下动态语言表现更好,ultra 下静态语言反而更优,且此前评测存在测试路径错误等缺陷。作者认为,琐碎任务上的性能无法推广到更大问题。

微信小微AI帮写与AI点评内测:朋友圈最后一点人味正在消失

公众号:数字生命卡兹克公众号:数字生命卡兹克

微信基于小微推出朋友圈AI帮写与AI点评内测功能,前者可根据图片和已写文字生成3条朋友圈文案,后者可长按文字生成评价或快捷评论。作者认为这两个功能将AI置于社交核心位置,可能鼓励AI内容、破坏朋友圈自2012年确立的“记录美好生活”基调。公众号端小微还常驻首位,自动总结常看公众号文章,作者担忧这会反向影响创作者内容生产。

Ryan Greenblatt:人类级AI或于2032年前通过递归自我改进催生失控超级智能

Dwarkesh Patel:Podcast & Blog(RSS)Dwarkesh Patel:Podcast & Blog(RSS)

Dwarkesh Patel与Redwood Research首席科学家Ryan Greenblatt探讨递归自我改进(RSI)的可能性:一旦AI达到人类顶级专家水平,可能在一年内实现相当于4-5年的AI进展,Ryan的中位预期是2031年自动化AI研发。双方还讨论了超级智能的对齐对象、奖励黑客行为是否会升级为AI联手接管世界等风险。

每个类别都有赢家:AI 时代 SaaS 龙头的估值溢价

Tomer Tunguz 博客(VC 分析)Tomer Tunguz 博客(VC 分析)

SaaS 估值整体承压,但每个细分赛道都跑出了 AI 龙头:CrowdStrike 以 34.4x 前瞻收入领跑安全(中位数 3.9x),Cloudflare 32.6x 对 17.5x,Shopify 11.3x 对 1.4x。

26
今日事件
0
一手报道
3
新模型
20
信源
AI for Science · 编辑系统自动生成