Anthropic 发表对 Block AI capabilities 负责人 Bradley Axen 的访谈,介绍 Block 用 Claude Fable 5 编排大规模代码迁移:Fable 做数据模型、API 规格等高层设计,再调度数十个更小的 Opus 或 Sonnet 模型执行文件修改和测试,一次迁移可能合并上千个 pull request。
AI 动态
模型、产品、Agent、研究,一屏读完高信号变化。
精选
高信号更新流
当前热点
- 1
- 2
- 3
- 4
- 5
10月8日
Block 如何用 Claude Fable 编排数千个 pull request 的代码迁移Claude:Blog(网页)精选66 Hugging Face 工程师用 ML Intern 以约 103 美元自制 7 个小模型Hugging Face 官方团队博客精选72Hugging Face 工程师 yuvraj sharma 用 HuggingChat 的 ML Intern 模式在几天内做出 7 个模型,包括可在 CPU 运行、99.7% 有效输出的 0.8B 提示词重写器,以及将柑橘病害识别准确率从 14.9% 提升到 52.8% 的 Qwen3.5-2B 微调模型等,全部计算成本约 103 美元。
NVIDIA KGMON 团队分享 KDD Cup 2026 数据分析智能体的构建经验NVIDIA Technical Blog:Agentic AI / Generative AI精选62NVIDIA KGMON 团队在 KDD Cup 2026 Data Agents 竞赛获得第二名,并发布构建可靠数据分析智能体的方法复盘。
Anthropic 用 Claude Managed Agents 构建定时智能体自动化的实践指南Anthropic:Claude.dev 开发者博客(RSS)精选68Anthropic 发布基于 Claude Managed Agents(beta)的每日简报参考实现,按计划读取 Slack 和 GitHub 来源并向 Slack 发布简报。
Tessl 工程博客:AI 不是笨,是瞎——企业级 Agent 记忆的三个关键设计决策Tessl:产品与工程博客精选68作者基于为跨公司工作的 Agent 构建记忆系统一年的经验指出,AI 失败的常见原因不是模型推理差,而是它看不到关键决策上下文,多数 agent memory 只是给瞎子更大的档案柜。
Unsloth 开源教程:本地训练 Qwen3.5 0.8B 决策模型,准确率从 20.7% 提升至 74.3%Unsloth@UnslothAI精选66Unsloth 发布教程与开源仓库,可将 Qwen3.8、Gemma 4 等 LLM 微调为输出选项概率的决策模型,Qwen3.5 0.8B 在 3 个决策基准上的合计准确率从 20.7% 提到 74.3%,仅需 4GB 显存。
10月9日
如何在单张 RTX 5090 上用 MiniMax H3 生成实时视频Comfy Blog精选66ComfyUI 博客作者用智能体搜集各类优化,把 MiniMax H3 实时视频生成压缩到单张 RTX 5090(32 GB 显存)上运行,生成 30 秒视频耗时 23.51 秒,达 1.28 倍实时吞吐。
LangChain 用 Stripe Link 和 Managed Deep Agents 构建可支付的智能体 RestockLangChain:Blog(RSS)精选61LangChain 发布示例项目 Restock,一个在 Slack 上通过 Managed Deep Agents 运行的办公用品购买智能体,演示智能体如何安全完成支付。
10月7日
vLLM 详解 DeepSeek-V4.1-Flash 优化:Agent 场景吞吐提升 5 倍vLLM 官方博客(RSS)精选63Inferact 与 vLLM 社区在 DeepSeek-V4.1-Flash 发布三周内完成优化,低并发速度提升 1.9 倍,150 TPS 约束下吞吐提升 5.3 倍。
a16z 解析德州为何让数据中心排队等电a16z:News(RSS)精选75a16z 的 Ryan McEntush 分析德州电网暂停审批数据中心的原因:并网队列从 2024 年底的 63 GW 激增到今年 6 月的 474 GW,约 90% 是数据中心,开发商大量投机性申请且社区沟通不足。
Google 开放 SynthID Detector 门户,可检测图片、视频和音频是否由 AI 生成Google@Google精选68Google 介绍检测媒体是否由 AI 生成的方法:访问 https://synthid.com 上传图片、视频或音频文件,门户会扫描文件是否包含来自 Google 或其合作伙伴的 SynthID 水印。
10月6日
PromptArmor 解析 WebMCP 的机制与主要安全风险PromptArmor:Threat Intelligence精选60PromptArmor 发布 WebMCP 威胁情报解读,介绍 WebMCP 如何让网站向浏览中的智能体提供工具,并指出治理、提示词注入、Web 安全、误配置和操作漂移等新增风险。
Claude Code 云端会话实战指南:每个任务独占一台 VM,可并行跑任务并以分支收尾Anthropic:Claude.dev 开发者博客(RSS)精选82Claude Code 推出云端会话:每个任务在独立 VM 上运行,仓库克隆到新分支,可从 claude.ai/code、手机、Desktop、终端和 Slack 启动并跟踪,完成后产出可转 PR 的分支,Pro、Max、Team、Enterprise 计划不额外收费。
Vercel COO 讲解如何用 Agent 自动化 Inbound 销售Tomasz Tunguz 博客(VC 分析)精选63Vercel COO Jeanne DeWitt Grosser 在 Tom Tunguz 的 Office Hours 节目中讲解团队如何搭建运行销售漏斗顶端的 Agent。
卡兹克解读 A16Z 两份 AI 报告:AI 使用很广但用得还浅,头部 1% 用户月均花 903 美元卡兹克@Khazix0918精选72作者解读 A16Z 第七版《Top 100 消费级 AI 应用》和 90 多页的《市场状况 II》报告,指出反常识数据。美国近一半人用过 AI 但只有 25% 每天在用,截至 2026 年 8 月仅 4.5% 有 ChatGPT、Gemini 或 Claude 个人付费订阅;付费用户中头部 1% 月均消费 903 美元、贡献 19.5% 的全部消费。
卡兹克解读A16Z《Top 100 消费级 AI 应用》与《市场状况 II》两份报告中的反常识数据公众号:数字生命卡兹克精选71作者解读A16Z第七版《Top 100 消费级 AI 应用》和90多页的《市场状况 II》报告,指出AI付费渗透率仅4.5%、头部1%付费用户月均消费903美元、Agent Token量一年增长14倍等反常识数据。文章还讨论了AI消费分布高度集中、单位智能价格下降但H100租金走高的杰文斯悖论、AI商业模式更像SaaS以及算力资本开支带动实体基建回归等要点。
10月3日
Baseten 工程师实测:LLM 生成的推理引擎比 vLLM 快最多 90%Baseten 工程博客(网页)精选64Baseten 工程师参考 MetaInfer 论文,让 Claude Code(Fable 5)为 Qwen-3.6-35B-A3B(NVFP4,单张 B200)自动构建推理引擎 VibeQwen,单流解码比 vLLM 0.25.1 快 90%,首 token 从 28ms 降至 12ms,并发 32 时吞吐高 71%。
OpenAI 发布 GPT-6 家族实用指南:选型、提示词与长任务管理OpenAI:官网动态(RSS · 排除企业/客户案例)精选71OpenAI 发布 GPT-6 家族的实用指南,讲解如何按任务选择 GPT-6 Astra、GPT-6.1 Sol、GPT-6 Luna 及推理档位与速度模式。