在 iPhone Air 上跑到 37 tok/s,太猛了。🚀 这正是小而强的开源模型大放异彩的地方:无需云端 GPU 就能拥有强大的多模态智能。很高兴看到 MiniCPM5-2B 在移动端流畅运行。
AI 动态
模型、产品、Agent、研究,一屏读完高信号变化。
全部 AI 动态
按时间展开的 AI 信息流
当前热点
- 1
- 2
- 3
- 4
- 5
10月9日
MiniCPM5-2B 在 iPhone Air 上跑出 37 tok/s面壁智能 OpenBMB@OpenBMB43 Addy Osmani 谈工程师对 AI Agent 感受两极分化的三种喜悦来源邵猛@shao__meng62Addy Osmani 认为工程师对 AI Coding Agent 的两极分化无法用「爱写代码 vs 爱交付」概括,实际取决于三种喜悦来源:创造的喜悦最安全只是上移一层,知晓的喜悦最危险,从 Agent 建议中挑选与自己构想是不同技能,长期只挑选会让构想能力退化;重要的喜悦不降反升,判断力从未如此重要。他把失落感重新定义为对工作的真实依恋而非适应失败,建议主动守护构成职业认同的核心部分。
马东锡NLP谈谷歌参访:Gemini 太拉但员工福利到位马东锡 NLP@dongxi_nlp20马东锡 NLP 称,拜访谷歌前因 Gemini 表现不佳而看低这家公司,进入谷歌后则被其对员工的关爱打动,认为福利安排细致且不计成本,午餐水准很高,据称中国办公室甚至能吃到整只甲鱼。他因此建议"牛马"应去谷歌这类公司上班,而不是去其他公司接受 PUA,并调侃 AGI 是否实现与个人无关,活得长短才与自己相关。
AI 时代需求定义与设计描述仍然缺失indigo@indigox34AI 已能快速实现或复制功能,但如何定义需求、清晰描述设计依然缺失。随着功能定义层次上移、目标愈发抽象,中间环节将全部由智能体实现,最终只剩提出需求的人和检查结果的人,软件逻辑层变成模型输出的 token。
李飞飞发问:机器时代谁来定义美Fei-Fei Li@drfeifei, World Labs14我认识的每一位数学家朋友,都能从他们研究的数字、形状和自然现象中看到美。在机器时代,谁来定义美?🤔
Meta 首席 AI 官 Alexandr Wang 解释 Muse 智能体的安全虚拟机设计Rohan Paul@rohanpaul_ai54Meta 首席 AI 官 Alexandr Wang 介绍每个 Muse 智能体运行在独立的 secure VM 沙箱中,用户数据只存储在该隔离环境内。智能体对外发送信息时由单独的 sentinel 智能体检查并拦截信用卡号、社会安全号等敏感数据,且访问新网站需用户批准;未来还将推出加密的 confidential VM,目标是 WhatsApp 级别保障,但可能更慢。
开源 MCP 服务器 REA:用 AI 智能体逆向分析任意应用功能Rohan Paul@rohanpaul_ai55Rohan Paul 介绍了一个约 29k stars 的 GitHub 开源项目 REA(Reverse Engineer Anything),一个面向二进制、应用和运行时行为逆向工程的 MCP 服务器。无需应用源码即可让 AI 智能体调查某项功能,REA 将应用机器码转回可读代码,智能体阅读代码、解释功能原理、展示证据,并能为你的项目构建自己的实现版本。
马东锡调侃 Tibo 与 Codex Reset马东锡 NLP@dongxi_nlp13我认为 Tibo @thsottiaux 就是 OpenAI 的雨宫阳平,他说的任何 codex 的新功能都不再重要了,大家就等那一句: Codex Reset “中华冷面开始供应了!”
郭宇谈 Agent 时代:软件为何会像牛奶一样便宜indigo@indigox29郭宇在 INDIGO TALK 中回顾:2015 年在字节初见神经网络产品,十年后在东京独自用 Agent 做出三十多个产品,随后陷入倦怠。节目从抖音意外胜出聊起,谈及 Vibe Coding 的决策负担、Agent OS、智能的五个层次,以及软件像牛奶一样便宜后真正要交付什么。
Gemini 2.5 医疗建议质量比肩医生Ethan Mollick@emollick41在急诊场景中,已过时的 Gemini 2.5 Pro 和 Gemini 2.5 Flash(无法访问患者病历)给出的建议,被其他医生评为与医生质量相当。未发现安全问题。 此后模型已显著提升。
INDIGO TALK EP52 对谈郭宇:当软件像牛奶一样便宜,我们还要交付什么indigo@indigox55indigo 与字节跳动前资深员工郭宇对谈,郭宇称一个人用 Agent 做出三十多个产品后陷入倦怠,因为 Vibe Coding 把整个团队的决策负担压到一人身上。对谈还讨论了 Agent OS、智能的五个层次、智能商品化会使软件像牛奶一样便宜,以及年轻人是否该把工作当作必选项。
Musk 称 Grok Bot 性价比极高Elon Musk@elonmusk, xAI27用 Grok @Bot 就像花 peanuts 雇一个超级聪明、勤奋的人
斯坦福 CS146S 第三周课程公开:Agent Skills 与 CLI邵猛@shao__meng72斯坦福大学 @mihail_eric 的「CS146S: The Modern Software Developer」第三周课程公开,主题为 Agent Skills and CLI,首次加入客座讲师 @leerob,讲义见 https://themodernsoftware.dev。
Claude Code 数字鞭子作者恐遭封禁Yuchen Jin@Yuchenj_UW28给 Claude Code 做了这个数字鞭子的人,肯定会被以“虐待或残忍行为”为由终身封禁 Claude。
Matt Pocock 分享 AI Coding Agent 流程选择框架:按改动规模匹配流程重量邵猛@shao__meng62Matt Pocock(281K ⭐ 开源项目 Skills For Real Engineers 作者)分享 AI Coding Agent 流程选择决策框架。
OpenAI 调侃 GPT-6 洗碗广告OpenAI Developers@OpenAIDevs20对细节的关注有点令人担忧。
密歇根大学 EECS 498 AASE 课程解读:把 AI 编程方法论做成五个 Skill邵猛@shao__meng71密歇根大学 2026 年秋季开设 EECS 498-016「Applied Agentic Software Engineering」,无教材无考试、总花费零美元,由 Marcus Darden 主讲,全部讲义 L01–L11 已在 GitHub 公开。
独立研究者用 Claude Code 在 NASA TESS 数据中发现疑似新行星Rohan Paul@rohanpaul_ai53一位独立研究者用 Claude Code(Opus 5.5 和 Fable 5.1)分析 NASA TESS 数据,发现一个自 2018 年起未被报告的行星候选体。
Meta 首席 AI 官谈 AI 最大恐惧Rohan Paul@rohanpaul_ai26Alexandr Wang(Meta 首席 AI 官)对 AI 最大的恐惧 “如果说有什么让我对 AI 夜不能寐,大概就是这件事,也许是我最害怕的:我们在全球范围内部署智能体,然后它们的行为不符合我们的需要,但我们甚至没有注意到,因为我们太忙了或其他什么。” ---- 完整视频在“Cleo Abram”YouTube 频道,(链接在评论中)
Shaders 开源:200+ WebGPU 视觉特效封装为声明式组件,React/Vue/Svelte/Solid/原生 JS 共用一套 props邵猛@shao__meng67Shaders 宣布开源其 WebGPU 着色器特效组件库,提供 200+ 个视觉效果组件,支持 React / Vue / Svelte / Solid / 原生 JS 共用一个包和同一套 props,MIT 协议,可免费导出任意框架代码,GitHub 地址为 https://github.com/shader-effects-inc/shaders。
白宫AI主管谈AI安全与提速Rohan Paul@rohanpaul_ai43白宫AI主管Jay Clayton在CNBC表示:为了安全而放慢AI发展是本末倒置 “人们谈论平衡,就好像在说,好吧,为了安全我必须放慢速度。 实际上恰恰相反。你必须以促进安全的方式来开发技术。而这正是这里可以做到的。” ---- 完整视频见“CNBC Television”YouTube频道,(链接在评论中)
游戏、软件、硬件,一切终将开源?Oran Ge@oran_ge57Orange AI 发布 Next Token 播客第五期的转写文章,讨论 Opus 5.5 发布及 RSI 到来后对软件、硬件和游戏行业的冲击。文中举例 Opus 5.5 直接根据旧剧本写出可玩游戏、反编译塞尔达等老游戏进度加快、AI 重写 Photoshop 类软件规避起诉、Muse 通用固件让 ESP32 硬件变得 Agent Ready,并认为法律和生态尚未跟上,最终能留下的东西不多了。
Luma AI:Jon Erwin 用 AI 拍摩西Luma AI@LumaLabsAI33预算曾决定一个故事能在哪里拍成。 Jon Erwin 在曼哈顿海滩的一个舞台上拍出了《摩西》,用真实演员,加上 AI 把他们带入故事所需的任何世界。
Arena 解读对齐指数三大信号Arena@arena44今天在 @tbpn 上收听 @ml_angelopoulos 带来的另一期 Arena Alignment Index 解读
xAI 调侃 AI 安全测试新方案Elon Musk@elonmusk, xAI25很高兴宣布,所有超级智能组织现已共同同意 AI/SI 安全的终极方案: 把所有测试都搬到 Delta Airlines 的航班上进行,在那里上网是绝对不可能的!
Claude Managed Agents 自动化搭建指南:定时读取 Slack 与 GitHub 并发布更新Claude Devs@ClaudeDevs62一篇介绍如何用 Claude Managed Agents 搭建自动化的教程,示例为部署一个按计划读取 Slack 和 GitHub、具备凭证与记忆并发布更新的智能体。搭建可通过一条 Claude Code 命令完成,Max 和 Team 套餐中包含的 API credits 可用于该用途,原文链接 https://claude.dev/blog/building-effective-agent-automations/。
Thariq 开源用 Claude API 每日生成首页的 Chrome 扩展 ai-newtabThariq@trq21259Thariq 更正此前失误,将自己在用的 Chrome 扩展仓库设为公开,地址为 https://github.com/ThariqS/ai-newtab。该扩展每天根据他浏览的网站生成 AI 首页,替换 Chrome 的新标签页;作者此前提到 MAX 计划用户每月可获得 100 或 200(与套餐匹配)的 Claude API 额度,可用于构建个人 AI 工具。
Grok Bot 一键配置模拟掌机Elon Musk@elonmusk, xAI34把最难搞的问题交给 Grok @Bot
Grok Bot 能力升级并接入 XElon Musk@elonmusk, xAI32而 Grok @Bot 只会从这里变得更好 🚀 🚀 你完全可以打造一家全部由 Grok Bot 组成的公司!