AI Signals · AI 动态

AI 动态

模型、产品、Agent、研究,一屏读完高信号变化。

All Signals40 条Asia/Shanghai
Timeline

全部 AI 动态

按时间展开的 AI 信息流

AI for Science
ALL SIGNALS40 条
HOT SIGNALS

当前热点

多信源热度 · 随时间消退
  1. 113 个信源同时报道11小时前
  2. 27 个信源同时报道4小时前
  3. 310 个信源同时报道1天前
  4. 45 个信源同时报道12小时前
  5. 57 个信源同时报道41分钟前

10月9日

  1. 马东锡 NLP@dongxi_nlp
    20
    马东锡NLP谈谷歌参访:Gemini 太拉但员工福利到位

    马东锡 NLP 称,拜访谷歌前因 Gemini 表现不佳而看低这家公司,进入谷歌后则被其对员工的关爱打动,认为福利安排细致且不计成本,午餐水准很高,据称中国办公室甚至能吃到整只甲鱼。他因此建议"牛马"应去谷歌这类公司上班,而不是去其他公司接受 PUA,并调侃 AGI 是否实现与个人无关,活得长短才与自己相关。

    • 技巧
  2. 公众号:卡尔的AI沃茨
    35
    用腾讯游戏游点灵搭游戏,我去了马栏山AI游戏训练营看大学生们的真实水平

    作者用腾讯游戏游点灵几句话搭出一个"给超级英雄盖楼"的跳跃策略小游戏并已公开,玩家只有9格泥土,需通过1层、5层、3层的楼高搭配让主角加速荡向终点。在游点灵·湖南马栏山集团AI游戏训练营现场,在读大学生做出的海鸥偷薯条、海岛硬核求生等游戏机制完善,游点灵自带4万多个游戏资产并支持可视化调参和二创。

    • 技巧
  3. indigo@indigox
    34
    AI 时代需求定义与设计描述仍然缺失

    AI 已能快速实现或复制功能,但如何定义需求、清晰描述设计依然缺失。随着功能定义层次上移、目标愈发抽象,中间环节将全部由智能体实现,最终只剩提出需求的人和检查结果的人,软件逻辑层变成模型输出的 token。

    • 技巧
  4. Fei-Fei Li@drfeifei, World Labs
    14
    李飞飞发问:机器时代谁来定义美

    我认识的每一位数学家朋友,都能从他们研究的数字、形状和自然现象中看到美。在机器时代,谁来定义美?🤔

    • 技巧
  5. Rohan Paul@rohanpaul_ai
    54
    Meta 首席 AI 官 Alexandr Wang 解释 Muse 智能体的安全虚拟机设计

    Meta 首席 AI 官 Alexandr Wang 介绍每个 Muse 智能体运行在独立的 secure VM 沙箱中,用户数据只存储在该隔离环境内。智能体对外发送信息时由单独的 sentinel 智能体检查并拦截信用卡号、社会安全号等敏感数据,且访问新网站需用户批准;未来还将推出加密的 confidential VM,目标是 WhatsApp 级别保障,但可能更慢。

    • 技巧
  6. Rohan Paul@rohanpaul_ai
    55
    开源 MCP 服务器 REA:用 AI 智能体逆向分析任意应用功能

    Rohan Paul 介绍了一个约 29k stars 的 GitHub 开源项目 REA(Reverse Engineer Anything),一个面向二进制、应用和运行时行为逆向工程的 MCP 服务器。无需应用源码即可让 AI 智能体调查某项功能,REA 将应用机器码转回可读代码,智能体阅读代码、解释功能原理、展示证据,并能为你的项目构建自己的实现版本。

    • 技巧
  7. 马东锡 NLP@dongxi_nlp
    13
    马东锡调侃 Tibo 与 Codex Reset

    我认为 Tibo @thsottiaux 就是 OpenAI 的雨宫阳平,他说的任何 codex 的新功能都不再重要了,大家就等那一句: Codex Reset “中华冷面开始供应了!”

    • 技巧
  8. indigo@indigox
    29
    郭宇谈 Agent 时代:软件为何会像牛奶一样便宜

    郭宇在 INDIGO TALK 中回顾:2015 年在字节初见神经网络产品,十年后在东京独自用 Agent 做出三十多个产品,随后陷入倦怠。节目从抖音意外胜出聊起,谈及 Vibe Coding 的决策负担、Agent OS、智能的五个层次,以及软件像牛奶一样便宜后真正要交付什么。

    • 技巧
  9. Ethan Mollick@emollick
    41
    Gemini 2.5 医疗建议质量比肩医生

    在急诊场景中,已过时的 Gemini 2.5 Pro 和 Gemini 2.5 Flash(无法访问患者病历)给出的建议,被其他医生评为与医生质量相当。未发现安全问题。 此后模型已显著提升。

    • 技巧
  10. indigo@indigox
    55
    INDIGO TALK EP52 对谈郭宇:当软件像牛奶一样便宜,我们还要交付什么

    indigo 与字节跳动前资深员工郭宇对谈,郭宇称一个人用 Agent 做出三十多个产品后陷入倦怠,因为 Vibe Coding 把整个团队的决策负担压到一人身上。对谈还讨论了 Agent OS、智能的五个层次、智能商品化会使软件像牛奶一样便宜,以及年轻人是否该把工作当作必选项。

    • 技巧
  11. Rohan Paul@rohanpaul_ai
    26
    Meta 首席 AI 官谈 AI 最大恐惧

    Alexandr Wang(Meta 首席 AI 官)对 AI 最大的恐惧 “如果说有什么让我对 AI 夜不能寐,大概就是这件事,也许是我最害怕的:我们在全球范围内部署智能体,然后它们的行为不符合我们的需要,但我们甚至没有注意到,因为我们太忙了或其他什么。” ---- 完整视频在“Cleo Abram”YouTube 频道,(链接在评论中)

    • 技巧
  12. IT之家·人工智能
    73
    陶哲轩批评 OpenAI 发布 719 篇 AI 数学证明:人类来不及理解和消化

    陶哲轩于 10 月 7 日在 mathstodon 发帖,批评 OpenAI 10 月公布 719 份 AI 数学解答(涵盖 372 个结果族)的做法,称这会把开放问题变成可批量消耗的资源。他不反对 AI 辅助研究,但反对把快速攻克著名难题当产品展示,指出约 42% 证明未经形式化处理、仅 10 份附推理链,未达到 AGMAI 建议的披露标准,并担心出现大量无人能消化的证明。

    • 技巧
  13. Rohan Paul@rohanpaul_ai
    43
    白宫AI主管谈AI安全与提速

    白宫AI主管Jay Clayton在CNBC表示:为了安全而放慢AI发展是本末倒置 “人们谈论平衡,就好像在说,好吧,为了安全我必须放慢速度。 实际上恰恰相反。你必须以促进安全的方式来开发技术。而这正是这里可以做到的。” ---- 完整视频见“CNBC Television”YouTube频道,(链接在评论中)

    • 技巧
  14. Oran Ge@oran_ge
    57
    游戏、软件、硬件,一切终将开源?

    Orange AI 发布 Next Token 播客第五期的转写文章,讨论 Opus 5.5 发布及 RSI 到来后对软件、硬件和游戏行业的冲击。文中举例 Opus 5.5 直接根据旧剧本写出可玩游戏、反编译塞尔达等老游戏进度加快、AI 重写 Photoshop 类软件规避起诉、Muse 通用固件让 ESP32 硬件变得 Agent Ready,并认为法律和生态尚未跟上,最终能留下的东西不多了。

    • 技巧
  15. Luma AI@LumaLabsAI
    33
    Luma AI:Jon Erwin 用 AI 拍摩西

    预算曾决定一个故事能在哪里拍成。 Jon Erwin 在曼哈顿海滩的一个舞台上拍出了《摩西》,用真实演员,加上 AI 把他们带入故事所需的任何世界。

    • 技巧
  16. Elon Musk@elonmusk, xAI
    25
    xAI 调侃 AI 安全测试新方案

    很高兴宣布,所有超级智能组织现已共同同意 AI/SI 安全的终极方案: 把所有测试都搬到 Delta Airlines 的航班上进行,在那里上网是绝对不可能的!

    • 技巧
  17. Claude Devs@ClaudeDevs
    62
    Claude Managed Agents 自动化搭建指南:定时读取 Slack 与 GitHub 并发布更新

    一篇介绍如何用 Claude Managed Agents 搭建自动化的教程,示例为部署一个按计划读取 Slack 和 GitHub、具备凭证与记忆并发布更新的智能体。搭建可通过一条 Claude Code 命令完成,Max 和 Team 套餐中包含的 API credits 可用于该用途,原文链接 https://claude.dev/blog/building-effective-agent-automations/。

    • 技巧
  18. Thariq@trq212
    59
    Thariq 开源用 Claude API 每日生成首页的 Chrome 扩展 ai-newtab

    Thariq 更正此前失误,将自己在用的 Chrome 扩展仓库设为公开,地址为 https://github.com/ThariqS/ai-newtab。该扩展每天根据他浏览的网站生成 AI 首页,替换 Chrome 的新标签页;作者此前提到 MAX 计划用户每月可获得 100 或 200(与套餐匹配)的 Claude API 额度,可用于构建个人 AI 工具。

    • 技巧
  19. Elon Musk@elonmusk, xAI
    32
    Grok Bot 能力升级并接入 X

    而 Grok @Bot 只会从这里变得更好 🚀 🚀 你完全可以打造一家全部由 Grok Bot 组成的公司!

    • 技巧
  20. MIT News(RSS)
    39
    MIT 报告作者 Sasha Rakhlin 谈 AI 时代学术界的最佳前行路径

    MIT 统计与数据科学中心主任 Sasha Rakhlin 撰文探讨 AI 如何改变学术界,重点聚焦研究生科研与培养。他指出,验证速度与可靠性决定学科被 AI 推进的快慢,数学领域已有模型达到国际数学奥林匹克金牌水平,并在一年后产出新研究结果。他建议院系重新界定学术贡献与评价标准,并建设共享 AI 科研基础设施,以保留实验室的隐性知识与失败经验。

    • 技巧
  21. NVIDIA Blog(RSS)
    34
    NVIDIA Omniverse 如何用 GPT-6 Astra 等前沿 AI 智能体把想法变成仿真应用

    NVIDIA 展示开发者如何用 GPT-6 Astra、Claude Fable 5 等前沿 AI 智能体配合 Omniverse 库构建仿真应用,覆盖人形机器人仓库控制、自动驾驶测试、数字孪生传感器校验等场景。其中 Robo Olympics 项目中 Unitree G1 人形机器人在 100 次仿真试验里有 64 次跨过单个栏架,另有智能体在约三天内从零创建两个数字孪生并改进两个已有孪生。

    • 技巧

10月8日

  1. Claude:Blog(网页)
    精选66
    Block 如何用 Claude Fable 编排数千个 pull request 的代码迁移

    Anthropic 发表对 Block AI capabilities 负责人 Bradley Axen 的访谈,介绍 Block 用 Claude Fable 5 编排大规模代码迁移:Fable 做数据模型、API 规格等高层设计,再调度数十个更小的 Opus 或 Sonnet 模型执行文件修改和测试,一次迁移可能合并上千个 pull request。

    • 技巧
  2. Hugging Face 官方团队博客
    精选72
    Hugging Face 工程师用 ML Intern 以约 103 美元自制 7 个小模型

    Hugging Face 工程师 yuvraj sharma 用 HuggingChat 的 ML Intern 模式在几天内做出 7 个模型,包括可在 CPU 运行、99.7% 有效输出的 0.8B 提示词重写器,以及将柑橘病害识别准确率从 14.9% 提升到 52.8% 的 Qwen3.5-2B 微调模型等,全部计算成本约 103 美元。

    • 技巧