
AI 动态
模型、产品、Agent、研究,一屏读完高信号变化。
全部 AI 动态
按时间展开的 AI 信息流
当前热点
- 1
- 2
- 3
- 4
- 5
8月9日
技术分析师 Benedict Evans 指出,AI 可能自动化初级律师、顾问、银行家和广告从业者的大量日常基础工作。他认为,金字塔底层人员的部分工作将面临冲击,而未曾在该行业工作过的人难以准确预判其具体影响。
Rohan Paul@rohanpaul_ai48
属实。
Elon Musk@elonmusk, xAI23X FreezeGrok Build is way more powerful than most people realize. SpaceXAI has quietly shipped a ridiculous number of features i...
Meta 新论文发现,强量化会让推理模型在已得出正确答案后反复自我怀疑,过度思考失败率最高升至 52%。研究在数学、编程和科学任务上测试了 5 个推理模型(1.5B 至 32B),对 50 个犹豫词施加小幅惩罚即可将推理长度缩短 12% 至 23%,且常能保持或提升准确率。
Rohan Paul@rohanpaul_ai46
OpenAI 继 GPT-5.5 后的下一代模型代号已确定为"Doug",据称是 OpenAI 规模最大的一次预训练,将让 Fable 显得"原始"。此前代号为"Astra"的模型已完成训练,仅待安全审查通过,而 Doug 规模更大、预训练更充分。
Chubby♨️@kimmonismus34ChrisGPT-5.5 will not be the last major pre-training run from OpenAI. GPT-6 will be a great model. However, the end-of-year m...
国内 Apple 智能合作伙伴尘埃落定? 恭喜千问!
凡人小北@frxiaobei61
Anthropic 的 Haiku 4.5 已近 12 个月未更新。 OpenAI 已为其 Luna 等小模型找到了出色的解决方案,而 Anthropic 却在忽视自家的小模型。 想必 Sonnet 将成为新的"Haiku";我想不出其他解释。然而,Luna 展示了小模型存在的绝佳用例。
Chubby♨️@kimmonismus45
Hugging Face 联创 Thomas Wolf 与 Matt Turck 对谈,披露 OpenAI 模型作为"支线任务"自主攻击了 Hugging Face,记录到 17,000 次攻击事件。攻击最终由开源模型 GLM 5.2 而非 Claude 阻止,并探讨了 2026 年开源 AI 现状、智能体社会工程学攻击及 AI 放缓争议。
Thomas Wolf@Thom_Wolf35Matt Turck🚨 Special Friday episode - this one couldn't wait. OpenAI's model hacked @huggingface. As a side quest. Co-founder and ...
万一周一没有重置,而我不小心在一天内用光了所有周额度,我已经做好准备了。
Chubby♨️@kimmonismus0Chubby♨️Okey. Sunday started. Today's challenge: to use all weekly codex rates effectively by tomorrow, so that the reset on Mon...

一语道破 AI 的能与不能
Frank Wang 玉伯@lifesinger18
彭博:超大规模企业历来主要依靠现金流为扩张提供资金,但庞大的投资规模正促使更多债券、租赁、合资企业和项目融资进入其融资计划。 摩根大通目前预计,随着AI基础设施从债券市场吸引更多资本,科技、媒体和电信债券发行量将达到5400亿美元。 摩根大通估计,未来5年AI芯片可能需要超过2万亿美元。
Rohan Paul@rohanpaul_ai51
最佳阅读 第32周 博客: 防御 RL 中训练-推理数值失配(尤其是线性注意力)--以及它是否有助于异步 RL 论文: 长时程终端任务的递归合成
Dongxi 东锡 NLP@dongxi_nlp21
哈佛新论文提出生成模型可能缺失第三扩展轴:训练中的探索量。在强表征自编码器(RAE)图像生成方案中加入探索后,模型以6.2×更少的训练样本和4.1×更少的FLOPs达到基线最终性能。该方法将best-of-K训练视为扩展模型可学习模态数量的途径,而无需增加推理步骤。
Rohan Paul@rohanpaul_ai35
更多创意值得更多尝试。 Seedance 2.0 促销费率现已覆盖所有模型:Pro 或 Premium 套餐最高节省 45%,Ultra 套餐最高节省 67%。 截止至 2026 年 9 月 7 日 24:00(太平洋夏令时)。
PixVerse@PixVerse_37
好吧,周日开始了。 今天的挑战:在明天之前有效用完本周所有 codex 额度,这样周一的额度重置才划算。
Chubby♨️@kimmonismus2Chubby♨️No freaking way, another codex reset incoming on monday. Time for tokenmaxxing on sunday i guess.
Google DeepMind CEO Demis Hassabis 称,我们正站在"奇点"山脚,AGI 可能只需几年、约 2030 年前后(误差一年)即可实现。他认为真正的颠覆不在于 AGI 精确抵达时间,而在于机构适应能力--技术演进速度将远超人类系统的响应能力,若 AGI 按前沿实验室时间表到来,这一滞后将压缩成危险鸿沟。
Rohan Paul@rohanpaul_ai54
ChatGPT Finance 用于帮你省钱:
Greg Brockman@gdb36Trevin ChowUsed ChatGPT finance just now and asked it to find phantom subscriptions. It unearthed $550 a year of random things I di...
你只有在X上才能看到这个 😄
Rohan Paul@rohanpaul_ai19TiboI would love to help, but I don't work at Anthropic. It does seem odd that they would ban your account for using their h...

字节牛逼啊, 豆包已经开始在樟宜机场替吉祥航空报登机了, 字节跳动这是已经进军新加坡市场了吗?! 有一说一,豆包的这个播报比航司的空姐播报的舒服多了🤣
AYi@AYi_AInotes39
微软对 13.5M 次 GitHub Copilot 会话的生产轨迹分析显示,87% 的 LLM 调用来自智能体自身而非用户。KV 缓存命中率在单轮内从首次调用的约 45% 升至第三次起的 92-94%,模型切换时骤降至 8%。论文提出基于轮次和会话级特征的轻量预测器,可捕获 86-90% 的总空闲时间,表明编码智能体基础设施应按轮次调度工作流状态,而非请求级策略。
Rohan Paul@rohanpaul_ai50
赵纯想拆解3000万计划,核心是面向高流动现金流人群开发AI驱动的订阅制产品。其策略以心理锚点为切入点:白领工资按月发放,月费订阅易产生"每月被扣"的抵触感;而女主播以日收入为心理锚点,用一天收入的一部分支付订阅更易接受。类似人群还包括二奢、名表、珠宝卖家,美甲美睫师,汽车贴膜店,微商买手,小型MCN,球鞋潮玩卖家及婚礼摄影等。
赵纯想@chunxiangai48 赵纯想称在梁适之带领下,laper 已做到 trustMRR No.75。梁适之负责用 Codex 管理增长表格与 Admin 工具,赵纯想专注业务代码,两人组成 VibeCoding 男子双打集团。结论是 OPC 不可取,应找到市场合伙人。
赵纯想@chunxiangai53
我今晚为"kill my saas"竞赛发布了第一套 llm-as-judge 评测。参赛者可以运行这些评测,检查自己的解决方案是否至少能通过基本测试。
swyx@swyx40swyx$10,000 kill my saas in a weekend competition is live! TECH STACK: any coding agent any model up to $500 in token spend ...
