Liquid AI 于 10 月 7 日发布博文,推出开放权重决策模型 d1-3B(31.2 亿参数,支持文本与图像输入)和 d1-omni-600M(5.87 亿参数,支持文本、图像及语音输入),已在 Hugging Face 公开,可下载、微调并部署。
AI 动态
模型、产品、Agent、研究,一屏读完高信号变化。
全部 AI 动态
按时间展开的 AI 信息流
当前热点
- 1
- 2
- 3
- 4
- 5
10月9日
Liquid AI 开源 d1 系列决策模型:d1-3B 单次判断仅 8 毫秒,支持图像输入IT之家·人工智能56 JetBrains 编程 AI 模型 Mellum2.1 发布:高负载推理吞吐量近 Qwen3.5-9B 两倍IT之家·人工智能50JetBrains 发布编程 AI 模型 Mellum2.1,延续 Mellum2 的 12B 混合专家架构、2.5B 活跃参数,仍以 Apache 2.0 许可证开源,重点增强智能体编程能力。
阶跃星辰 Step 5 Preview 现身 OpenRouter,1M 上下文 MoE 模型Hacker News:AI 热帖38阶跃星辰的 Step 5 Preview 已在 OpenRouter 上线,这是一款 1M 上下文的 MoE 模型。该系列此前的 Step 3.7 Flash 采用 196B 参数语言主干加视觉编码器,每 token 激活约 11B 参数,支持 256K 上下文和 high/medium/low 可选推理等级,面向编程、智能体工作流与结构化输出。
JetBrains 发布 Mellum2.1:面向编码 Agent 的 12B MoE 开源模型MarkTechPost(RSS)62JetBrains 发布面向编码 Agent 的开源思考模型 Mellum2.1(checkpoint 为 Mellum2.1-12B-A2.5B-Thinking),总参数 12B、每 token 激活 2.5B,以 Apache 2.0 协议上架 Hugging Face。
10月8日
Artificial Analysis Cyber Index 引入 trusted-access 模型,GPT-6 Sol (Daybreak Blue) 登顶Artificial Analysis 完整文章(网页)51Artificial Analysis 将 Cyber Index 排行榜扩展至非公开访问的 trusted-access 模型,首个纳入的 GPT-6 Sol (Daybreak Blue, max) 目前登顶,仅可通过 OpenAI 的 Daybreak 项目使用。
Harvey LAB-AA v1.1 发布:为智能体法律工作加入幻觉检查Artificial Analysis 完整文章(网页)34Harvey LAB-AA v1.1 新增幻觉检查,将幻觉分为矛盾源材料、捏造源内容和无记录支持的具体断言三类,并区分重大与轻微,仅重大幻觉会触发 Hallucination-Gated All-Pass Rate 清零。
Understanding AI 解读新模型 Jev:只输出概率的新形态 AI 为何爆红Timothy B. Lee:Understanding AI(RSS)67TypeSafe AI 于 9 月 15 日发布的模型 Jev 走红,公告获近 4000 万浏览,一周内超 10 万人加入其 Discord,GitHub 上约 2000 个项目使用。
Perplexity 发布 pplx-embed-v2-late:0.6B 边缘模型与 9B 模型,MADQA 得分 92.4%MarkTechPost(RSS)48Perplexity 发布 ColBERT 式多模态嵌入模型 pplx-embed-v2-late,含 0.6B 与 9B 两个版本,9B 在 MADQA 上取得 92.4% 的最佳成绩,0.6B 则面向边缘设备与本地查询编码。
生数科技发布 Vidu Q4 Preview 视频生成模型预览版,支持 3 段参考音频与 2K/4K 输出公众号:生数科技(Vidu·视频)60生数科技发布全新视频生成旗舰模型 Vidu Q4 的预览版 Vidu Q4 Preview,主打人物演技、镜头语言与特效表现力。新版本最多支持 3 段参考音频和 15 张参考图,支持 2K、4K 输出与 10bit 色深,首发优惠价 0.09 元/秒起,官方称同样预算约 5 倍出片,并从 Day 1 起面向全球创作者开放。
PFN 发布 PLaMo 3 Translate 31B 翻译模型:日语翻译表现优于 GPT-6.1 SolIT之家·人工智能44日本企业 Preferred Networks 发布翻译模型 PLaMo 3 Translate 31B,完全由日本自主研发,训练数据中日语占比约 30%。该模型基于 PLaMo 3,支持语言从 2 种扩展至 53 种,并引入覆盖 15 种语言的在线会议翻译模式。
Anthropic 发布 Claude Haiku 5.5:1M 上下文,输入每百万 token 0.10 美元MarkTechPost(RSS)77Anthropic 发布 Claude Haiku 5.5,为目前最便宜最快的小模型,1M 上下文窗口、最高 128K 输出,10 万 token 以内输入每百万 0.10 美元、输出 0.50 美元,比 Haiku 4.5 低约 90%。
OpenAI 面向所有 ChatGPT 用户推出 GPT-6 系列模型和智能用户界面IT之家·人工智能76OpenAI 于 10 月 8 日宣布面向所有 ChatGPT 用户推出 GPT-6 系列模型和智能用户界面(Intelligent UI),ChatGPT 全球周活跃用户超过 12 亿,此前停留在 GPT-5.6 系列。
10月7日
Anthropic 发布 Claude Haiku 5.5,Artificial Analysis 评测得分 43Artificial Analysis 完整文章(网页)精选78Anthropic 发布 Claude Haiku 5.5,在 Artificial Analysis Intelligence Index 得 43 分,较上一代 Haiku 一年内提升 26 分,是首个支持 effort 设置与 adaptive thinking 的 Haiku 模型。