AI Signals · AI 动态

AI 动态

模型、产品、Agent、研究,一屏读完高信号变化。

Selected Signals15 条Asia/Shanghai
Timeline

精选

高信号更新流

AI for Science
SELECTED15 条
HOT SIGNALS

当前热点

多信源热度 · 随时间消退
  1. 16 个信源同时报道1天前
  2. 24 个信源同时报道12小时前
  3. 33 个信源同时报道1天前
  4. 42 个信源同时报道18小时前
  5. 52 个信源同时报道1天前

8月7日

8月6日

8月5日

  1. 字节 Seed:Research Feed(网页内嵌数据)
    精选78
    字节 Seed 发布 SeedRealtime 音视频全双工大模型,走向全模态自然交互

    字节 Seed 发布 SeedRealtime,用统一架构原生融合音频、视频与文本,实现"边看、边听、边说"的实时交互。相比级联模型,其音视频对话节奏问题减少一半,并已在豆包 App 全量上线,率先实现音视频全双工技术的规模化落地。

    • 模型
  2. Qwen@Alibaba_Qwen
    精选68
    Qwen-Image-3.0-Pro 上线 Qwen Cloud

    阿里通义千问发布 Qwen-Image-3.0-Pro 与 Standard,现已在 Qwen Cloud 上线。该模型在 Arena 文生图榜单中位列中国模型第一、主流模型第二,支持 4.5k-token 提示词、10px 级文字渲染及 12 种语言。Pro 版起价 $0.04/张,Standard 版起价 $0.03/张。

    Qwen Cloud

    🔔 Qwen-Image-3.0 is now live on Qwen Cloud! Ranked #1 among Chinese models and #2 among mainstream models in Arena. ai'...

    • 模型
  3. OpenRouter@OpenRouter
    精选66
    OpenRouter 上线 FLUX 3 Video 统一多模态模型

    @bfl_ai 的 FLUX 3 Video 现已在 OpenRouter 上向所有人开放。 一个统一的视频、音频、图像和动作预测多模态模型家族。严肃、有趣、创意、真实、电影感,随你所需。基于统一架构联合训练。

    • 模型

8月4日

  1. SenseTime@SenseTime_AI
    精选67
    商汤 SenseNova U1 开源:统一推理与图像生成

    商汤发布开源模型 SenseNova U1,可在统一流程中同时进行推理与图像生成。其信息图模式可将单条提示词转为结构化幻灯片,交错模式则逐步生成图文内容,如演示六步画龙教程。模型已上线 SenseNova Studio、HuggingFace 及 GitHub。

    • 模型
  2. 公众号:腾讯混元
    精选65
    腾讯混元发布 Hy ASR 3.0 preview:真正懂上下文的语音识别

    腾讯混元发布新一代语音识别模型 Hy ASR 3.0 preview,基于大语言模型 Hy3 与 MoE 架构,融合高精度识别与语义理解。其在开源评测集中中文普通话 WER 3.34%、英语 WER 2.62%、粤语 WER 3.12%,并支持上下文纠错、热词注入及高噪耳语等场景。该模型已上线腾讯云 API,元宝 App 首发并免费开放。

    • 模型

8月3日

  1. HuggingFace Daily Papers(社区热门论文)
    精选74
    UEmbed:统一稀疏与稠密的多模态嵌入模型

    UEmbed 是一种仅解码器的多模态嵌入模型,可在单次因果前向传播中同时生成稀疏词级和稠密表示,通过可学习特殊 token 与词汇表分区突破单 token 信息瓶颈。

    • 模型
  2. SenseTime@SenseTime_AI
    精选68
    商汤发布 SenseNova U1.5-Lite-Preview 开源模型

    商汤推出 SenseNova U1.5-Lite-Preview,一个基于 NEO-Unify 架构的轻量级原生统一多模态模型,仅 8B-MoT 参数即可达到商业闭源模型的生成与编辑质量。

    • 模型