热点事件 历史事件

Alibaba Qwen 发布 Qwen3.8-Flash

5 篇报道4 个精选信源

事件全貌

AI 综述

通义千问发布 Qwen3.8-Flash,一款多模态 MoE 模型,也是 Qwen4 架构的早期预览,现已开放权重。该模型总参数量 125B,每 token 仅激活 6B,原生上下文 262K,可扩展至 1M。

训练成本仅为 Qwen3.7-Plus 的 1/9,并在编码和办公任务上表现更优。API 定价为每百万输入 token $0.16、输出 token $0.47。

该模型基于新架构构建,是 Qwen4 架构的前身,在 DeepSWE 1.1 和 SWE-bench Pro 上分别得分 58.7 和 62.5。

AI 汇总报道生成 · 20天前更新。单篇报道保留其发布时的原貌。

最新进展

最新情况详见事件全貌。

报道时间线

沿着报道,了解事件的不同侧面。

显示 5全部报道最新在前
  1. X:阿里云 / Alibaba Cloud (@alibaba_cloud)官方一手
    阿里云发布 Qwen3.8-Flash 多模态 MoE 模型

    阿里云发布 Qwen3.8-Flash,一款多模态 MoE 模型,为 Qwen4 架构的早期预览,现已开放权重。该模型拥有 125B 参数,每 token 仅激活 6B,训练成本仅为 Qwen3.7-Plus 的 1/9,性能全面超越后者。其 API 定价为每百万输入 token 0.16 美元、输出 0.47 美元,原生支持 262K 上下文,可扩展至 1M。

  2. X:通义千问 / Qwen (@Alibaba_Qwen)官方一手精选
    Qwen3.8-Flash 开源,Qwen4 架构预览

    通义千问发布 Qwen3.8-Flash,一款多模态 MoE 模型,作为 Qwen4 架构的早期预览并开放权重。该模型总参数 125B,每 token 仅激活 6B,训练成本仅为 Qwen3.7-Plus 的 1/9,性能全面超越后者。生产版 API 定价 $0.16/1M 输入 tokens 和 $0.47/1M 输出 tokens,原生上下文 262K,可扩展至 1M。

  3. X:Testing Catalog (@testingcatalog)
    阿里发布 Qwen3.8 Flash 多模态 MoE 模型

    阿里巴巴发布 Qwen3.8 Flash,一款 125B 参数的多模态 MoE 模型,原生支持 262K 上下文,可通过 YaRN 扩展至 1M。API 定价为每百万输入 token $0.16、输出 token $0.47。该模型基于新架构构建,是 Qwen4 架构的前身,在 DeepSWE 1.1 和 SWE-bench Pro 上分别得分 58.7 和 62.5。

  4. IT之家
    阿里通义 Qwen3.8-Flash 发布开源:125B 参数 MoE 模型,训练成本仅为前代 1/9

    阿里通义千问团队发布 Qwen3.8-Flash,这是一款 125B 参数的多模态 MoE 模型,每 token 激活 6B 参数,原生支持 262,144 tokens 上下文,并可通过 YaRN 扩展至 1M tokens。

  5. X:通义千问 / Qwen (@Alibaba_Qwen)官方一手
    通义千问发布 Qwen3.8-Flash,多模态 MoE 模型,Qwen4 架构早期预览

    通义千问发布 Qwen3.8-Flash,一款多模态 MoE 模型,也是 Qwen4 架构的早期预览,现已开放权重。该模型总参数量 125B,每 token 仅激活 6B,原生上下文 262K,可扩展至 1M;训练成本仅为 Qwen3.7-Plus 的 1/9,并在编码和办公任务上表现更优。