OmniTools 8月27日消息,通义千问正式发布 Qwen3.8-Flash,一款作为 Qwen4 架构早期预览的多模态混合专家(MoE)模型,并同步开源模型权重。该模型总参数量为 125B,每 token 仅激活 6B 参数,训练成本约为 Qwen3.7-Plus 的 1/9,实测性能全面优于后者。
Qwen3.8-Flash 原生上下文长度为 262K,支持扩展至 1M。其生产版 API 定价为 0.16 美元/百万输入 tokens、0.47 美元/百万输出 tokens。
OmniTools 8月27日消息,通义千问正式发布 Qwen3.8-Flash,一款作为 Qwen4 架构早期预览的多模态混合专家(MoE)模型,并同步开源模型权重。该模型总参数量为 125B,每 token 仅激活 6B 参数,训练成本约为 Qwen3.7-Plus 的 1/9,实测性能全面优于后者。
Qwen3.8-Flash 原生上下文长度为 262K,支持扩展至 1M。其生产版 API 定价为 0.16 美元/百万输入 tokens、0.47 美元/百万输出 tokens。
从这条动态出发,继续查看相关分析、产品详情和同主题更新。
刚收录的 AI 工具,适合顺手发现可用产品。