8月26日晚,阿里发布并同步开源千问最新模型Qwen3.8-Flash,训练成本较上一代Qwen3.7-Plus骤降近90%,推理价格每百万Tokens输入仅1元、输出3元。
据阿里千问团队披露,Qwen3.8-Flash是一款多模态混合专家(MoE)模型,采用下一代架构,Transformer总参数125B、每次仅激活6B,性能超越Anthropic的Claude Opus 4.6、接近Opus 4.8。在智能体编程评测SWE-bench Pro上,该模型领先Opus 4.6达9.1分;在专业工作任务评测JobBench上领先近20分;在移动端智能体评测AndroidWorld上高出22.5分;在视觉数学推理MathVision上高出25.1分;在具身智能ERQA任务上领先31.5分。
成本下降来自架构层面的革新。Qwen3.8-Flash引入QSA稀疏注意力机制,与GDN高效融合,同时加入Gated Residual方法以及51B规模的N-gram Embedding参数。阿里称,这套与此前所有千问大模型完全不同的全新架构,让模型仅用约九分之一的资源即可完成训练。
8月17日,DeepSeek的V4系列API启用峰谷分时计费;据机器之心援引第三方核算,V4 Flash闲时缓存未命中输入价格上涨约57%。OpenAI、谷歌和Anthropic此前也已相继上调API价格或收缩免费额度。相比之下,Qwen3.8-Flash的推理价格最低至DeepSeek-V4-Flash的三分之一、约为Claude Opus 4.6的3%。
Qwen3.8-Flash当晚首发上线“千问办公”,开发者和企业也可通过千问AI平台获取新模型API服务。
市场有风险,投资需谨慎。本文为AI基于第三方数据生成,仅供参考,不构成个人投资建议。
来源:市场资讯
上一篇:香港创新科技及工业局:“全民AI”普惠计划赋能企业升级 把握AI时代机遇
下一篇:同一个任务:最贵模型550美元,DeepSeek只要23美元 #AI #DeepSeek #大模型对比 #AI成本#人工智能