Newsgather
Atrás阿里巴巴发布“通义千问3.8-Max”AI模型,DeepSeek续打低价战
阿里巴巴发布“通义千问3.8-Max”AI模型,DeepSeek续打低价战
En desarrollo
德国之声hace 1 horaTecnología7 min de lecturaChina

阿里巴巴发布“通义千问3.8-Max”AI模型,DeepSeek续打低价战

En resumen

阿里巴巴发布了其最强大的AI模型“通义千问3.8-Max”,拥有2.4兆参数,在AI排行榜上表现突出,带动股价上涨。同时,中国AI新创DeepSeek发布V4-Flash模型,延续低成本策略,引发市场关注。中国企业正积极押注“开放权重”模型以吸引全球开发者。

Resumen generado por IA

Por qué importa

中国科技巨头阿里巴巴发布了其功能最强大的人工智能模型“通义千问3.8-Max”,同时中国AI新创DeepSeek也发布了低成本模型V4-Flash,显示美中AI竞争持续。

Tamaño de fuente

中国科技巨头阿里巴巴週一(8月3日)发布了旗下功能最强大的人工智能模型“通义千问3.8-Max”( Qwen3.8-Max),随后迅速登上多个AI模型能力排行榜前列,也带动该公司在香港的股票上涨7%。

该模型拥有2.4兆个参数,参数是模型从资料中学习得来的数值设定,用于辨识模式、生成答案并执行各项任务。

路透社报道称,“通义千问3.8-Max”的规模已接近中国竞争对手“月之暗面”(Moonshot AI)上个月推出、拥有2.8兆个参数的AI模型Kimi K3。

盡管参数数量增加并不一定代表模型更优秀,但参数规模已成为衡量先进AI系统背后运算能力与资料规模的重要指标。

“通义千问3.8-Max”週一在在线AI模型评测与盲测平台“Arena.AI”上亮相,随后迅速成为该平台文字模型排行榜中排名最高的中国模型,但仍落后于美国人工智能新创企业Anthropic的Claude Fable 5以及三个Opus版本模型。

在用于分析图片及其他视觉内容的视觉能力排行榜中,“通义千问3.8-Max”位居全球第二,仅次于Claude Fable 5的一个版本。

路透社指出,“通义千问3.8-Max”与Kimi K3均可同时处理文字、图片与影片,并1次处理最高达100万个“词元”(Token)。词元数量越大,代表模型能1次读取的资讯越多。

阿里巴巴表示,Qwen3.8-Max采用了“混合专家模型”(Mixture-of-Experts,MoE)架构,透过将工作分配给不同的专业模组,而非每次都启动整个模型来完成运算。因此,模型虽然总共有2.4兆个参数,但每次运行实际只启用约950亿个参数,从而降低运算成本与回应延迟。

阿里巴巴指出,“通义千问3.8-Max”预计下週透过“阿里云”(Alibaba Cloud)的“Model Studio”平台正式发布,并称该模型曾在16天内完成1项软件工程专案。

DeepSeek续打低价战

随著美中AI战场持续,中国AI新创“深度求索”(DeepSeek)在上週五(7月31日)发布的新模型V4-Flash也持续采用低成本战略。

研究机构Artificial Analysis评估显示,V4-Flash当前是全球知名AI模型中,运行成本最低的模型之一,而且远低于多数竞争产品。

路透社引述知情人士说法指,DeepSeek正在为首次公开募股(IPO)做准备。该公司于2025年初推出的R1与V3模型曾引发全球轰动,不仅造成美国科技股遭到抛售,也引发外界对美国企业在AI领域是否非得投入巨额资金的讨论。

Artificial Analysis数据显示,V4-Flash每100万个输入词元收费0.14美元,每100万个输出词元收费0.28美元。

该平台估算,V4-Flash完成每项基准测试的平均成本约为0.03美元;月之暗面的Kimi K3为0.86美元,OpenAI的GPT-5.6 Sol为1.86美元,Anthropic的Claude Fable 5则为3.15美元。

研究机构指出,单看定价未必能反映模型的实际价值。由于完成任务所需处理的资料量与运算步骤存在差异,即便有些模型看似价格较低,但若需要更多运算才能产生结果,最终成本反而可能更高。

中国企业押注 “开放权重”

值得注意的是,不论是阿里巴巴的“通义千问3.8-Max”与还是DeepSeek的V4-Flash,都反映出中国企业持续著重于“开放权重”(open-weight)模型,希望藉此吸引更多全球开发者使用其技术。

研究机构Omdia首席分析师苏连杰(Lian Jye Su)表示:“中国AI企业已找到一个重要市场”,并指出许多企业的应用场景实际上并不需要业界最顶尖的模型,而是“性能够、价格合理、透明且容易取得的模型,而开放权重模型正好能满足这类需求。”

“开放权重”模型指的是,开发者可以下载模型的核心参数,并自行调整模型。相较之下,OpenAI、Anthropic及Google采用的则是封闭式模型。

Qué observar

Perspectiva de IA — posibilidades, no hechos

  • 阿里巴巴的“通义千问3.8-Max”预计下週透过“阿里云”的“Model Studio”平台正式发布。

    Muy probable · En semanas

  • DeepSeek正在为首次公开募股(IPO)做准备。

    Probable · En meses

Preguntas abiertas

  • DeepSeek IPO的具体时间表和估值如何?
  • 开放权重模型策略能否真正帮助中国企业在全球AI市场取得更大份额?

Temas relacionados

This article was originally published by 德国之声.

Noticias relacionadas

Más sobre este tema阿里巴巴