
据一家业内研究机构称,在针对全球知名人工智能(AI)模型的基准测试中,中国初创企业DeepSeek旗下旗舰人工智能模型的一个版本在运行成本上是最低的,其运行成本甚至比Anthropic公司Claude Fable 5模型便宜一百多倍。
据路透社援引知情人士报导称,DeepSeek正筹备潜在的首次公开募股(IPO)。该公司于周五正式发布了V4-Flash模型,这是其重拾发展势头的最新举措,延续了DeepSeek一贯的策略——即提供超低成本的人工智能替代方案。
DeepSeek的R1模型曾在2025年初引发全球轰动,导致全球科技股遭到抛售,并引发了外界对于美企在人工智能领域巨额投入的质疑。
据研究机构人工分析(Artificial Analysis)称,DeepSeek的V4-Flash收费标准为:输入Token每百万个0.14美元,输出Token每百万个0.28美元。所谓Token是衡量人工智能使用量的数据单位。
总部位于旧金山的人工分析估算,V4-Flash模型完成单次测试的平均成本为3美分;相比之下,竞争对手月之暗面(Moonshot AI)的Kimi K3模型的成本为86美分,OpenAI的GPT-5.6 Sol模型的成本为1.86美元,Claude Fable 5模型的成本则为3.15美元。
报导指,这种比较方式比单纯看单价更能真实地衡量价值,因为它考量了一个模型为完成任务所需处理和生成的数据量。如果某个模型需要更多步骤才能给出答案,即便其标价较低,最终成本仍可能很高。
DeepSeek曾一度占据有关中国人工智能发展报道的头条,但很快便面临众多本土竞争对手的围攻——这些对手既包括月之暗面、稀宇科技(MiniMax )和智谱 AI等初创企业,也包括字节跳动和阿里巴巴等科技巨头。这些中企正与美国科技公司争夺全球市场份额,目标客户是那些寻求以更低成本大规模部署人工智能技术的企业。
人工分析指出,DeepSeek的V4-Flash模型在其“智能指数”(Intelligence Index)中获得了50分——满分100分;该指数综合了涵盖编程、推理及职场类任务等九项基准测试的结果。这一得分与谷歌的Gemini 3.6 Flash模型持平,但比脸书母公司Meta的Muse Spark 1.1模型以及智谱 AI的 GLM-5.2模型低1分。
相比之下,月之暗面的Kimi K3模型得分为57分,而Anthropic的Claude Opus 5模型、Fable 5模型以及OpenAI的GPT-5.6模型的得分则高出9分或更多。据了解,DeepSeek也在筹备一款性能更强大的模型版本,即V4-Pro,但尚未公布该版本的正式发布日期。
此外,阿里巴巴于周一发布了迄今为止其规模最大、能力最强的人工智能模型Qwen3.8-Max;就规模而言,该模型与国内竞争对手月之暗面于上月发布的产品相比,差距并不大。
Qwen3.8-Max拥有2.4 万亿个参数——即模型从数据中学习并用于识别模式、生成回答及执行任务的数值设置。相比之下,月之暗面的Kimi K3拥有2.8 万亿个参数。参数数量多并不意味着模型一定更出色,但这一指标已成为衡量先进人工智能系统背后算力与数据规模的一个备受关注的尺度。
中国科技公司热衷于公布参数规模,以帮助其模型在开发者群体中获得关注。这些模型通常采用开放权重模式,即允许开发者运行或适配系统的底层学习参数,这些参数可供下载。相比之下,OpenAI、Anthropic和谷歌则不会公布其闭源模型的参数规模。
Qwen3.8-Max在众包模型评测平台Arena.AI上亮相,随即成为排名最高的中文文本模型,尽管其表现仍落后于Anthropic旗下的Claude Fable 5及其三个Opus变体版本。
不过,在Arena.AI平台针对图像及其他视觉素材分析能力的人工智能模型排行榜上,Qwen3.8-Max位居全球第二,仅次于Claude Fable 5模型的一个变体版本。Qwen3.8-Max和Kimi K3均具备处理文本、图像和视频的能力,且单次处理的Token数量可达100万。
阿里巴巴称,其模型采用了“混合专家”(Mixture-of-Experts)架构设计;该设计将任务分配给系统中的特定专业模块来处理,而非针对每次请求都启动整个模型。每次运行仅调用950亿个参数,从而降低了成本并缩短了响应延迟。
阿里巴巴称,该模型在16天内完成了一个软件工程项目。Qwen3.8-Max模型预计将于下周通过阿里云的百炼平台发布。