有报道说,9月份,DeepSeek、阿里巴巴、腾讯、小米等中国主要10家人工智能企业共推出了16个新开发的模型;这个统计包括图像和语音生成模型,不包括在别家模型基础上改良的产品。美国Anthropic公司首席执行官达里奥·阿莫代伊(Dario Amodei)日前呼吁放慢人工智能研发脚步,以便更深入地了解风险。
中国企业的重点是参数规模较小、价格低、更灵活的轻量版模型:DeepSeek在9月发布了最新模型DeepSeek-V4.1-Flash,智谱和MiniMax也推出了轻量版。受影响的是使用人工智能的企业和开发者:智能体处理的Token数量多,市场对低价模型的需求旺盛,而按美国调查公司Artificial Analysis的数据,完成相同任务时,Anthropic最先进模型的成本约为DeepSeek和小米新模型的20到50倍。这家公司的数据也显示,在先进模型的性能比较中,美国企业仍然领先;中美性能差距在缩小,价格差距却在扩大。
中国企业也在做更大的模型:阿里巴巴9月22日在云栖大会上公布,计划研发参数规模5万亿至10万亿级的新模型,还计划到2032年把阿里云数据中心扩大到20吉瓦以上;阿里巴巴8月发布的旗舰模型参数约为2.4万亿。科大讯飞和中国电信9月推出的模型,训练和推理都用了中国国产芯片,华为也在加快推出人工智能芯片。阿莫代伊说,中国在人工智能领域领先会构成重大的国家安全风险,呼吁除了限制先进芯片出口,还要打击非法“蒸馏”美国人工智能的行为;日本国立情报学研究所教授佐藤一郎则认为,中国重视用人工智能推动产业和科学发展,不会放缓开发步伐。
茉莉花观察
这一节是茉莉花的看法,依据是上文的事实。
我们的分析中国模型拼的是价格和数量,不是最高性能。按AI评测网站BenchLM的统计,中国8家主要企业推出的大语言模型从今年第一季度的2个、第二季度的17个,增加到第三季度的20个;同样的任务,Anthropic最先进的模型却要贵20到50倍。
数据:AI评测网站BenchLM的统计,2026年
不同看法美国企业1至9月共推出59个模型,比中国多50%,先进模型的性能也仍然领先。我们同意美国在总数和顶尖性能上仍领先;但按单月算,中国已经多次超过美国,而智能体用量越大,价格差距就越要紧。
我们的预判阿里巴巴的超大模型计划多快兑现。我们判断,到2026年12月31日,阿里巴巴不会正式发布参数规模达到5万亿的千问模型。阿里巴巴8月的旗舰模型约2.4万亿参数,9月才公布5万亿至10万亿级的研发计划,同时推出的还有新一代芯片和到2032年的数据中心扩建计划。Anthropic的首席执行官呼吁放慢脚步,中国企业9月却推出了16个新模型,主打的是低价、轻量的模型。
综合联合新闻网、新华社、路透社报道



