>>返回【卡城华人网】主页




卡城新闻   加国新闻   即时新闻   娱乐八卦    最新科技   读者文摘   养生保健   美食饮品    居家生活   移民茶馆   艺术中心   风筝专辑   
房屋租赁   求职招聘   便民广告   定居指南    城市介绍   房产动态   留学移民   华人故事    教育话题   财经信息   精华旅游   难得一笑   

>>返回【卡城华人网】主页





卡城新闻  加国新闻  即时新闻  娱乐八卦
最新科技  读者文摘  养生保健  美食饮品
居家生活  移民茶馆  艺术中心  风筝专辑
房屋租赁  求职招聘  便民广告  定居指南
城市介绍  房产动态  留学移民  华人故事
教育话题  财经信息  精华旅游  难得一笑

最新科技
 卡城华人网信息中心
 最新科技
     中国AI性能逼近美国,DeepSeek成本创新低

中国AI性能逼近美国,DeepSeek成本创新低

【卡城华人网 www.calgarychina.ca】  2026-08-12 10:52
  免责声明: 本消息未经核实,不代表网站的立场、观点,如有侵权,请联系删除。
【卡城华人网】中国AI性能逼近美国,DeepSeek成本创新低

中国开源AI 模型不只性能逼近美国顶尖模型,DeepSeek 还拿下最低任务成本纪录



中国人工智慧模型正快速缩小与OpenAI、Anthropic 等尖端系统的性能差距,同时企业最在意的「单任务成本」持续领先。独立AI 评测网站Artificial Analysis(AA)最新分析显示,截至8 月7 日,DeepSeek V4 Flash 前20 大模型以每项任务仅3 美分成本,取得最低成本表现。





AA 评估指出,近来多款中国模型不再只靠低价竞争,开始进入高阶模型之列。月之暗面(Moonshot AI)的Kimi K3 与阿里巴巴的Qwen 3.8 Max,都跻身AA 综合智慧指数前十名;若扩大到前20 名,7 月底公开的DeepSeek-V4 Flash 也名列其中。这些模型多属开放权重架构,并在性能与成本之间展现更强平衡性。

AA 的综合智慧指数,DeepSeek-V4 Flash(最大推理模式)拿下52 分,与OpenAI GPT-5.6 Luna(max 模式)相同,但任务成本仅3 美分,低于后者5 美分。更关键的是,两者回应速度差距明显:DeepSeek 首字回应时间为1.17 秒、点到点回应时间为19.49 秒;GPT-5.6 Luna(max)光首字回应就超过135 秒,代表使用者必须等更久才会看到第一个字。

AA 也强调,对企业而言,真正重要的不是单纯的每token 价格,而是完成一项任务的总成本。 AI 逐步导入代理式工作流程与推理密集型任务,token 计价往往无法反映实际支出,因为模型可能悄悄消耗大量推理token,或因回答冗长拉高成本。 Uber 与亚马逊近期成本暴表案例,突显AI 预算可能因使用量暴增而迅速失控。

更高阶模型区间,AA 显示Claude Opus 5 以63 分居首,但单任务成本达2.34 美元,为评测第二高;Claude Fable 5 以3.14 美元成最昂贵模型。开放权重模型方面,Kimi K3(max)以60 分居前,任务成本为84 美分,仅比Claude Opus 5 少3 分、比GPT-5.6 Sol 少1 分,显示中国模型逼近顶尖闭源模型水准。

阿里巴巴最新Qwen 3.8 Max 也成为焦点。这款拥有2.4 兆参数的模型AA 智慧指数拿下58 分,排名第十,验证阿里巴巴自称「历代最强Qwen」;不过任务成本为1.13 美元,仍高于同级部分竞品。最低成本区间,GPT-5.6 Luna(low 模式)、MiMo-V2.5 与Llama 4 Scout 都可将单任务成本压到1 美分,MiMo-V2.5 以37 分成为此价位带性价比最高选项。



AA 表示,智慧指数与任务成本评估是基于九项基准测试,涵盖程式、科学、长上下文推理与代理式任务等,更适合衡量企业实际工作负载,而非纯翻译、一般聊天或日常办公用途。

来源: TechNews

编辑(Edit)     删除(Delete)







>>返回【卡城华人网】主页




版权所有(C), 2002-2026, 卡城华人网中国版 www.calgarychina.ca

版权所有(C), 2002-2026, 卡城华人网中国版 www.calgarychina.ca