|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
卡城新闻 加国新闻 即时新闻 娱乐八卦
最新科技 读者文摘 养生保健 美食饮品
居家生活 移民茶馆 艺术中心 风筝专辑 房屋租赁 求职招聘 便民广告 定居指南 城市介绍 房产动态 留学移民 华人故事 教育话题 财经信息 精华旅游 难得一笑 |
|
|
|
|
|
|
|
|
|
|
|
|
|
|
卡城新闻 加国新闻 即时新闻 娱乐八卦 最新科技 读者文摘 养生保健 美食饮品 居家生活 移民茶馆 艺术中心 风筝专辑 房屋租赁 求职招聘 便民广告 定居指南 城市介绍 房产动态 留学移民 华人故事 教育话题 财经信息 精华旅游 难得一笑 |
| 最新科技 |
 卡城华人网信息中心![]()  最新科技
     ![]()  中国AI性能逼近美国,DeepSeek成本创新低
|
|
【卡城华人网 www.calgarychina.ca】  2026-08-12 10:52   免责声明: 本消息未经核实,不代表网站的立场、观点,如有侵权,请联系删除。 |
|
中国开源AI 模型不只性能逼近美国顶尖模型,DeepSeek 还拿下最低任务成本纪录
中国人工智慧模型正快速缩小与OpenAI、Anthropic 等尖端系统的性能差距,同时企业最在意的「单任务成本」持续领先。独立AI 评测网站Artificial Analysis(AA)最新分析显示,截至8 月7 日,DeepSeek V4 Flash 前20 大模型以每项任务仅3 美分成本,取得最低成本表现。
AA 评估指出,近来多款中国模型不再只靠低价竞争,开始进入高阶模型之列。月之暗面(Moonshot AI)的Kimi K3 与阿里巴巴的Qwen 3.8 Max,都跻身AA 综合智慧指数前十名;若扩大到前20 名,7 月底公开的DeepSeek-V4 Flash 也名列其中。这些模型多属开放权重架构,并在性能与成本之间展现更强平衡性。 AA 的综合智慧指数,DeepSeek-V4 Flash(最大推理模式)拿下52 分,与OpenAI GPT-5.6 Luna(max 模式)相同,但任务成本仅3 美分,低于后者5 美分。更关键的是,两者回应速度差距明显:DeepSeek 首字回应时间为1.17 秒、点到点回应时间为19.49 秒;GPT-5.6 Luna(max)光首字回应就超过135 秒,代表使用者必须等更久才会看到第一个字。 AA 也强调,对企业而言,真正重要的不是单纯的每token 价格,而是完成一项任务的总成本。 AI 逐步导入代理式工作流程与推理密集型任务,token 计价往往无法反映实际支出,因为模型可能悄悄消耗大量推理token,或因回答冗长拉高成本。 Uber 与亚马逊近期成本暴表案例,突显AI 预算可能因使用量暴增而迅速失控。 更高阶模型区间,AA 显示Claude Opus 5 以63 分居首,但单任务成本达2.34 美元,为评测第二高;Claude Fable 5 以3.14 美元成最昂贵模型。开放权重模型方面,Kimi K3(max)以60 分居前,任务成本为84 美分,仅比Claude Opus 5 少3 分、比GPT-5.6 Sol 少1 分,显示中国模型逼近顶尖闭源模型水准。 阿里巴巴最新Qwen 3.8 Max 也成为焦点。这款拥有2.4 兆参数的模型AA 智慧指数拿下58 分,排名第十,验证阿里巴巴自称「历代最强Qwen」;不过任务成本为1.13 美元,仍高于同级部分竞品。最低成本区间,GPT-5.6 Luna(low 模式)、MiMo-V2.5 与Llama 4 Scout 都可将单任务成本压到1 美分,MiMo-V2.5 以37 分成为此价位带性价比最高选项。
AA 表示,智慧指数与任务成本评估是基于九项基准测试,涵盖程式、科学、长上下文推理与代理式任务等,更适合衡量企业实际工作负载,而非纯翻译、一般聊天或日常办公用途。 来源: TechNews 编辑(Edit)     删除(Delete) |
|
|
|
| 版权所有(C), 2002-2026, 卡城华人网中国版 www.calgarychina.ca |
| 版权所有(C), 2002-2026, 卡城华人网中国版 www.calgarychina.ca |