DeepSeek

DeepSeek

凤凰网科技讯 北京时间8月3日,据路透社报道,美国旧金山研究公司Artificial Analysis称,DeepSeek旗舰AI模型的一个版本,在全球知名模型基准测试中的运行成本是目前为止最低的,比Anthropic旗下Claude Fable 5的运行成本便宜逾100倍

DeepSeek在上周五正式发布了其最新模型V4-Flash,试图通过它最擅长的提供超低成本AI替代方案重新获得市场关注。知情人士此前称,DeepSeek正在筹备IPO。

Artificial Analysis称,DeepSeek的V4-Flash每百万输入token收费0.14美元,每百万输出token收费0.28美元。token是用于衡量AI使用量的数据单位。

该研究公司估计,V4-Flash每次测试的平均成本为3美分。相比之下,月之暗面的Kimi K3为86美分,OpenAI的GPT-5.6 Sol为1.86美元,Claude Fable 5为3.15美元。Claude Fable 5的测试成本大约是V4-Flash的105倍。

与单纯看定价相比,这种比较方式能更实际地衡量价值,因为它考虑了模型在完成任务所需处理和生成的数据量。一个标价看起来很低的模型,如果需要经过更多步骤才能给出答案,实际成本仍可能很高。

Artificial Analysis表示,DeepSeek的V4-Flash模型在其智能指数中得分为50分(满分100分)。该指数综合了涵盖编程、推理和职场类任务的九项基准测试结果。这一分数与谷歌的Gemini 3.6 Flash持平,比Meta的Muse Spark 1.1和智谱AI的GLM-5.2低1分。

不过,月之暗面的Kimi K3得分为57分,而Anthropic的Claude Opus 5、Fable 5以及OpenAI的GPT-5.6则高出9分或更多。

DeepSeek还在准备其模型的一个更强大版本,名为V4-Pro。该公司尚未公布该版本的正式发布时间。

另外,阿里巴巴在周一发布了其迄今为止规模最大、能力最强的AI模型:千问3.8-Max。与国内竞争对手月之暗面上月推出的产品相比,该模型在参数规模上并没有落后太多。(作者/箫雨)

更多一手新闻,欢迎下载凤凰新闻客户端订阅凤凰网科技。想看深度报道,请微信搜索“凤凰网科技”。

本文转自:凤凰网科技

原文地址: https://tech.ifeng.com/c/8vHzeQfj1Kf