DeepSeek V4.1 Flash 得分 81.2,GPT-6 Astra 成本 1.4%

By: decrypt.co|2026/09/10 21:16:03

OpenDesign 对 13 个 AI 模型进行了设计任务测试,其中 OpenAI 的 GPT-6 Astra 得分最高,达到 82.7 分。DeepSeek 的 V4.1 Flash 得分为 81.2 分,完成任务的时间为 5.3 分钟,成本为 0.023美元。GPT-6 Astra 则花费 11.1 分钟,成本为 1.61美元。其他模型如 Claude Fable 5.1 得分 80.3 分,耗时 12.8 分钟,成本为 3.66美元。DeepSeek 的模型使用了 5520 亿个参数,但仅激活 80 亿个用于提示,160 亿个用于响应,从而提高了效率。这并不是 DeepSeek 第一个具有成本效益的模型;其 V4 Pro 之前的得分在 Claude Fable 5 的 5% 以内,但成本更低。OpenDesign 的测试重点在于可靠的设计输出,而非一般推理。GPT-6 Astra 于 9 月 3 日发布,以其多功能性而闻名,但速度较慢且成本高于 DeepSeek 的模型。V4.1 Flash 的交付率为 57.7%,GPT-6 Astra 为 60%,Claude Fable 5.1 为 56.7%。

本内容仅供参考,不构成任何金融、投资、法律或税务建议。文中提及的任何活动、奖励、线上活动或相关信息,不应被视为对购买、出售或交易任何加密资产的推荐、招揽或邀请。加密资产具有高波动性,存在价值损失风险。WEEX服务、产品及相关活动的可用性可能因地区而异。用户在参与前有责任确保符合当地适用法律法规。

猜你喜欢

iconiconiconiconiconicon
客户服务:@weikecs
商务合作:@weikecs
量化做市商合作:bd@weex.com