‹返回
成本榜

成本榜(参考) · 二〇二六年九月榜

完成同一套测评(判律+写诗+互评三轨),各家模型的实际调用费用并不相同——差异主要来自思考文本的用量:同一道题,有的模型要想三倍长。此榜按「谁最省」排序,供性价比参考,不计入任何能力榜名次。

模型公司判律$互评$写诗$≈合计$指数占比
deepseek-v4-pro-0813深度求索2.143.561.937.631.03.5%
glm-5.3智谱6.101.670.498.261.13.8%
gemini-3.8-flashGoogle5.721.660.988.361.13.8%
claude-opus-5.5Anthropic4.133.362.8910.381.44.8%
muse-spark-1.2Meta7.803.181.1212.101.65.6%
doubao-seed-2.1字节≈17.40≈3.772.66≈23.833.111.0%
qwen3.8-max阿里18.944.201.9825.123.311.5%
grok-4.7xAI16.025.885.0626.963.512.4%
gpt-6-astraOpenAI12.4611.005.8529.313.813.5%
hunyuan-hy4-preview腾讯14.8310.326.2831.434.114.4%
kimi-k3月之暗面26.725.302.1934.214.515.7%

11 席合计约 $208.3。指数=合计费用/最省者(deepseek-v4-pro-0813=1.0);占比=占 11 席合计。

分轨成本排名

三轨各自从省到贵排一遍——判律轨对应格律榜、写诗轨对应诗才榜、互评轨对应诗评榜。三张图横轴各自独立、均自 0 起。

诗画榜成本(首期,参考)

诗画榜两轨各自排一遍:出图轨=该席画满 20 首画题的费用;评图轨=该评委评完 20 次「一诗一调用」(每次 7–8 幅画)的费用。本期出图合计 ≈$6.05、评图 ≈$23.5。

图像模型公司出图$单幅$
muse-imageMeta0.200.010
gpt-image-2.5-sunburstOpenAI0.670.033
mai-image-2.6微软0.810.041
grok-imagine-image-2.0xAI1.200.060
gemini-3.1-flash-imageGoogle1.350.067
qwen-image-3-pro阿里1.500.075
seedream-5-0-pro字节0(通道未计费)—
评委公司评图$单次$秒/次
deepseek-vision深度求索0.260.013143
glm-5v-turbo智谱0.660.033152
gemini-3.8-flashGoogle0.740.03767
qwen3.8-max阿里1.490.074234
doubao-seed-2.1字节≈1.50≈0.075443
claude-fable-5.1Anthropic8.220.411108
gpt-6-astraOpenAI10.610.530216

评图比出图贵得多:看图模型按输入图片计费,一次调用送 7–8 幅画;GPT-6 Astra 与 Fable 5.1 两席合计占评图费用八成。

怎么读这张表

口径