阿里刚刚发布千问Qwen3.8-Max,参数规模直接干到 2.4 万亿
这次主打 Coding、办公 Agent、长周期任务和原生多模态。
按阿里公布的自测成绩:
TerminalBench 2.1 达到 86.6,仅次于 GPT-5.6 Sol 的 88.8;
PaperBench 93.0、ERQA 77.8、OSWorld 86.1,多项任务已经进入全球第一梯队。
更狠的是价格,每百万 Token:
Qwen3.8-Max:输入 $2,输出 $6
GPT-5.6 Sol:输入 $5,输出 $30
Claude Opus 5:输入 $5,输出 $25
DeepSeek V4-Pro:输入 $0.435,输出 $0.87
也就是说,Qwen 的输出价格只有 GPT Sol 的五分之一、Claude Opus 的四分之一左右。
京ICP备2024094994号-17
评论 (0)
还没有评论,来发第一条吧