发生了什么
DeepSeek正式发布 V4-Flash。据Artificial Analysis测算,其价格为每百万输入Token 0.14美元、输出Token 0.28美元,完成一次综合基准测试的平均成本约3美分;其综合智能指数为50分,与Gemini 3.6 Flash相当,但低于GPT-5.6及Anthropic高端模型。
阿里同时公布 Qwen3.8-Max:总参数量2.4万亿,但采用混合专家架构,每次推理只激活约950亿参数,支持文本、图片、视频和最长100万Token上下文,预计下周正式发布。
为什么重要
模型市场正在形成更清晰的分层:
| 任务 | 更合理的选择 |
|---|---|
| 商品分类、标签、摘要 | 超低成本模型 |
| 客服意图识别、普通代码任务 | 中档模型 |
| 复杂架构、综合健康分析 | 前沿模型 |
| 敏感数据、高频稳定任务 | 本地或私有开放模型 |
单看Token单价仍不够。便宜模型若需要更多重试、工具调用和人工修正,最终任务成本可能反而更高。