2026 年 8 月 21 日,DeepSeek 在 API 平台上线实验性视觉理解模型 deepseek-v4-flash-vision-exp,首次为 V4 系列补齐图片输入能力。该模型支持 JPEG、PNG、GIF、WebP 等图像格式输入,视觉 Agent 基准接近 Claude Opus 4.8 水平,文本能力与 V4-Flash 正式版持平。
图片按最多 384 Tokens 计费,无额外视觉附加费,价格与 V4-Flash 一致——约 1 分钱处理 9 张图,较同类便宜近 20 倍。同步推出的 Files API 允许开发者上传图片后通过 file_id 跨请求复用,DeepSeek Harness 同步更新以支持官方多模态。
同期,OpenAI 宣布未来三个月内将旗舰模型 GPT-5.6 Sol 的 API 与 Credit 价格下调超 20%:输入从 5 美元/百万 Token 降至 4 美元,输出从 30 美元降至 20 美元。谷歌 Gemini 3.7 Flash 也在 OpenRouter 上降价约 75%。头部模型密集降价使价格战担忧抬头。
OpenRouter 最新数据显示,全球 AI 大模型调用量前五名中除 GPT-5.6 Luna 外均为中国模型,前十名中有 6 家国产模型,分别是 DeepSeek-V4-Flash、Hy3、GLM-5.2、Mimo-V2.5 和 DeepSeek-V4-Pro。
智谱同期发布旗舰模型 GLM-5.3,使用与 GLM-5.2 相同的底座,通过更大规模后训练增强复杂编程和网络安全能力。在 CyberGym 漏洞识别基准得分 84.5% 居首,超越 Anthropic Mythos 5 和 GPT-5.6 Sol。智谱强调可能还远未开发出这个基座的智能上限。
【AICOR 点评】DeepSeek 补齐视觉能力后,V4 系列正式成为全模态模型,且价格优势极为突出——1 分钱处理 9 张图的成本结构,让多模态 Agent 的大规模部署变得经济可行。叠加 OpenAI 降价 20% 和 Gemini 降价 75%,全球大模型正在进入 Token 白菜价时代。当模型能力趋同、价格趋零,竞争焦点将从谁的模型更强转向谁的 Agent 编排更好——这正是 AICOR 流程治理框架的核心价值区间。
版权声明 本文由 AI 辅助整理,基于公开报道转写,信息版权归原作者及原媒体所有;内容仅作行业信息分享,不构成任何投资或商业建议。
如涉版权问题,请联系 AICOR(400-601-8080 / 微信 aicor-ai),我们将在收到通知后及时处理。