行业观察

DeepSeek 发布 V4-Flash-Vision-Exp,首次补齐视觉理解能力

Publicado 2026-08-25 Autor Fuente 东方财富 · https://data.eastmoney.com/report/zw_industry.jshtml?encodeUrl=C1UUbb8YVqY3vdajVLuUWblgfgMskhNelhcADqOjhn8= · 2026-08-21 Etiquetas Organización Nativa IA / Auto-Caso / Lanzamiento
DeepSeek 上线实验性视觉理解模型,支持多种图片格式输入,视觉 Agent 基准接近 Claude Opus 4.8,图片计费无附加费。

2026 年 8 月 21 日,DeepSeek 在 API 平台上线实验性视觉理解模型 deepseek-v4-flash-vision-exp,首次为 V4 系列补齐图片输入能力。该模型支持 JPEG、PNG、GIF、WebP 等图像格式输入,视觉 Agent 基准接近 Claude Opus 4.8 水平,文本能力与 V4-Flash 正式版持平。

图片按最多 384 Tokens 计费,无额外视觉附加费,价格与 V4-Flash 一致——约 1 分钱处理 9 张图,较同类便宜近 20 倍。同步推出的 Files API 允许开发者上传图片后通过 file_id 跨请求复用,DeepSeek Harness 同步更新以支持官方多模态。

同期,OpenAI 宣布未来三个月内将旗舰模型 GPT-5.6 Sol 的 API 与 Credit 价格下调超 20%:输入从 5 美元/百万 Token 降至 4 美元,输出从 30 美元降至 20 美元。谷歌 Gemini 3.7 Flash 也在 OpenRouter 上降价约 75%。头部模型密集降价使价格战担忧抬头。

OpenRouter 最新数据显示,全球 AI 大模型调用量前五名中除 GPT-5.6 Luna 外均为中国模型,前十名中有 6 家国产模型,分别是 DeepSeek-V4-Flash、Hy3、GLM-5.2、Mimo-V2.5 和 DeepSeek-V4-Pro。

智谱同期发布旗舰模型 GLM-5.3,使用与 GLM-5.2 相同的底座,通过更大规模后训练增强复杂编程和网络安全能力。在 CyberGym 漏洞识别基准得分 84.5% 居首,超越 Anthropic Mythos 5 和 GPT-5.6 Sol。智谱强调可能还远未开发出这个基座的智能上限。

【AICOR 点评】DeepSeek 补齐视觉能力后,V4 系列正式成为全模态模型,且价格优势极为突出——1 分钱处理 9 张图的成本结构,让多模态 Agent 的大规模部署变得经济可行。叠加 OpenAI 降价 20% 和 Gemini 降价 75%,全球大模型正在进入 Token 白菜价时代。当模型能力趋同、价格趋零,竞争焦点将从谁的模型更强转向谁的 Agent 编排更好——这正是 AICOR 流程治理框架的核心价值区间。

Aviso de Copyright Este artículo está asistido por IA, reescrito a partir de reportajes públicos. El copyright de la información pertenece a los autores y medios originales; el contenido es solo para compartir información del sector y no constituye asesoramiento de inversión ni comercial.

Por cuestiones de copyright, contacte a AICOR (400-601-8080 / WeChat: aicor-ai); lo gestionaremos con prontitud al recibir la notificación.

← Volver a Noticias