DeepSeek 又炸场:Flash 装上眼睛还顺手免费开放 Files API,这次它想干嘛
胡新宇
Published on 2026-08-22
DeepSeek 把多模态视觉塞进 Flash 级别 + Files API 完全免费 + Harness v0.1.1 同步开放——三件事的真正看点不是又'炸场',是中型规格多模态的开发账本被一次性改了。

DeepSeek 又炸场:Flash 装上眼睛还顺手免费开放 Files API,这次它想干嘛
8 月 21 日上午,DeepSeek 把多模态视觉理解模型 DeepSeek-V4-Flash-Vision-Exp 推到了 API 平台。一句话定位:这是 Flash 系列第一次有"眼睛"——文本能力和 V4-Flash 正式版完全持平,多模态 Agent 表现直接逼近 Claude Opus-4.8(来源:DeepSeek 官方公众号"深度求索"2026-08-21 推送)。
但如果你只看到模型本身,那大概率漏了关键动作。同一批推送里还有两件事:Harness v0.1.1 开箱支持这个新模型;Files API 同步上线,且完全免费。三件事拼在一起,才是这次发布的真正信号——DeepSeek 想在 Flash 这种中等规格上把多模态 Agent 拼图补齐,并把"上传一次、多次引用"这种工程能力直接下沉到默认层。

Flash 不是"换了辆车",是"加了只眼睛"
新模型的命名已经讲清楚了:V4-Flash-Vision-Exp,底座是 V4-Flash,加 Vision 模块,标 Exp(实验性)。
关键不是参数怎么堆,而是能力坐标是怎么被重新画的:
- 纯文本能力(Agent、推理、世界知识)和 V4-Flash 正式版持平——不是"为了视觉牺牲文本",而是在 Flash 这一档内做了一次叠加。
- 多模态 Agent benchmark 大幅跃升,官方表述是"多模态 Agent 能力接近 Opus-4.8"——这是 Flash 这种中型规格级别第一次摸到那条线。
- 图片按 token 计费,单张图最多占 384 tokens——和 V4-Flash 同价,没有因为多模态而涨价。
DeepSeek 把模型上线的同时,把调用入口扩到了三个:Chat Completions、Messages、Responses。图片传入也给了三条路:base64 内联、外部 URL、Files API(来源:官方推送)。最后这条最值得多写两段。
Flash 级别做到接近 Opus-4.8 的多模态水平,才是这次的真正新闻。大模型卷了一年多,旗舰级的多模态早不是新鲜事;真正贵的是在中型规格上把多模态压到工程可用——这恰好是开发者每天都在调用的一档。
Files API 免费:免费的不是接口,是"带宽通胀"的反操作
Files API 的官方说明很短:"用户可先将图片上传到平台,再在请求中通过 file_id 引用,从而节省请求带宽。同一张图片在多个请求中无需重复上传。"
把它翻译成开发者语言:上传一次,拿到一个 file_id,之后每次请求直接报 ID 就好。
这个动作对小场景省不了几个钱。但只要你在做下面任何一种工作流,Files API 直接决定成本曲线:
- 多轮 Agent 对话:同一个截图要被模型看 5 轮、10 轮。base64 内联意味着每一轮都把整张图再传一遍,流量费按请求数累乘。Files API 把它压成"上传一次,后续每轮只带几十字节的 ID"。
- 可重放工具调用:PPT 生成、Harness 任务、Claude Code 这类 IDE 工具,常常需要反复"喂同一张参考图给模型"。复用 file_id 等于把工作流变成可重放。
- 批处理场景:用同一个 base image 生成几十种风格的衍生图,原来要传几十次图,现在传一次就够。
DeepSeek 在产品页把"省带宽"作为 Files API 的第一卖点,而不是"省存储"——这是一个带宽经济学判断。对一家把 Flash 级别模型做到接近 Opus-4.8 的厂商来说,多模态 Agent 最大的隐性成本不在算力,而在每次请求都要把图重新编一遍的多模态流量。Files API 免费上线,是把这条隐性成本从账单上抹掉。
