3075
0
9264
超级版主
8 月 21 日,DeepSeek 正式发布面向 API 调用的实验性多模态视觉模型 DeepSeek‑V4‑Flash‑Vision‑Exp,给主打推理、代码、Agent 任务的 V4‑Flash 装上视觉感知能力DeepS...。这并不只是简单补上多模态识图功能,结合 8 天前开源发布的 Harness 框架,以及同步开放的 Files API,DeepSeek 完成了感知‑思考‑执行整套 Agent 底层基建闭环,Agent 的竞争逻辑正在发生本质变化。
理论测算:1000 张图片,图片输入 Token 总量上限约 38.4 万 Token。高峰时段图片输入成本约 0.38 元,闲时仅约 0.19 元。注:该数值仅为图片输入部分理论下限,实际调用还需要叠加提示词、输出 Token、上下文历史、网络与文件存储开销,不能简单理解为处理一千张图只需要几毛钱。
模型 ID:deepseek‑v4‑flash‑vision‑exp,实验版本,支持 Chat Completions、Responses、Anthropic Messages 三类调用格式;图片支持 Base64、URL、Files API 三种传入方式。
举报
本版积分规则 发表回复 回帖后跳转到最后一页
相关侵权、举报、投诉及建议等,请发 E-mail:2026@typc.net
Powered by Discuz! X5.0 © 2001-2026 Discuz! Team.|晋ICP备2026008270号-1|晋公网安备14010602111293号