DeepSeek 官方发布了一款新模型:DeepSeek-V4-Flash-Vision-Exp。需要注意的是,官方明确表示这是一款实验性质的多模态模型,后续接口或效果可能还会调整。
目前已经可以直接通过 API 访问使用。调用过程中,图片会先被转换为 token 再计费,单张图片最多占用 384 tokens,计费价格与 V4-Flash 正式版保持一致。
除了直接调 API,也可以在 DeepSeek Harness 中使用该模型。先升级 dsh 到最新版本:
npm install -g @deepseek-ai/dsh@next
更新完成后,即可在 Harness 中直接调用这一多模态模型。
性能方面,官方给出的结论如下:
- 纯文本能力(Agent、推理、世界知识等)与
DeepSeek-V4-Flash 正式版持平;
- 在需要视觉理解的 Agent Benchmark 上,
DeepSeek-V4-Flash-Vision-Exp 相比 DeepSeek-V4-Flash 实现大幅跃升;
- 多模态 Agent 能力已接近
Opus-4.8。
相关模型动态也可以在 云栈社区 持续关注。
|