All AI models · LLM benchmarks · Methodology

DeepSeek

DeepSeek V4 Flash Vision Exp

Experimental multimodal DeepSeek V4 Flash model for image understanding, coding, and agentic work

Model facts

Context window
1M tokens
Maximum output
384K tokens
Cheapest paid input
$0.14 per 1M tokens
Cheapest paid output
$0.28 per 1M tokens
Open weights
yes
Providers
18

Capabilities and modalities

reasoning, tool calling, structured output, attachments, temperature control, open weights, text, image.

Local hardware estimate

At 4K context: Q4_K_M 187.4 GiB, Q8_0 329.3 GiB, F16 595.3 GiB working memory.

Parameters
304.6 billion
Architecture
deepseekv4
Model license
mit

Planning estimate adapted from the MIT-licensed whichllm estimator using metadata from Hugging Face; not a vendor minimum requirement.

Observed price history

  • 2026-08-24: $0.14 input / $0.28 output per 1M tokens

API providers

  • AMD — model id DeepSeek-V4-Flash-Vision-Exp; $0.14 input / $0.28 output per 1M tokens; provider documentation
  • DeepSeek — model id deepseek-v4-flash-vision-exp; $0.14 input / $0.28 output per 1M tokens; provider documentation
  • DevPass (LLM Gateway) — model id deepseek-v4-flash-vision-exp; $0.14 input / $0.28 output per 1M tokens; provider documentation
  • LLM Gateway (DeepSeek) — model id deepseek/deepseek-v4-flash-vision-exp; $0.14 input / $0.28 output per 1M tokens; provider documentation
  • OrcaRouter — model id deepseek/deepseek-v4-flash-vision-exp; $0.147 input / $0.295 output per 1M tokens; provider documentation
  • Eden AI — model id deepseek/deepseek-v4-flash-vision-exp; $0.22 input / $0.66 output per 1M tokens; provider documentation
  • Fireworks AI — model id accounts/fireworks/models/deepseek-v4-flash-vision-exp; $0.22 input / $0.66 output per 1M tokens; provider documentation
  • NanoGPT — model id deepseek/deepseek-v4-flash-vision-exp; $0.22 input / $0.66 output per 1M tokens; provider documentation
  • OpenCode Go — model id deepseek-v4-flash-vision-exp; $0.22 input / $0.66 output per 1M tokens; provider documentation
  • OpenRouter — model id deepseek/deepseek-v4-flash-vision-exp; $0.22 input / $0.66 output per 1M tokens; provider documentation
  • Vancine — model id deepseek-v4-flash-vision-exp; $0.22 input / $0.66 output per 1M tokens; provider documentation
  • Vercel AI Gateway — model id deepseek/deepseek-v4-flash-vision-exp; $0.22 input / $0.66 output per 1M tokens; provider documentation
  • above.dev — model id deepseek-v4-flash-vision-exp; $0.242 input / $0.726 output per 1M tokens; provider documentation
  • CrossModel — model id deepseek/deepseek-v4-flash-vision-exp; $0.405 input / $1.22 output per 1M tokens; provider documentation
  • Deep Infra — model id deepseek-ai/DeepSeek-V4-Flash-Vision-Exp; $0.44 input / $1.32 output per 1M tokens; provider documentation
  • Hugging Face — model id deepseek-ai/DeepSeek-V4-Flash-Vision-Exp; $0.44 input / $1.32 output per 1M tokens; provider documentation
  • Kilo Gateway — model id deepseek/deepseek-v4-flash-vision-exp; $0.44 input / $1.32 output per 1M tokens; provider documentation
  • Ofox — model id deepseek/deepseek-v4-flash-vision-exp; $0.44 input / $1.32 output per 1M tokens; provider documentation