Models / DeepSeek
Chat
Reasoning
Vision

Coming soon

DeepSeek V4.1 Flash

Million-token multimodal intelligence with radically compressed KV cache

This model is coming soon to Together’s Serverless API

Performance benchmarks

Model

FrontierMath Tier 4

GPQA Diamond

HLE

SciCode

GDPval-AA

Terminal-Bench 2.1

Agent Arena

FrontierCode

DeepSWE

90.9

36.8

Related open-source models

Competitor closed-source models

Claude Fable 5

87.8%

92.6%

53%

60%

62%

85%

53.5%

70%

Claude Opus 5

73.2%

93.2%

53%

56%

68%

89%

+16.4pp

53.4%

74%

GPT-5.6 Sol

82.9%

94.1%

47%

56%

61%

88%

47.5%

73%

Grok 4.5

24.4%

93.1%

40%

54%

51%

82%

+4.2pp

42.4%

54%

GPT-5.6 Luna

61.0%

91.1%

37%

53%

54%

81%

39.8%

67%

Related models
  • Model provider
    DeepSeek
  • Type
    Chat
    Reasoning
    Vision
  • Parameters
    552B
  • Activated parameters
    8B / 16B
  • Context length
    1M