← All models
DeepSeek V4 Flash 0731
deepseek/deepseek-v4-flash-0731text
Fresh DeepSeek V4 Flash snapshot (2026-07-31): 1M-token context, fast answers on long texts and everyday tasks.
Pricing
Request / 1M
Response / 1M
Parameters
messagesrequiredtemperature0–2max_tokensoptionalstreamtrue · falseHow to use via API
from openai import OpenAIclient = OpenAI(base_url="https://api.mixen.ai/v1", api_key="mxn-...")resp = client.chat.completions.create(model="deepseek/deepseek-v4-flash-0731",messages=[{"role": "user", "content": "Привет"}],temperature=0.7,max_tokens=1024,stream=False,)print(resp.choices[0].message.content)# Стриминг: stream=True — ответ приходит чанкамиfor chunk in client.chat.completions.create(model="deepseek/deepseek-v4-flash-0731",messages=[{"role": "user", "content": "Привет"}],stream=True,):print(chunk.choices[0].delta.content or "", end="", flush=True)

