← Все модели
DeepSeek: DeepSeek V4.1 FlashNEW
deepseek/deepseek-v4.1-flashтекстЗрениеРассуждение
DeepSeek V4.1 Flash — экономичный тир семейства V4.1, который по заявлениям DeepSeek обходит V4 Pro по качеству, скорости и времени завершения задач. Кодинг, рассуждения и агентные сценарии, особенно длинные многошаговые задачи. Понимает изображения, контекст 1M токенов.
Цена вход / выход
Кэш, чтение / запись
Контекст / Макс. ответ
1.05M / 384K
Релиз
10 сент. 2026 г.
Дополнительные тарифы
В отдельные часы UTC апстрим берёт в 2 раза дороже — ставки по маршрутам в таблице ниже.
Параметры
messagesобязательныйreasoning_effortoff · low · high · maxmax_tokensопционально · алиас max_completion_tokensstreamtrue · falsetoolsfunction calling (OpenAI-формат)tool_choiceauto · none · requiredresponse_formatjson_object · json_schemaweb_search · · · providerмаршрут: order · only · ignore · sortstream_options{"include_usage": true}image_urlкартинка (data: URL)Тонкая настройка · 11
temperature0–2stopопциональноseedопциональноtop_p0–1top_kопциональноmin_p0–1frequency_penalty−2…2presence_penalty−2…2repetition_penalty0–2logprobstrue · falsetop_logprobs0–20Как использовать через API
from openai import OpenAI
client = OpenAI(base_url="https://api.mixen.ai/v1", api_key="mxn-...")
resp = client.chat.completions.create(
model="deepseek/deepseek-v4.1-flash",
messages=[{"role": "user", "content": "Привет"}],
reasoning_effort="low", # off · low · high · max
temperature=0.7,
max_tokens=1024,
stream=False,
)
print(resp.choices[0].message.content)
# Стриминг: stream=True — ответ приходит чанками
for chunk in client.chat.completions.create(
model="deepseek/deepseek-v4.1-flash",
messages=[{"role": "user", "content": "Привет"}],
stream=True,
):
print(chunk.choices[0].delta.content or "", end="", flush=True)

