← Все модели
NVIDIA: Nemotron 3.5 Lightning
nvidia/nemotron-3.5-lightningтекстРассуждение
Открытая MoE-модель NVIDIA: 30B параметров, активны 3B. Высокопроизводительная для агентских задач и специализированных workflows, настраиваемое рассуждение, контекст 1M.
Цена
Запрос / 1М
Ответ / 1М
Параметры
messagesобязательныйtemperature0–2max_tokensопциональноstreamtrue · falseКак использовать через API
from openai import OpenAIclient = OpenAI(base_url="https://api.mixen.ai/v1", api_key="mxn-...")resp = client.chat.completions.create(model="nvidia/nemotron-3.5-lightning",messages=[{"role": "user", "content": "Привет"}],temperature=0.7,max_tokens=1024,stream=False,)print(resp.choices[0].message.content)# Стриминг: stream=True — ответ приходит чанкамиfor chunk in client.chat.completions.create(model="nvidia/nemotron-3.5-lightning",messages=[{"role": "user", "content": "Привет"}],stream=True,):print(chunk.choices[0].delta.content or "", end="", flush=True)

