Все модели

Nemotron 3 Super

nvidia/nemotron-3-super-120b-a12b
текстРассуждение

Открытая модель NVIDIA на 120B параметров, из них активны всего 12B (MoE на гибридной архитектуре Mamba-Transformer) — отсюда низкая цена при точности в многоагентных сценариях. Настраиваемое рассуждение, контекст 1M.

Цена

Запрос / 1М
Ответ / 1М

Параметры

messagesобязательный
reasoning_effortoff · low · medium · high
temperature0–2
max_tokensопционально
streamtrue · false

Как использовать через API

from openai import OpenAI
client = OpenAI(base_url="https://api.mixen.ai/v1", api_key="mxn-...")
resp = client.chat.completions.create(
model="nvidia/nemotron-3-super-120b-a12b",
messages=[{"role": "user", "content": "Привет"}],
reasoning_effort="low", # off · low · medium · high
temperature=0.7,
max_tokens=1024,
stream=False,
)
print(resp.choices[0].message.content)