NVIDIA Nemotron 3 Super — это открытая гибридная модель MoE с 120 миллиардами параметров, при этом для максимальной вычислительной эффективности и точности в сложных многоагентных приложениях активируется всего 12 миллиардов параметров. Созданная на основе гибридной архитектуры Mixture-of-Experts (MoE) Mamba-Transformer с предсказанием нескольких токенов (MTP), она обеспечивает более чем на 50 % более высокую генерацию токенов по сравнению с ведущими открытыми моделями. Модель имеет контекстное окно в 1 миллион токенов для долгосрочной согласованности агентов, кросс-документного рассуждения и многоступенчатого планирования задач. Латентная MoE позволяет вызывать 4 эксперта при стоимости вывода, как от одного, улучшая интеллект и обобщение. Обучение с подкреплением в нескольких средах (RL) в более чем 10 средах обеспечивает ведущую точность в контрольных показателях, включая AIME 2025, TerminalBench и SWE-Bench Verified. Полностью открытая модель с весами, наборами данных и рецептами под лицензией NVIDIA Open License, Nemotron 3 Super позволяет легко настраивать и безопасно развертывать ее где угодно — от рабочей станции до облака.
from openai import OpenAI
client = OpenAI(
base_url="https://infergate.ru/api/v1",
api_key="sk-•••",
)
resp = client.chat.completions.create(
model="nvidia/nemotron-3-super-120b-a12b:free",
messages=[{"role": "user", "content": "Привет!"}],
)
print(resp.choices[0].message.content)modelstringобязательныйmessagesarrayобязательныйtemperaturenumbermax_tokensintegertop_pnumberseedintegerresponse_formatobjectstructured_outputsbooleantoolsarraytool_choicestring | objectreasoningobjectreasoning_effortstringinclude_reasoningboolean