NVIDIA Nemotron 3 Ultra — это открытая модель рассуждений и оркестрации на передовом уровне от NVIDIA с 55 миллиардами активных параметров из 550 миллиардов общих (MoE). Построенная на гибридной архитектуре Mixture-of-Experts (MoE) на основе Transformer-Mamba, она поддерживает текстовый ввод и вывод с размером контекстного окна до 1 миллиона токенов. Она подходит для долгосрочных агентных рабочих процессов, включая оркестрацию агентов, кодирующих агентов, глубокие исследования и сложные корпоративные задачи. Она особенно сильна в многошаговых рассуждениях и планировании, с высокой пропускной способностью вывода, разработанной для крупномасштабных агентных конвейеров. Она является частью семейства открытых моделей NVIDIA Nemotron для агентного ИИ.
from openai import OpenAI
client = OpenAI(
base_url="https://infergate.ru/api/v1",
api_key="sk-•••",
)
resp = client.chat.completions.create(
model="nvidia/nemotron-3-ultra-550b-a55b:free",
messages=[{"role": "user", "content": "Привет!"}],
)
print(resp.choices[0].message.content)modelstringобязательныйmessagesarrayобязательныйtemperaturenumbermax_tokensintegertop_pnumberseedintegertoolsarraytool_choicestring | objectreasoningobjectreasoning_effortstringinclude_reasoningboolean