NVIDIA Nemotron™ 3 Nano Omni — это открытая мультимодальная модель размером 30B-A3B, предназначенная для выполнения функций субагента восприятия и контекста в корпоративных агентных системах. Она принимает текстовые, графические, видео- и аудиовходы и выдает текстовые выходы, позволяя агентам воспринимать и рассуждать в различных модальностях в рамках одного цикла вывода. Построенная на гибридной архитектуре MoE Transformer-Mamba с видеослоями Conv3D и Efficient Video Sampling (EVS), она обеспечивает примерно в 2 раза более высокую пропускную способность и в 2,5 раза меньшие вычислительные затраты для видеоанализа по сравнению с отдельными конвейерами зрения + речи. Она поддерживает контекст длиной до 300K и бюджет рассуждений в 16 384, с расширенным мышлением, включенным через reasoning.enabled на OpenRouter.
from openai import OpenAI
client = OpenAI(
base_url="https://infergate.ru/api/v1",
api_key="sk-•••",
)
resp = client.chat.completions.create(
model="nvidia/nemotron-3-nano-omni-30b-a3b-reasoning:free",
messages=[{"role": "user", "content": "Привет!"}],
)
print(resp.choices[0].message.content)modelstringобязательныйmessagesarrayобязательныйtemperaturenumbermax_tokensintegertop_pnumberseedintegertoolsarraytool_choicestring | objectreasoningobjectinclude_reasoningboolean