NVIDIA Nemotron 3.5 Content Safety — это компактная мультимодальная модель-ограничитель от NVIDIA с 4 миллиардами параметров, дообученная на базе Google Gemma-3-4B. Она модерирует как входные данные, так и ответы от больших языковых моделей (LLM) и больших визуальных моделей (VLM), принимая на вход текст и изображения и возвращая текстовый вывод: классификацию «безопасно/небезопасно» для запроса пользователя и ответа, метки категорий безопасности и необязательный трассировочный путь. Модель охватывает 12 языков с контекстным окном до 128 тысяч токенов. Она подходит для модерации запросов и ответов, классификации контента, систем безопасности и корпоративных ИИ-ограничителей с принудительным соблюдением политик, а также включает переключаемый режим обоснования. Модель является частью семейства открытых моделей NVIDIA Nemotron для агентского ИИ.
from openai import OpenAI
client = OpenAI(
base_url="https://infergate.ru/api/v1",
api_key="sk-•••",
)
resp = client.chat.completions.create(
model="nvidia/nemotron-3.5-content-safety",
messages=[{"role": "user", "content": "Привет!"}],
)
print(resp.choices[0].message.content)modelstringобязательныйmessagesarrayобязательныйtemperaturenumbermax_tokensintegertop_pnumbertop_kintegermin_pnumberstopstring | string[]frequency_penaltynumberpresence_penaltynumberrepetition_penaltynumberseedintegerlogit_biasobjectresponse_formatobjectreasoningobjectinclude_reasoningboolean