Llama Guard 4 — это мультимодальная предварительно обученная модель, созданная на основе Llama 4 Scout и доработанная для классификации контента по критериям безопасности. Как и предыдущие версии, она может использоваться для классификации контента как во входных данных LLM (классификация запросов), так и в ответах LLM (классификация ответов). Она действует как LLM, генерируя в своих выходных данных текст, указывающий, является ли данный запрос или ответ безопасным или небезопасным, и если небезопасным, то также перечисляет категории контента, которые были нарушены. Llama Guard 4 была настроена для защиты от злоупотреблений в соответствии со стандартизированной таксономией угроз MLCommons и разработана для поддержки мультимодальных возможностей Llama 4. В частности, она сочетает в себе функции предыдущих моделей Llama Guard, обеспечивая модерацию контента для английского и нескольких поддерживаемых языков, а также расширенные возможности для обработки смешанных текстово-визуальных запросов, включая несколько изображений. Кроме того, Llama Guard 4 интегрирована в API Llama Moderations, расширяя надежную классификацию безопасности на текст и изображения.
from openai import OpenAI
client = OpenAI(
base_url="https://infergate.ru/api/v1",
api_key="sk-•••",
)
resp = client.chat.completions.create(
model="meta-llama/llama-guard-4-12b",
messages=[{"role": "user", "content": "Привет!"}],
)
print(resp.choices[0].message.content)modelstringобязательныйmessagesarrayобязательныйtemperaturenumbermax_tokensintegertop_pnumbertop_kintegermin_pnumberstopstring | string[]frequency_penaltynumberpresence_penaltynumberrepetition_penaltynumberseedintegerlogit_biasobjectresponse_formatobject