Hermes 4 — это крупномасштабная модель рассуждений, построенная на базе Meta-Llama-3.1-405B и выпущенная Nous Research. Она представляет гибридный режим рассуждений, в котором модель может выбирать между внутренними размышлениями с использованием трассировок <think>...</think> или прямым ответом, предлагая гибкость между скоростью и глубиной. Пользователи могут контролировать поведение рассуждений с помощью логической переменной `reasoning` `enabled`. [Узнайте больше в нашей документации](https://openrouter.ai/docs/use-cases/reasoning-tokens#enable-reasoning-with-default-config) Модель настроена для работы с инструкциями с использованием расширенного корпуса для пост-обучения (~60 миллиардов токенов), что подчеркивает трассировки рассуждений, улучшая производительность в математике, кодировании, STEM и логическом рассуждении, при этом сохраняя широкую полезность в качестве помощника. Она также поддерживает структурированные выходы, включая режим JSON, соответствие схеме, вызов функций и использование инструментов. Hermes 4 обучена для управляемости, более низких показателей отказов и ориентации на нейтральное, управляемое пользователем поведение.
from openai import OpenAI
client = OpenAI(
base_url="https://infergate.ru/api/v1",
api_key="sk-•••",
)
resp = client.chat.completions.create(
model="nousresearch/hermes-4-405b",
messages=[{"role": "user", "content": "Привет!"}],
)
print(resp.choices[0].message.content)modelstringобязательныйmessagesarrayобязательныйtemperaturenumbermax_tokensintegertop_pnumbertop_kintegerfrequency_penaltynumberpresence_penaltynumberrepetition_penaltynumberresponse_formatobjectreasoningobjectinclude_reasoningboolean