Hermes 4 70B — это гибридная модель рассуждений от Nous Research, построенная на базе Meta-Llama-3.1-70B. Она представляет тот же гибридный режим, что и более крупная версия 405B, позволяя модели либо отвечать напрямую, либо генерировать явные трассировки рассуждений <think>...</think> перед ответом. Пользователи могут управлять поведением рассуждений с помощью логического параметра `reasoning` `enabled`. [Подробнее в нашей документации](https://openrouter.ai/docs/use-cases/reasoning-tokens#enable-reasoning-with-default-config) Этот 70B-вариант обучен с использованием расширенного корпуса дообучения (~60B токенов), с упором на проверенные данные рассуждений, что приводит к улучшениям в математике, кодировании, STEM, логике и структурированных выходных данных, при сохранении общей производительности помощника. Он поддерживает режим JSON, схемы, вызовы функций и использование инструментов, а также разработан для большей управляемости с уменьшенным количеством отказов.
from openai import OpenAI
client = OpenAI(
base_url="https://infergate.ru/api/v1",
api_key="sk-•••",
)
resp = client.chat.completions.create(
model="nousresearch/hermes-4-70b",
messages=[{"role": "user", "content": "Привет!"}],
)
print(resp.choices[0].message.content)modelstringобязательныйmessagesarrayобязательныйtemperaturenumbermax_tokensintegertop_pnumbertop_kintegerfrequency_penaltynumberpresence_penaltynumberrepetition_penaltynumberresponse_formatobjectreasoningobjectinclude_reasoningboolean