Gemma 4 26B A4B IT — это модель Mixture-of-Experts (MoE) с тонкой настройкой инструкций от Google DeepMind. Несмотря на 25,2 млрд общих параметров, во время вывода на каждый токен активируется только 3,8 млрд, что обеспечивает качество, близкое к 31 млрд, при значительно меньших вычислительных затратах. Поддерживает мультимодальный ввод, включая текст, изображения и видео (до 60 секунд со скоростью 1 кадр в секунду). Отличается окном контекста в 256 тыс. токенов, нативным вызовом функций, настраиваемым режимом мышления/рассуждения и поддержкой структурированного вывода. Выпущена по лицензии Apache 2.0.
from openai import OpenAI
client = OpenAI(
base_url="https://infergate.ru/api/v1",
api_key="sk-•••",
)
resp = client.chat.completions.create(
model="google/gemma-4-26b-a4b-it:free",
messages=[{"role": "user", "content": "Привет!"}],
)
print(resp.choices[0].message.content)modelstringобязательныйmessagesarrayобязательныйtemperaturenumbermax_tokensintegertop_pnumberseedintegerresponse_formatobjecttoolsarraytool_choicestring | objectreasoningobjectinclude_reasoningboolean