MiniMax-M3 — это мультимодальная модель-основа от MiniMax. Она поддерживает ввод текста, изображений и видео с выводом текста, имеет контекстное окно на 1 миллион токенов и подходит для агентской работы с длительным горизонтом, кодирования и использования инструментов. Модель основана на MiniMax Sparse Attention (MSA), которая заменяет полное внимание выбором блоков KV для сокращения вычислений на каждый токен для длинного контекста — примерно в 20 раз дешевле, чем предыдущее поколение, при 1 миллионе токенов, со значительно более быстрой предварительной обработкой и декодированием при сохранении качества в большинстве задач. Модель, разработанная как нативная мультимодальная модель на основе перемежающихся данных и настроенная для многоэтапного, аналогичного производственному, сотрудничества с использованием интерактивной среды-симулятора пользователя, ориентирована на устойчивые, многошаговые задачи, а не на одноэтапное выполнение.
from openai import OpenAI
client = OpenAI(
base_url="https://infergate.ru/api/v1",
api_key="sk-•••",
)
resp = client.chat.completions.create(
model="minimax/minimax-m3:batch",
messages=[{"role": "user", "content": "Привет!"}],
)
print(resp.choices[0].message.content)modelstringобязательныйmessagesarrayобязательныйtemperaturenumbermax_tokensintegertop_pnumbertop_kintegermin_pnumberstopstring | string[]frequency_penaltynumberpresence_penaltynumberrepetition_penaltynumberlogit_biasobjectresponse_formatstructured_outputsbooleantoolsarraytool_choicestring | objectreasoningobjectinclude_reasoningboolean