Qwen3-Coder-30B-A3B-Instruct — это модель Mixture-of-Experts (MoE) с 30,5 миллиардами параметров, имеющая 128 экспертов (8 активных на каждый прямой проход), разработанная для продвинутой генерации кода, понимания репозиториев большого масштаба и применения агентных инструментов. Построенная на архитектуре Qwen3, она поддерживает нативную длину контекста в 256 тысяч токенов (расширяемую до 1 миллиона с Yarn) и демонстрирует высокую производительность в задачах, связанных с вызовами функций, использованием браузера и структурированным завершением кода. Эта модель оптимизирована для следования инструкциям без «режима размышления» и хорошо интегрируется с форматами использования инструментов, совместимыми с OpenAI.
from openai import OpenAI
client = OpenAI(
base_url="https://infergate.ru/api/v1",
api_key="sk-•••",
)
resp = client.chat.completions.create(
model="qwen/qwen3-coder-30b-a3b-instruct",
messages=[{"role": "user", "content": "Привет!"}],
)
print(resp.choices[0].message.content)modelstringобязательныйmessagesarrayобязательныйtemperaturenumbermax_tokensintegertop_pnumbertop_kintegerstopstring | string[]frequency_penaltynumberpresence_penaltynumberrepetition_penaltynumberseedintegerlogprobsbooleantop_logprobsintegerresponse_formatobjectstructured_outputsbooleantoolsarraytool_choicestring | object