Qwen3, последнее поколение серии больших языковых моделей Qwen, включает в себя как плотную архитектуру, так и архитектуру «смеси экспертов» (MoE), чтобы преуспеть в логическом мышлении, многоязычной поддержке и расширенных задачах для агентов. Его уникальная способность легко переключаться между режимом мышления для сложного рассуждения и режимом не-мышления для эффективного диалога обеспечивает универсальную, высококачественную производительность. Значительно превосходя предыдущие модели, такие как QwQ и Qwen2.5, Qwen3s обеспечивает превосходные возможности в математике, кодировании, здравомыслящем рассуждении, творческом письме и интерактивном диалоге. Вариант Qwen3-30B-A3B включает 30,5 миллиардов параметров (3,3 миллиарда активированных), 48 слоев, 128 экспертов (8 активированных на задачу) и поддерживает до 131K токенов контекста с помощью YaRN, устанавливая новый стандарт среди моделей с открытым исходным кодом.
from openai import OpenAI
client = OpenAI(
base_url="https://infergate.ru/api/v1",
api_key="sk-•••",
)
resp = client.chat.completions.create(
model="qwen/qwen3-30b-a3b",
messages=[{"role": "user", "content": "Привет!"}],
)
print(resp.choices[0].message.content)modelstringобязательныйmessagesarrayобязательныйtemperaturenumbermax_tokensintegertop_pnumbertop_kintegermin_pnumberstopstring | string[]frequency_penaltynumberpresence_penaltynumberrepetition_penaltynumberseedintegerlogit_biasobjectresponse_formatobjecttoolsarraytool_choicestring | objectreasoningobjectinclude_reasoningboolean