Qwen3-235B-A22B-Thinking-2507 — это высокопроизводительная языковая модель "Смесь экспертов" (MoE) с открытым весом, оптимизированная для сложных задач рассуждения. Она активирует 22 миллиарда из 235 миллиардов своих параметров за один прямой проход и нативно поддерживает контекст до 262 144 токенов. Этот вариант "только для мышления" улучшает структурированные логические рассуждения, математику, науку и генерацию длинных текстов, демонстрируя высокие показатели в бенчмарках AIME, SuperGPQA, LiveCodeBench и MMLU-Redux. Он поддерживает специальный режим рассуждения (</think>) и разработан для вывода большого количества токенов (до 81 920 токенов) в сложных областях. Модель настроена для инструкций и превосходно справляется с пошаговыми рассуждениями, использованием инструментов, агентными рабочими процессами и многоязычными задачами. Этот выпуск представляет собой наиболее мощный вариант с открытым исходным кодом в серии Qwen3-235B, превосходящий многие закрытые модели в сценариях использования структурированных рассуждений.
from openai import OpenAI
client = OpenAI(
base_url="https://infergate.ru/api/v1",
api_key="sk-•••",
)
resp = client.chat.completions.create(
model="qwen/qwen3-235b-a22b-thinking-2507",
messages=[{"role": "user", "content": "Привет!"}],
)
print(resp.choices[0].message.content)modelstringобязательныйmessagesarrayобязательныйtemperaturenumbermax_tokensintegertop_pnumbertop_kintegerstopstring | string[]frequency_penaltynumberpresence_penaltynumberrepetition_penaltynumberseedintegerlogprobsbooleantop_logprobsintegerresponse_formatobjecttoolsarraytool_choicestring | objectreasoningobjectinclude_reasoningboolean