Qwen3-Next-80B-A3B-Thinking — это чат-модель с приоритетом рассуждений из линейки Qwen3-Next, которая по умолчанию выводит структурированные «трассировки мышления». Она разработана для сложных многоэтапных задач: математических доказательств, синтеза/отладки кода, логики и агентного планирования, и демонстрирует высокие результаты в оценках знаний, рассуждений, кодирования, согласованности и многоязычности. По сравнению с предыдущими вариантами Qwen3, она подчеркивает стабильность при длинных цепочках мыслей и эффективное масштабирование во время вывода, а также настроена на следование сложным инструкциям при одновременном снижении повторяющегося или непрофильного поведения. Модель подходит для агентских фреймворков и использования инструментов (вызов функций), рабочих процессов с интенсивным извлечением данных и стандартизированного бенчмаркинга, где требуются пошаговые решения. Она поддерживает длинные, подробные завершения и использует методы, ориентированные на пропускную способность (например, предсказание нескольких токенов), для более быстрой генерации. Обратите внимание, что она работает только в режиме «мышления».
from openai import OpenAI
client = OpenAI(
base_url="https://infergate.ru/api/v1",
api_key="sk-•••",
)
resp = client.chat.completions.create(
model="qwen/qwen3-next-80b-a3b-thinking",
messages=[{"role": "user", "content": "Привет!"}],
)
print(resp.choices[0].message.content)modelstringобязательныйmessagesarrayобязательныйtemperaturenumbermax_tokensintegertop_pnumbertop_kintegerstopstring | string[]frequency_penaltynumberpresence_penaltynumberrepetition_penaltynumberseedintegerlogprobsbooleantop_logprobsintegerresponse_formatobjectstructured_outputsbooleantoolsarraytool_choicestring | objectreasoningobjectinclude_reasoningboolean