Qwen3-32B — это плотная причинная языковая модель серии Qwen3 с 32,8 миллиардами параметров, оптимизированная как для сложного мышления, так и для эффективного диалога. Она поддерживает плавное переключение между режимом «мышления» для таких задач, как математика, кодирование и логический вывод, и режимом «без мышления» для более быстрого, общего разговора. Модель демонстрирует высокую производительность в выполнении инструкций, использовании инструментов агентов, творческом письме и многоязычных задачах на более чем 100 языках и диалектах. Она нативно обрабатывает контексты в 32K токенов и может расширяться до 131K токенов с использованием масштабирования на основе YaRN.
from openai import OpenAI
client = OpenAI(
base_url="https://infergate.ru/api/v1",
api_key="sk-•••",
)
resp = client.chat.completions.create(
model="qwen/qwen3-32b",
messages=[{"role": "user", "content": "Привет!"}],
)
print(resp.choices[0].message.content)modelstringобязательныйmessagesarrayобязательныйtemperaturenumbermax_tokensintegertop_pnumbertop_kintegermin_pnumberstopstring | string[]frequency_penaltynumberpresence_penaltynumberrepetition_penaltynumberseedintegerlogit_biasobjectresponse_formatobjectstructured_outputsbooleantoolsarraytool_choicestring | objectreasoningobjectinclude_reasoningboolean