Qwen3-VL-30B-A3B-Thinking — это мультимодальная модель, которая объединяет мощную генерацию текста с визуальным пониманием изображений и видео. Её вариант Thinking улучшает рассуждение в области STEM (наука, технологии, инженерия и математика), математики и сложных задач. Она превосходно справляется с восприятием реальных/синтетических категорий, 2D/3D пространственной привязкой и глубоким визуальным пониманием, достигая конкурентоспособных результатов в мультимодальных бенчмарках. Для агентского использования она обрабатывает многоизобразные многоэтапные инструкции, выравнивание временной шкалы видео, автоматизацию графического интерфейса и визуальное кодирование от эскизов до отлаженного пользовательского интерфейса. Производительность текста соответствует флагманским моделям Qwen3, что делает её подходящей для документного ИИ, OCR, помощи с пользовательским интерфейсом, пространственных задач и исследований в области агентов.
from openai import OpenAI
client = OpenAI(
base_url="https://infergate.ru/api/v1",
api_key="sk-•••",
)
resp = client.chat.completions.create(
model="qwen/qwen3-vl-30b-a3b-thinking",
messages=[{"role": "user", "content": "Привет!"}],
)
print(resp.choices[0].message.content)modelstringобязательныйmessagesarrayобязательныйtemperaturenumbermax_tokensintegertop_pnumbertop_kintegerstopstring | string[]frequency_penaltynumberpresence_penaltynumberseedintegerlogprobsbooleantop_logprobsintegerresponse_formatstructured_outputsbooleantoolsarraytool_choicestring | objectreasoningobjectinclude_reasoningboolean