Qwen3-VL-30B-A3B-Instruct — это мультимодальная модель, которая объединяет мощную генерацию текста с визуальным пониманием изображений и видео. Её вариант Instruct оптимизирует следование инструкциям для общих мультимодальных задач. Модель превосходно справляется с восприятием реальных/синтетических категорий, 2D/3D пространственной привязкой и длинным визуальным пониманием, демонстрируя конкурентоспособные результаты в мультимодальных бенчмарках. Для агентского использования она обрабатывает инструкции с несколькими изображениями и многошаговые инструкции, выравнивание временной шкалы видео, автоматизацию графического интерфейса и визуальное кодирование от эскизов до отлаженного пользовательского интерфейса. Производительность текста соответствует флагманским моделям Qwen3, что подходит для задач Document AI, OCR, помощи с пользовательским интерфейсом, пространственных задач и исследований агентов.
from openai import OpenAI
client = OpenAI(
base_url="https://infergate.ru/api/v1",
api_key="sk-•••",
)
resp = client.chat.completions.create(
model="qwen/qwen3-vl-30b-a3b-instruct",
messages=[{"role": "user", "content": "Привет!"}],
)
print(resp.choices[0].message.content)modelstringобязательныйmessagesarrayобязательныйtemperaturenumbermax_tokensintegertop_pnumbertop_kintegermin_pnumberstopstring | string[]frequency_penaltynumberpresence_penaltynumberrepetition_penaltynumberseedintegerlogit_biasobjectlogprobsbooleantop_logprobsintegerresponse_formatobjectstructured_outputsbooleantoolsarraytool_choicestring | object