Gemini 3 Flash Preview — это высокоскоростная и высокоэффективная модель, разработанная для агентских рабочих процессов, многошаговых чатов и помощи в кодировании. Она обеспечивает уровень рассуждений и использования инструментов, сравнимый с Pro, при значительно меньшей задержке, чем более крупные варианты Gemini, что делает ее хорошо подходящей для интерактивной разработки, длительных циклов агентов и совместных задач кодирования. По сравнению с Gemini 2.5 Flash, она обеспечивает значительное улучшение качества в области рассуждений, мультимодального понимания и надежности. Модель поддерживает контекстное окно объемом 1 млн токенов и мультимодальные входы, включая текст, изображения, аудио, видео и PDF-файлы, с текстовым выводом. Она включает настраиваемое рассуждение с помощью уровней мышления (минимальный, низкий, средний, высокий), структурированный вывод, использование инструментов и автоматическое кэширование контекста. Gemini 3 Flash Preview оптимизирован для пользователей, которым нужны сильные рассуждения и агентское поведение без затрат или задержек полномасштабных передовых моделей.
from openai import OpenAI
client = OpenAI(
base_url="https://infergate.ru/api/v1",
api_key="sk-•••",
)
resp = client.chat.completions.create(
model="google/gemini-3-flash-preview",
messages=[{"role": "user", "content": "Привет!"}],
)
print(resp.choices[0].message.content)modelstringобязательныйmessagesarrayобязательныйtemperaturenumbermax_tokensintegertop_pnumberstopstring | string[]seedintegerresponse_formatobjectstructured_outputsbooleantoolsarraytool_choicestring | objectreasoningobjectreasoning_effortinclude_reasoningboolean