DeepSeek V4 Flash — это оптимизированная по производительности модель «смесь экспертов» (Mixture-of-Experts) от DeepSeek с общим количеством параметров 284B и 13B активированных параметров, поддерживающая контекстное окно в 1M токенов. Она разработана для быстрого вывода и высокопроизводительных рабочих нагрузок, сохраняя при этом высокие показатели в рассуждениях и написании кода. Модель включает гибридное внимание для эффективной обработки длинных контекстов. Поддерживаются уровни рассуждений `high` и `xhigh`; `xhigh` соответствует максимальному уровню рассуждений. Она хорошо подходит для таких приложений, как помощники по кодированию, чат-системы и рабочие процессы агентов, где важны скорость отклика и экономичность.
from openai import OpenAI
client = OpenAI(
base_url="https://infergate.ru/api/v1",
api_key="sk-•••",
)
resp = client.chat.completions.create(
model="deepseek/deepseek-v4-flash",
messages=[{"role": "user", "content": "Привет!"}],
)
print(resp.choices[0].message.content)modelstringобязательныйmessagesarrayобязательныйtemperaturenumbermax_tokensintegermax_completion_tokensintegertop_pnumbertop_kintegermin_pnumbertop_anumberstopstring | string[]frequency_penaltynumberpresence_penaltynumberrepetition_penaltyseedintegerlogit_biasobjectlogprobsbooleantop_logprobsintegerresponse_formatobjectstructured_outputsbooleantoolsarraytool_choicestring | objectreasoningobjectreasoning_effortstringinclude_reasoningboolean