Perceptron Mk1 (Mark One) – это высококачественная видео-языковая модель Perceptron для понимания видео и воплощенного рассуждения. Она принимает изображения и видео в сочетании с запросами на естественном языке и выдает подробные ответы для визуального понимания, как в структурированном виде, так и на естественном языке. Модель превосходно справляется с задачами понимания видео, такими как ответы на вопросы по видео, его суммаризация и обнаружение событий. При работе с изображениями она улучшает привязку «точка-по-примеру» из мультимодальных подсказок, OCR и анализ документов на неструктурированных реальных данных, обнаружение и подсчет объектов с открытым словарем, а также оценку положения рук. Рассуждение может быть включено по запросу, чтобы пожертвовать задержкой ради более глубокого анализа сложных задач. Структурированные аннотации генерируются в тексте только при явном запросе через параметр `annotation_format` (передайте `"point"`, `"box"`, или `"polygon"` для пространственной локализации на изображениях, или `"clip"` (временные метки начала/конца) для временных сегментов в видео). Без `annotation_format` модель возвращает только текст на естественном языке.
from openai import OpenAI
client = OpenAI(
base_url="https://infergate.ru/api/v1",
api_key="sk-•••",
)
resp = client.chat.completions.create(
model="perceptron/perceptron-mk1",
messages=[{"role": "user", "content": "Привет!"}],
)
print(resp.choices[0].message.content)modelstringобязательныйmessagesarrayобязательныйtemperaturenumbermax_tokensintegertop_pnumbertop_kintegerfrequency_penaltynumberpresence_penaltynumberstructured_outputsbooleanreasoningobjectinclude_reasoningboolean