Встраивание Gemini 2 Preview — это первая мультимодальная модель встраивания от Google. В настоящее время мы поддерживаем отображение текста и изображений в унифицированное векторное пространство для семантического поиска и генерации с дополненным извлечением (RAG). Модель поддерживает входной контекст до 8192 токенов и гибкие выходные размерности от 128 до 3072 (рекомендуемые: 768, 1536 или 3072). Разработанная для кросс-модального сходства — вы можете встроить текстовый запрос и получить наиболее релевантные изображения или наоборот — что делает ее хорошо подходящей для мультимодального поиска, рекомендаций и конвейеров понимания документов.
from openai import OpenAI
client = OpenAI(
base_url="https://infergate.ru/api/v1",
api_key="sk-•••",
)
resp = client.embeddings.create(
model="google/gemini-embedding-2-preview",
input="Текст для векторизации",
)
print(resp.data[0].embedding[:8])modelstringобязательныйinputstring | string[]обязательныйtemperaturenumbermax_tokensintegertop_pnumberseedintegerresponse_formatobject