Google Gemini 3.1 Flash Lite в AI Gateway Vercel: возможности и настройка
Vercel добавил поддержку модели Gemini 3.1 Flash Lite от Google в свой сервис AI Gateway. Это облегчённая версия флагманской модели Gemini, оптимизированная для высоконагруженных агентных задач, где критичны бюджет и задержка. Разработчики теперь могут использовать её через единый API без дополнител

Vercel добавил поддержку модели Gemini 3.1 Flash Lite от Google в свой сервис AI Gateway. Это облегчённая версия флагманской модели Gemini, оптимизированная для высоконагруженных агентных задач, где критичны бюджет и задержка. Разработчики теперь могут использовать её через единый API без дополнительных интеграций.
Особенности Gemini 3.1 Flash Lite
Gemini 3.1 Flash Lite позиционируется как преемник 2.5 Flash Lite. По заявлению Vercel, новая модель превосходит предшественницу по общему качеству, особенно заметны улучшения в переводе, извлечении данных и автодополнении кода. Разработчики могут подключить модель через AI SDK, указав параметр model как google/gemini-3.1-flash-lite-preview. Модель поддерживает четыре уровня глубины мышления: mini, low, medium и high, что позволяет гибко настраивать баланс между скоростью и качеством.
Чем Gemini 3.1 Flash Lite отличается от 2.5 Flash Lite?
Основное отличие — в улучшенном качестве при сохранении низкой задержки и стоимости. Gemini 3.1 Flash Lite лучше справляется с задачами, требующими понимания контекста и точности, такими как извлечение структурированных данных из текста или генерация кода. При этом модель остаётся лёгкой и подходит для сценариев с большим количеством параллельных запросов. Четыре уровня мышления позволяют разработчикам выбирать, насколько глубоко модель будет анализировать запрос, что напрямую влияет на скорость ответа.
Как использовать Gemini 3.1 Flash Lite через AI Gateway
Для использования Gemini 3.1 Flash Lite через AI Gateway достаточно указать идентификатор модели google/gemini-3.1-flash-lite-preview в вызове AI SDK. Vercel рекомендует эту модель для высокочастотных агентных задач, массового извлечения данных и приложений, где задержка и бюджет являются главными ограничениями. Разработчики могут протестировать модель в модельном плейграунде Vercel или изучить лидерборд AI Gateway для сравнения с другими моделями.
Как настроить уровень мышления?
Уровень мышления задаётся через параметр thinking в запросе. Например, thinking: "low" даёт быстрый ответ, а thinking: "high" — более глубокий анализ, но с большей задержкой. Это позволяет адаптировать модель под конкретные сценарии: от простых чат-ботов до сложных задач извлечения данных.
Предыстория и контекст
AI Gateway от Vercel — это унифицированный API для вызова различных языковых моделей, который предоставляет единый интерфейс для работы с провайдерами, такими как Google, OpenAI, Anthropic и другие. Сервис включает встроенные возможности observability, поддержку Bring Your Own Key, интеллектуальную маршрутизацию запросов между провайдерами и автоматические повторные попытки при сбоях. Это позволяет разработчикам не завязываться на одного вендора и оптимизировать затраты. Появление Gemini 3.1 Flash Lite расширяет выбор лёгких моделей, доступных через Gateway.
Какие ещё модели доступны в AI Gateway?
Помимо Gemini 3.1 Flash Lite, AI Gateway поддерживает множество моделей от разных провайдеров, включая GPT-4o, Claude 3.5 Sonnet, Llama 3.1 и другие. Каждая модель имеет свои характеристики по стоимости, скорости и качеству. Разработчики могут сравнивать их в лидерборде и выбирать оптимальную под задачу.
Кого затронет и как
Новость в первую очередь важна для разработчиков, использующих AI Gateway для построения масштабируемых AI-приложений. Благодаря поддержке Bring Your Own Key, компании могут использовать собственные API-ключи Google, сохраняя контроль над расходами. Улучшенное качество Gemini 3.1 Flash Lite может повысить точность чат-ботов, ассистентов кода и систем обработки документов. Для российских разработчиков, которые работают через AI Gateway, это ещё один инструмент для создания конкурентных продуктов без привязки к одному провайдеру.
Что будет дальше
Ожидается, что Vercel продолжит расширять каталог моделей в AI Gateway, добавляя как новые версии от существующих провайдеров, так и поддержку новых вендоров. Gemini 3.1 Flash Lite пока доступна в предварительной версии (preview), и в будущем может получить стабильный релиз. Разработчикам стоит следить за обновлениями AI Gateway и тестировать модель в своих сценариях.
Итог
Gemini 3.1 Flash Lite — это своевременное пополнение арсенала AI Gateway, предлагающее баланс между стоимостью, скоростью и качеством. Разработчики, которые ищут эффективное решение для высоконагруженных AI-задач, теперь могут опробовать новую модель от Google без лишних интеграционных усилий.