Vercel снизила цены на GPT-5.6 и ускорила модель Sol в AI Gateway

Как сообщает Vercel Blog, платформа AI Gateway получила обновление тарифов и показателей производительности для языковых моделей семейства GPT-5.6. Разработчикам стали доступны удешевленные токены для Luna и Terra, а также двукратное ускорение быстрого режима модели Sol без необходимости менять код.

Vercel снизила цены на GPT-5.6 и ускорила модель Sol в AI Gateway

Компания Vercel объявила об изменениях в тарифной сетке и характеристиках производительности своего сервиса AI Gateway, ориентированного на разработчиков интеллектуальных приложений. Согласно опубликованным данным, обновления затронули модели openai/gpt-5.6-luna, openai/gpt-5.6-terra и openai/gpt-5.6-sol. Поскольку инфраструктура AI Gateway не добавляет собственную наценку на стоимость токенов, все изменения поступают пользователям напрямую по базовым ставкам провайдеров. Новые условия распространяются как на короткий, так и на длинный контекст запросов.

Новые расценки на модели Luna и Terra

Модель openai/gpt-5.6-luna получила самое заметное снижение стоимости, которое составило восемьдесят процентов от прежнего уровня. Теперь обработка короткого контекста обойдется разработчикам в ноль целых две десятые доллара за один миллион входных токенов, а выходные токены оцениваются в один доллар и двадцать центов за миллион единиц. Модель openai/gpt-5.6-terra стала дешевле на двадцать процентов, установив цену в два доллара за миллион входных токенов и двенадцать долларов за миллион выходных токенов.

Предыстория и контекст

Сервис AI Gateway создан для централизованного управления вызовами языковых моделей, помогая инженерным командам маршрутизировать запросы, контролировать лимиты и отслеживать метрики. С ростом популярности генеративных технологий расходы на инференс стали существенной статьей затрат для технологических компаний. Инфраструктурные решения, объединяющие мониторинг и оптимизацию трафика в единой точке входа, позволяют снизить операционные барьеры при создании продуктов.

Как изменилась модель Sol и что нужно менять в коде?

Как отмечает Vercel Blog, модель openai/gpt-5.6-sol сохранила прежнюю ценовую политику для короткого и длинного контекста, однако ее специальный быстрый режим стал работать в два с половиной раза быстрее по сравнению с базовой конфигурацией, тогда как ранее этот показатель составлял полтора раза. Важной особенностью обновления является то, что идентификаторы моделей остались неизменными. Благодаря этому существующие запросы автоматически переключаются на новые тарифы и повышенную скорость без необходимости редактировать программный код приложений.

Технические детали и маршрутизация токенов

Архитектура шлюза действует как прозрачный прокси-слой между клиентским софтом и апстрим-провайдерами. Отсутствие дополнительных комиссий за прохождение токенов через шлюз делает прогнозирование бюджетов более прозрачным. Обновленные цены и скоростные характеристики применяются автоматически, избавляя технические команды от ручного пересчета смет и миграции на новые версии идентификаторов API.

Кого затронут изменения

Нововведения напрямую касаются продуктовых разработчиков, стартапов и корпоративных команд, использующих инфраструктуру Vercel для интеграции передовых генеративных систем. Снижение стоимости обработки данных для моделей Luna и Terra делает масштабирование текстовых интерфейсов и аналитических систем более доступным. Это позволяет оптимизировать ИТ-бюджеты без ухудшения качества работы программных решений.

Что будет дальше

Платформа продолжит развивать инструменты управления сетевым трафиком и мониторинга запросов к моделям искусственного интеллекта. Ожидается дальнейшая интеграция вспомогательных функций для оптимизации расходов разработчиков непосредственно из панели управления сервисом.

Итог

Обновления AI Gateway от Vercel дают возможность снизить затраты на инфраструктуру и повысить скорость работы приложений на базе GPT-5.6. Следить за подобными изменениями полезно для сохранения конкурентоспособности и контроля над расходами на облачные ИИ-системы.