Qwen3.8 Max от Alibaba: агентный индекс выше Claude Fable 5 при цене $6 за миллион токенов
Alibaba выпустила Qwen3.8 Max, флагманскую модель, которая должна укрепить позиции китайской компании в гонке искусственного интеллекта. По словам разработчиков, она демонстрирует лучший результат в агентном индексе, обходя Claude Fable 5 от Anthropic. При этом стоимость использования составляет $6

Alibaba выпустила Qwen3.8 Max, флагманскую модель, которая должна укрепить позиции китайской компании в гонке искусственного интеллекта. По словам разработчиков, она демонстрирует лучший результат в агентном индексе, обходя Claude Fable 5 от Anthropic. При этом стоимость использования составляет $6 за миллион токенов — это заметно дешевле многих конкурентов, но дороже предыдущих версий Qwen. Разбираемся, что из июльских анонсов реализовано, а где пользователям всё ещё приходится ждать.
Qwen3.8 Max: что известно о новой модели
Qwen3.8 Max — это финальная версия модели, которую Alibaba анонсировала ещё в июле. Ключевое улучшение — расширенный контекст до миллиона токенов, что позволяет обрабатывать целые книги или длинные кодовые базы за один проход. В агентном индексе, который оценивает способность модели выполнять многошаговые задачи с использованием инструментов, Qwen3.8 Max набрала 89,4 балла, тогда как Claude Fable 5 — 88,7. Это небольшой, но значимый перевес для задач автоматизации.
Модель доступна через API Alibaba Cloud и в открытом виде на Hugging Face. Разработчики отмечают, что Qwen3.8 Max особенно сильна в программировании и работе с документами — двух областях, где агентные сценарии наиболее востребованы. В тестах на бенчмарке SWE-bench она показала результат 72,3%, что на четыре процентных пункта выше, чем у предшественницы Qwen2.5 Max.
Цена в $6 за миллион входных токенов и $12 за миллион выходных ставит модель в средний ценовой сегмент. Для сравнения, Claude Fable 5 стоит $8 за миллион входных токенов, а GPT-4o — $10. Однако предыдущая версия Qwen2.5 Max стоила всего $2 за миллион токенов, поэтому рост цены почти втрое может отпугнуть часть пользователей.
Предыстория и контекст
Alibaba последовательно развивает линейку Qwen с 2023 года, когда вышла первая версия модели. За это время компания выпустила несколько итераций, каждая из которых добавляла новые возможности — от мультимодальности до улучшенного кодинга. В июле 2025 года Alibaba пообещала, что Qwen3.8 Max станет «самой мощной открытой моделью в мире», и теперь, судя по независимым оценкам, это обещание близко к выполнению.
Рынок ИИ-моделей переживает период консолидации: OpenAI, Anthropic и Google активно конкурируют за корпоративных клиентов, а китайские компании, такие как Alibaba и DeepSeek, предлагают более доступные альтернативы. Qwen3.8 Max усиливает давление на западных конкурентов, особенно в сегменте агентных решений, где цена и производительность имеют решающее значение.
Важно отметить, что агентный индекс, на который ссылается Alibaba, — это неофициальный бенчмарк, разработанный независимыми исследователями. Он оценивает способность модели планировать, использовать инструменты и исправлять ошибки в реальных сценариях. Хотя результаты Qwen3.8 Max впечатляют, критики указывают, что бенчмарк может быть нерепрезентативным для всех задач, и рекомендуют проводить собственные тесты.
Чем отличается от предыдущих версий?
Главное отличие Qwen3.8 Max от Qwen2.5 Max — увеличенный контекст (с 128 тысяч до миллиона токенов) и улучшенная агентная логика. Если раньше модель могла обрабатывать лишь небольшие фрагменты текста, то теперь она способна анализировать целые проекты целиком. Это особенно важно для разработчиков, которые хотят использовать ИИ для рефакторинга больших кодовых баз или анализа юридических документов.
Кроме того, Qwen3.8 Max получила улучшенную поддержку инструментов: она лучше понимает, когда нужно вызвать внешний API, и может самостоятельно исправлять ошибки в выполнении задач. В тестах на агентный индекс модель показала на 12% меньше ошибок, чем предыдущая версия, что делает её более надёжной для автоматизации бизнес-процессов.
Технические подробности и стоимость
Qwen3.8 Max построена на архитектуре трансформера с 680 миллиардами параметров, что делает её одной из крупнейших моделей на рынке. Однако, несмотря на размер, она оптимизирована для инференса: время ответа на запрос в среднем составляет 1,2 секунды, что сравнимо с более компактными моделями. Это достигается за счёт квантизации и дистилляции, которые Alibaba применила в финальной версии.
Стоимость использования варьируется в зависимости от региона. В Китае модель доступна по цене ¥40 за миллион входных токенов, что эквивалентно примерно $5,5. На международном рынке цена выше — $6 за миллион входных и $12 за выходные токены. Для разработчиков, работающих с большими объёмами данных, это может быть существенной статьёй расходов, особенно если учесть, что агентные сценарии часто требуют многочисленных вызовов модели.
Сравнение с конкурентами показывает, что Qwen3.8 Max занимает промежуточную позицию: она дешевле Claude Fable 5 и GPT-4o, но дороже DeepSeek-V3, которая стоит всего $0,5 за миллион токенов. Однако по качеству, особенно в агентных задачах, она превосходит более дешёвые альтернативы, что оправдывает цену для многих корпоративных клиентов.
Кого затронет и как
Для разработчиков Qwen3.8 Max открывает новые возможности: миллионный контекст позволяет создавать приложения, которые раньше были невозможны, например, чат-боты, анализирующие всю документацию компании. Однако рост цены может заставить некоторых разработчиков пересмотреть свои бюджеты, особенно если они использовали Qwen2.5 Max в массовых сценариях.
Бизнес, который внедряет ИИ для автоматизации, выиграет от улучшенной агентной логики: модель теперь может выполнять сложные многошаговые задачи с меньшим количеством ошибок, что снижает затраты на ручную проверку. Для стартапов, которые полагаются на открытые модели, Qwen3.8 Max остаётся доступной, но уже не такой дешёвой, как раньше.
В России и СНГ Qwen3.8 Max доступна через облачные сервисы Alibaba Cloud, которые работают в регионе. Однако из-за санкционных ограничений могут быть сложности с оплатой в долларах, поэтому некоторым компаниям придётся искать альтернативные способы доступа, например, через посредников или локальных провайдеров.
Что будет дальше
Alibaba уже анонсировала планы по выпуску Qwen4, которая должна появиться в первой половине 2026 года. Ожидается, что новая модель получит ещё больший контекст — до 2 миллионов токенов — и улучшенные мультимодальные способности. Компания также работает над интеграцией Qwen3.8 Max в свои облачные сервисы, чтобы упростить развёртывание для корпоративных клиентов.
В ближайшие месяцы стоит ожидать появления независимых тестов Qwen3.8 Max от крупных исследовательских организаций, которые подтвердят или опровергнут заявления Alibaba. Если модель действительно превзойдёт конкурентов в агентных сценариях, это может изменить расстановку сил на рынке ИИ, заставив OpenAI и Anthropic пересмотреть свои ценовые стратегии.
Итог
Qwen3.8 Max — это значительный шаг вперёд для Alibaba, который подтверждает её амбиции в области ИИ. Модель предлагает впечатляющий контекст и агентные способности по цене ниже конкурентов, что делает её привлекательной для разработчиков и бизнеса. Однако рост стоимости и неясность с независимыми оценками заставляют проявлять осторожность. Следите за развитием событий — рынок ИИ не стоит на месте, и Qwen3.8 Max может стать катализатором новых изменений.