DeepSeek-R1 против OpenAI o1: сравнение ИИ Китая и США в 2025 году
Китайская компания DeepSeek представила новую языковую модель DeepSeek-R1, которая, по предварительным оценкам исследователей, сравнима по эффективности с лучшими американскими разработками, такими как OpenAI o1. Это событие может изменить баланс сил в мировой гонке ИИ, поскольку впервые китайская м

Китайская компания DeepSeek представила новую языковую модель DeepSeek-R1, которая, по предварительным оценкам исследователей, сравнима по эффективности с лучшими американскими разработками, такими как OpenAI o1. Это событие может изменить баланс сил в мировой гонке ИИ, поскольку впервые китайская модель достигает уровня топ-моделей США, несмотря на экспортные ограничения на чипы. Ученые из Nature протестировали DeepSeek-R1 и подтвердили ее конкурентоспособность в задачах математики, программирования и анализа текста.
DeepSeek-R1 показала результаты на уровне OpenAI o1
Модель DeepSeek-R1 стала результатом работы команды DeepSeek, которая смогла достичь высокой производительности при значительно меньших затратах на обучение. По данным Nature, учёные, протестировавшие модель, отмечают, что она демонстрирует конкурентоспособные показатели в задачах математического рассуждения, программирования и анализа текста. В частности, DeepSeek-R1 набрала 79,8% на тесте AIME 2024 (математические задачи), что лишь немного уступает 81,2% у OpenAI o1, но превосходит более старые модели, такие как GPT-4. В задачах программирования на бенчмарке Codeforces модель показала рейтинг 2029, что соответствует уровню сильного участника-человека и сопоставимо с o1. Эти результаты демонстрируют, что разрыв в производительности между китайскими и американскими ИИ сократился до статистически незначимого уровня.
Предыстория и контекст
Китай долгое время считался догоняющим в области ИИ, но с 2023 года начал активно наращивать темпы. Введение экспортных ограничений со стороны США на поставки передовых чипов Nvidia ускорило развитие собственных технологий. DeepSeek-R1 обучена на кластере из 2048 чипов Nvidia H800 — версии, разрешённой для экспорта в Китай, что демонстрирует возможность создания мощных моделей даже в условиях санкций. В отличие от более ранних китайских моделей, таких как Qwen и Ernie, которые отставали от американских аналогов на 10–20% по ключевым бенчмаркам, DeepSeek-R1 впервые сократила этот разрыв до минимума. Это стало возможным благодаря инновационной архитектуре и эффективному использованию доступных ресурсов.
Чем DeepSeek-R1 отличается от предыдущих китайских моделей?
Ранее китайские модели, такие как Qwen и Ernie, отставали от американских на 10–20% по ключевым бенчмаркам. DeepSeek-R1 впервые сократила этот разрыв до статистически незначимого уровня. Кроме того, модель использует архитектуру Mixture of Experts (MoE) с 671 миллиардом параметров, но активирует только 37 миллиардов при каждом запросе, что снижает вычислительные затраты. Это позволяет достигать высокой производительности при меньших энергозатратах и стоимости инференса. Для сравнения, OpenAI o1 имеет закрытую архитектуру, и точное количество параметров неизвестно, но по оценкам, она значительно дороже в обучении и эксплуатации.
Технические подробности и сравнение
DeepSeek-R1 основана на открытой архитектуре и частично опубликована в открытом доступе, что позволяет учёным проверять её работу. В отличие от закрытой OpenAI o1, китайская модель предлагает прозрачность, что может ускорить академические исследования. Однако точные данные о стоимости обучения не раскрываются; по оценкам, она могла составить около 6 миллионов долларов — в разы меньше, чем у американских конкурентов. Для сравнения, обучение GPT-4 обошлось, по слухам, в сотни миллионов долларов. DeepSeek-R1 также демонстрирует высокую эффективность в задачах логического вывода: на тесте GPQA (Graduate-Level Google-Proof Q&A) она набрала 71,5%, что близко к 73,3% у o1. В тесте MMLU (Massive Multitask Language Understanding) модель показала 90,8%, что лишь на 1% ниже результата o1.
Кого затронет и как
Для разработчиков и исследователей DeepSeek-R1 открывает доступ к мощному инструменту без привязки к американским платформам. Китайские компании, такие как Alibaba и Baidu, уже интегрируют модель в свои сервисы. Для потребителей это означает появление новых ИИ-продуктов с китайской спецификой, но с глобальным качеством. В России и СНГ модель может стать альтернативой для тех, кто ищет независимые от западных санкций решения. Кроме того, открытая архитектура позволяет адаптировать модель под локальные языки и задачи, что особенно важно для стран с ограниченным доступом к западным технологиям.
Что будет дальше
Ожидается, что DeepSeek продолжит улучшать модель, а конкуренция между Китаем и США усилится. Учёные предупреждают, что разрыв может полностью исчезнуть в течение года. Это ставит перед правительствами вопрос о регулировании и инвестициях в ИИ. Уже сейчас DeepSeek-R1 стимулирует американские компании ускорять разработки и снижать цены. В долгосрочной перспективе это может привести к демократизации доступа к мощным ИИ-моделям по всему миру.
Итог
DeepSeek-R1 — серьёзный сигнал, что китайский ИИ догнал американский по ключевым показателям. Следить за развитием этой модели стоит всем, кто работает с технологиями искусственного интеллекта. Она не только демонстрирует технический прогресс, но и меняет геополитический ландшафт в области ИИ, делая его более многополярным.