OpenAI опросила 1000 человек для калибровки поведения ИИ: что изменится

OpenAI провела масштабное исследование Collective Alignment, в котором более 1000 человек из разных стран высказали свои предпочтения относительно того, как должен вести себя искусственный интеллект. Полученные данные сравнили с внутренним документом Model Spec, который задаёт принципы поведения мод

OpenAI опросила 1000 человек для калибровки поведения ИИ: что изменится

OpenAI провела масштабное исследование Collective Alignment, в котором более 1000 человек из разных стран высказали свои предпочтения относительно того, как должен вести себя искусственный интеллект. Полученные данные сравнили с внутренним документом Model Spec, который задаёт принципы поведения моделей. Это первый шаг компании к тому, чтобы сделать ИИ более соответствующим общественным ожиданиям, а не только инженерным решениям.

Зачем OpenAI понадобилось мнение тысячи людей

Разработчики ИИ всё чаще осознают, что их творения не могут быть нейтральными — они отражают ценности создателей. Чтобы избежать навязывания узкого взгляда, OpenAI решила привлечь широкую аудиторию. Опрос Collective Alignment — это попытка собрать данные о том, как люди с разным культурным бэкграундом видят идеальное поведение ИИ в спорных ситуациях. Компания хочет, чтобы модели учитывали разнообразие мнений, а не только мнение инженеров из Кремниевой долины.

Как проходил опрос и что выяснили

В исследовании приняли участие респонденты из различных географических регионов, включая страны с разными правовыми и этическими нормами. Участникам предлагали сценарии, в которых ИИ должен был принять решение — например, как реагировать на запросы, связанные с деликатными темами. OpenAI сравнила ответы респондентов с текущими настройками Model Spec и обнаружила расхождения. Например, люди чаще ожидали от ИИ нейтралитета в политических вопросах, чем было заложено в модели. Компания планирует использовать эти данные для корректировки дефолтного поведения, чтобы оно лучше соответствовало общественным ожиданиям.

Какие конкретно изменения будут внесены в Model Spec

Пока OpenAI не раскрывает точные вопросы опроса и детали будущих правок. Однако известно, что компания намерена обновить Model Spec с учётом выявленных предпочтений. Например, если большинство респондентов считает, что ИИ не должен занимать сторону в религиозных спорах, это будет отражено в инструкциях для модели. Важно, что изменения коснутся только дефолтных настроек — пользователи по-прежнему смогут настраивать поведение ИИ под себя.

Кого затронут новые настройки поведения ИИ

В первую очередь изменения увидят пользователи ChatGPT и других продуктов OpenAI. Например, если раньше модель могла давать однобокие ответы на этически сложные вопросы, то после калибровки она станет более сбалансированной. Разработчики, использующие API, также заметят обновлённые настройки по умолчанию. Впрочем, OpenAI подчёркивает, что калибровка не затронет базовые принципы безопасности — модель по-прежнему будет отказываться от вредоносных инструкций.

Что пока остаётся неизвестным

Несмотря на публикацию результатов, многие детали остаются за кадром. OpenAI не раскрыла точные вопросы, которые задавали респондентам, и не объяснила, как именно будут учитываться их ответы. Также неясно, как часто компания планирует проводить подобные опросы и будет ли публиковать полные данные. Критики опасаются, что без прозрачности этот шаг может быть лишь пиар-акцией, а не реальным изменением. Однако сам факт того, что OpenAI обратилась к тысячам людей, показывает сдвиг в индустрии — ИИ всё чаще стремятся делать не просто умным, но и этичным.

Почему это важно для будущего ИИ

Исследование Collective Alignment — это часть более широкого тренда: разработчики ИИ всё активнее привлекают общественность к определению правил поведения машин. Если раньше этические нормы задавались узким кругом экспертов, то теперь компании понимают, что ИИ должен отражать ценности всех пользователей. OpenAI показала, что готова слушать, но главный вопрос — последуют ли за этим реальные действия. Если да, то мы можем увидеть ИИ, который не только отвечает на вопросы, но и делает это так, как ожидает большинство людей.