
В последние годы компании, занимающиеся искусственным интеллектом, такие как Anthropic и OpenAI, регулярно публикуют отчеты о том, как люди используют их продукты, такие как Claude и ChatGPT. Однако, как отмечают исследователи в области ИИ, эти отчеты содержат лишь ту информацию, которую компании хотят показать. "Нет независимого источника, который мог бы это подтвердить", — говорит Анка Рейл, аспирантка кафедры информатики Стэнфордского университета и со-лидер нового исследовательского проекта под названием AI Observatory.
Цели AI Observatory
AI Observatory — это публичная платформа, которая агрегирует и анализирует реальные разговоры с популярными моделями ИИ, такими как Claude и Gemini, собранные с согласия пользователей из семи существующих наборов данных. Основная цель проекта — предоставить независимые источники информации, которые помогут исследователям и политикам оценить, как люди используют генеративный ИИ. Анка Рейл подчеркивает, что на основе очень ограниченных данных в настоящее время принимаются важные решения о преимуществах и рисках ИИ.
Результаты исследования
AI Observatory обнаружил, что использование ИИ значительно различается между моделями и изменялось со временем. Исследование показало множество более чувствительных поведений, чем те, которые фиксируются в отчетах крупных компаний, которые, как правило, акцентируют внимание на рабочих аспектах, а не на личном использовании.
Одним из наиболее известных источников данных о использовании ИИ является Anthropic Economic Index, однако у него есть свои ограничения. Как следует из названия, он сосредоточен на рабочих и производительных аспектах использования Claude, исключая разговоры, не относящиеся к этим темам. Когда исследователи AI Observatory применили методы Anthropic к своему набору данных, они обнаружили, что почти половина разговоров — 48% — была бы отфильтрована. Эти разговоры чаще касались здоровья и отношений (44.2% против 31.2% в анализе Anthropic), взрослых или незаконных тем (7.9% против 2.1%), домогательств и ненависти (27.5% против 5.66%) и сексуального контента (16.7% против 2.4%). В отчете OpenAI за 2025 год о ChatGPT также было указано, что лишь 30% потребительского использования связано с работой.
Разнообразие использования ИИ
AI Observatory также обнаружил, что темы, стили взаимодействия, структуры разговоров и вероятность использования чувствительных случаев различаются от модели к модели. Например, пользователи чаще обращались к Grok и Gemini для поиска информации. Grok, в частности, был особенно популярен для получения новостей и политической информации, но именно здесь также наблюдалось сосредоточение дезинформации. В то же время пользователи чаще обращались к Anthropic для программирования, к Gemini — для социальных и ролевых взаимодействий, а к ChatGPT — для помощи с домашними заданиями.
Динамика взаимодействия
Данные AI Observatory охватывают разговоры, происходившие между 2023 и 2025 годами, и показывают изменения как в использовании ИИ, так и в реакциях различных платформ. Например, разговоры в WildChat, одном из крупнейших и наиболее детализированных наборов данных, стали длиннее и более развернутыми с течением времени, что подтверждается увеличением количества токенов запросов, токенов ответов и поворотов разговоров. Также наблюдалось значительное увеличение "маленьких разговоров" с течением времени, что может свидетельствовать о росте потребности в общении с ИИ. В то же время саморазоблачение ИИ (т.е. признание себя чат-ботом) стало менее частым.
Ограничения и будущее AI Observatory
Несмотря на то, что данные AI Observatory являются ценным вкладом в исследовательское сообщество, они, вероятно, недооценивают чувствительные случаи, поскольку люди могут быть менее склонны делиться такой информацией. Исследователи предупреждают, что их выводы не отражают всего спектра использования ИИ. Проект предоставляет доступ к данным для анализа, и команда надеется со временем расширить свои наборы данных.
В идеале, как говорит Анка Рейл, компании по ИИ должны делиться своими данными с независимыми исследователями, соблюдая при этом защиту конфиденциальности пользователей. Однако в текущих условиях, по ее словам, любой, кто принимает решения на основе данных о использовании ИИ, рискует "действовать в условиях неопределенности и принимать действительно важные решения, не зная, что на самом деле происходит за пределами нарративов компаний".
Комментарии (0)