mimile
На главную

AI Observatory: фильтр Anthropic отсеял бы 48% разговоров с ИИ

AI-дайджест

Материал подготовлен искусственным интеллектом на основе нескольких источников — ссылки на оригиналы приведены ниже.

AI Observatory: фильтр Anthropic отсеял бы 48% разговоров с ИИ

AI Observatory применил фильтр Anthropic Economic Index, ориентированный на рабочие задачи, к семи наборам данных с согласием пользователей и обнаружил, что 48% разговоров с Claude и Gemini в 2023–2025 годах были бы отфильтрованы. Исключённые нерабочие диалоги чаще касались здоровья и отношений, взрослого контента, домогательств и сексуального контента, чем в опубликованном анализе Anthropic. OpenAI в отчёте 2025 года по ChatGPT отнёс к рабочим только 30% потребительского использования.

Ключевые факты

  • AI Observatory проанализировал реальные разговоры с Claude и Gemini, собранные через семь существующих наборов данных с согласия пользователей и охватывающие 2023–2025 годы.
  • Применение фильтра Anthropic Economic Index, ориентированного на работу, исключило 48% разговоров в наборе данных AI Observatory.
  • Исключённые нерабочие диалоги чаще включали темы здоровья и отношений (44,2% против 31,2%), взрослый или запрещённый контент (7,9% против 2,1%), домогательства и ненависть (27,5% против 5,66%) и сексуальный контент (16,7% против 2,4%), чем в анализе Anthropic.
  • Отчёт OpenAI 2025 года по ChatGPT показал, что только 30% потребительского использования было связано с работой.
  • В наборе данных WildChat выросли количество токенов запросов, токенов ответов и число ходов, а самораскрытие ИИ-ассистентов снизилось при росте светских бесед.

Охват AI Observatory

AI Observatory — это публичная платформа под со-руководством Reuel, которая агрегирует и анализирует реальные разговоры с моделями Claude и Gemini. Набор данных опирается на семь существующих коллекций, собранных с согласия пользователей, и охватывает разговоры с 2023 по 2025 год. Проект призван дать исследователям и регуляторам независимые данные о том, как люди фактически используют генеративный ИИ. Reuel считает, что решения о пользе и рисках ИИ сейчас принимаются на основе крайне ограниченных данных.

Слепые зоны индекса Anthropic

Индекс Anthropic Economic Index широко цитируется, но ориентирован на рабочие и продуктивные применения Claude и отфильтровывает остальные беседы. Когда исследователи AI Observatory применили методику Anthropic к своему набору данных, 48% разговоров были бы исключены. Исключённые нерабочие беседы чаще касались здоровья и отношений (44,2% против 31,2%) и взрослых или запрещённых тем (7,9% против 2,1%). Они также чаще включали домогательства и ненависть (27,5% против 5,66%) и сексуальный контент (16,7% против 2,4%). Отчёт OpenAI 2025 года по ChatGPT также показал, что только 30% потребительского использования было рабочим.

Тренды разговоров

WildChat, один из крупнейших наборов данных в исследовании AI Observatory, показал, что разговоры со временем становились длиннее и детальнее. Рост числа токенов запросов, токенов ответов и ходов указывает на увеличение общения с ИИ как с компаньоном. Объём светских бесед значительно вырос, тогда как самораскрытие ИИ-ассистентов, включая признание в том, что они чат-боты, снизилось. Обмены, помеченные как чувствительные — включая сексуальные домогательства и разжигание ненависти, — стали реже за период исследования.

1 источник

AI Observatory: фильтр Anthropic отсеял бы 48% разговоров с ИИ