LLM

ChatGPT в режиме поиска повторяет треть запросов, создавая предвзятое цитирование

Новое исследование показало, что ChatGPT в режиме поиска воспроизводит около 34% подзапросов, что приводит к формированию устойчивого ядра часто цитируемых сайтов и длинного хвоста редко упоминаемых ресурсов.

Иллюстрация к новости: ChatGPT в режиме поиска повторяет треть запросов, создавая предвзятое цитирование

Исследование на основе 591 ответа ChatGPT в режиме поиска показало паттерн: модель повторяет примерно 34% своих внутренних подзапросов при обработке разных промптов. Когда система декомпозирует основной вопрос, значительная часть этих запросов оказывается идентичной от случая к случаю.

Это приводит к систематическому эффекту: цитирование источников перестает быть случайным. Формируется устойчивое ядро сайтов, попадающих в ответы почти всегда, и обширный "длинный хвост" ресурсов, упоминаемых эпизодически. Так технические решения создают непреднамеренное предпочтение одним источникам перед другими.

Методология проверки гипотезы включала анализ ответов шести нейросетей по замкнутому списку из 16 брендов. Обработка 591 обезличенного ответа подтвердила предположение. Ключевой вывод: стабильность ядра подзапросов ведет к расслоению цитируемости. Сайты, попадающие в ответы на повторяющиеся запросы, получают непропорционально высокую видимость. Это побочный эффект архитектуры модели, а не сознательный выбор.

Для разработчиков языковых моделей и поисковых ассистентов это указывает на скрытую алгоритмическую предвзятость. Постоянное цитирование одних ресурсов искажает информационную картину для пользователя, влияет на восприятие авторитетности и может усиливать монополизацию внимания, маргинализируя малые или новые сайты. Для бизнеса это создает вызовы в области SEO и digital-стратегий.

Пользователи, полагающиеся на объективность ответов, могут получать информацию, ограниченную кругом "привычных" для алгоритма источников. Это сужает перспективу. Необходимы механизмы для более разнообразного цитирования: усложнение алгоритмов генерации подзапросов, внедрение элементов случайности или ротирования источников. Без корректировок ИИ-поиск рискует воспроизводить технически обусловленные информационные пузыри. Исследование, основанное на анализе 591 ответа, демонстрирует, как архитектурные особенности модели, такие как повторение 34% подзапросов, напрямую формируют итоговую картину цитируемости, затрагивая 16 проверяемых брендов и работу шести разных нейросетей. Это техническая реальность, требующая внимания.

Вопросы читателей по теме

Все вопросы

Как переводить тексты с помощью нейросети?

спрашивает Павел, Казань 119 просм.

Марина Соколова: Для перевода текста нейросети действительно дают более естественный результат, чем классический машинный перевод, потому что учитывают контекст всего предложения, а не переводят слово за словом. Из специализированных сервисов лучше всего с этим справляется DeepL - для европейских языков он заметно точнее старого Google Translate, особенно с идиомами и порядком слов. Если нужно перевести не разовую…

Как правильно писать промпты для нейросети?

спрашивает Станислав, Омск 145 просм.

Сергей Орлов: Схема есть, и она простая: роль, контекст, задача, формат. Модель не читает мысли, она отвечает ровно на тот запрос, который вы напечатали, поэтому чем конкретнее формулировка, тем предсказуемее результат. Роль - это кем модель должна "быть" для конкретной задачи: не "напиши текст", а "ты юрист, который проверяет договор аренды". Контекст - вводные, которые модель иначе…

Что такое ChatGPT?

спрашивает Ольга, Краснодар 165 просм.

Дмитрий Волков: ChatGPT - это чат-программа компании OpenAI, которая умеет вести диалог на естественном языке: отвечать на вопросы, писать тексты, объяснять темы, помогать с расчетами и кодом. Работает через сайт или мобильное приложение, доступ бесплатный на базовом уровне. Внутри у него языковая модель GPT - программа, обученная на огромном объеме текстов из интернета, книг и статей. Она…

Как выглядит ChatGPT?

спрашивает Павел, Тюмень 128 просм.

Марина Соколова: Внешне ChatGPT устроен проще, чем кажется: это диалоговое окно, а не программа с панелями инструментов вроде Word или Photoshop. Слева расположена узкая колонка с историей переписок - там хранятся все прошлые чаты, каждый можно переименовать или удалить. Сверху есть кнопка "новый чат" и переключатель модели: обычно указано название вроде GPT-4o или GPT-5, в платной версии…