LLM

Как нейросети ищут ответы: исследование 686 тысяч подзапросов раскрывает внутреннюю кухню ИИ-поиска

Масштабный анализ показал, что крупные языковые модели не ищут ответ напрямую, а генерируют множество собственных формулировок запроса. Яндекс оказался лидером по ширине раскладки вопроса и уникально показывает, в какой именно поисковый индекс - веб, товары или карты - направляется каждый подзапрос.

Иллюстрация к новости: Как нейросети ищут ответы: исследование 686 тысяч подзапросов раскрывает внутреннюю кухню ИИ-поиска

Когда вы задаете вопрос ИИ-ассистенту, он не отправляет вашу фразу напрямую в поиск. Модель сначала создает несколько переформулировок вопроса - подзапросы, которые уже используются для сбора данных. Это ключевой, но скрытый этап работы нейросетевых поисковиков.

Исследование на Habr, изучившее 686 подзапросов от шести моделей, выявило различия в их стратегиях. В материале под номером 1072960 анализировалась работа обеих версий Яндекс.Алисы, ChatGPT, Gemini, Grok и DeepSeek.

Яндекс раскладывает исходный вопрос на большее число составляющих, чем ChatGPT. При этом Яндекс - единственный из изученных сервисов, кто открыто показывает, в какой поисковый индекс направляется каждый подзапрос: веб-поиск, поиск по товарам, картам, изображениям или видео. Это раскрывает логику планирования информационного сбора.

Исследование также выявило любопытные паттерны. Некоторые ассистенты самостоятельно подставляют в запросы названия брендов-конкурентов, иногда забывая упомянуть бренд из исходного вопроса. Это указывает на особенности алгоритмической обработки контекста.

Понимание логики генерации подзапросов - ключ к оптимизации ответов, снижению числа галлюцинаций и повышению релевантности. Стратегия раскладки вопроса напрямую влияет на полноту и точность собранной информации. Различия в подходах указывают на разные философии проектирования: одни ставят на ширину охвата, другие - на глубину в определенных типах запросов. Маркировка индексов у Яндекса - шаг к большей объяснимости в потребительских продуктах.

Для пользователей это значит, что качество ответа сильно зависит от того, насколько хорошо ИИ декомпозирует их запрос. Ошибки могут быть следствием не поиска, а этапа генерации подзапросов. Исследование показывает, что ИИ-поиск - это не магия, а многоэтапный процесс, где каждый шаг можно анализировать. Тенденция к прозрачности, вероятно, усилится под давлением пользователей и регуляторов, требуя от разработчиков более понятных и контролируемых систем.

Вопросы читателей по теме

Все вопросы

Как переводить тексты с помощью нейросети?

спрашивает Павел, Казань 119 просм.

Марина Соколова: Для перевода текста нейросети действительно дают более естественный результат, чем классический машинный перевод, потому что учитывают контекст всего предложения, а не переводят слово за словом. Из специализированных сервисов лучше всего с этим справляется DeepL - для европейских языков он заметно точнее старого Google Translate, особенно с идиомами и порядком слов. Если нужно перевести не разовую…

Как правильно писать промпты для нейросети?

спрашивает Станислав, Омск 145 просм.

Сергей Орлов: Схема есть, и она простая: роль, контекст, задача, формат. Модель не читает мысли, она отвечает ровно на тот запрос, который вы напечатали, поэтому чем конкретнее формулировка, тем предсказуемее результат. Роль - это кем модель должна "быть" для конкретной задачи: не "напиши текст", а "ты юрист, который проверяет договор аренды". Контекст - вводные, которые модель иначе…

Что такое ChatGPT?

спрашивает Ольга, Краснодар 165 просм.

Дмитрий Волков: ChatGPT - это чат-программа компании OpenAI, которая умеет вести диалог на естественном языке: отвечать на вопросы, писать тексты, объяснять темы, помогать с расчетами и кодом. Работает через сайт или мобильное приложение, доступ бесплатный на базовом уровне. Внутри у него языковая модель GPT - программа, обученная на огромном объеме текстов из интернета, книг и статей. Она…

Как выглядит ChatGPT?

спрашивает Павел, Тюмень 128 просм.

Марина Соколова: Внешне ChatGPT устроен проще, чем кажется: это диалоговое окно, а не программа с панелями инструментов вроде Word или Photoshop. Слева расположена узкая колонка с историей переписок - там хранятся все прошлые чаты, каждый можно переименовать или удалить. Сверху есть кнопка "новый чат" и переключатель модели: обычно указано название вроде GPT-4o или GPT-5, в платной версии…