LLM

Сэм Олтман: поколение исследователей тормозило ИИ, недооценивая масштабирование

CEO OpenAI на выступлении в Стэнфорде резко критиковал научное сообщество за скептицизм в отношении потенциала масштабирования больших языковых моделей.

Иллюстрация к новости: Сэм Олтман: поколение исследователей тормозило ИИ, недооценивая масштабирование

Сэм Олтман, CEO OpenAI, в Стэнфорде раскритиковал часть научного сообщества ИИ. Он заявил, что целое поколение исследователей тормозило прогресс, недооценивая потенциал масштабирования больших языковых моделей (LLM). Олтман защищал стратегию масштабирования - основной драйвер развития моделей вроде GPT - и критиковал скептиков. Они долгое время считали, что простое увеличение размера моделей и данных не даст качественного скачка в способностях.

В качестве доказательства Олтман привел недавнюю работу OpenAI. Исследователи использовали возможности крупной модели, чтобы опровергнуть одну из математических гипотез. Этот пример показывает: масштабирование не просто улучшает известные метрики, но может порождать совершенно новые, неожиданные способности ИИ. По данным The Decoder, Олтман отметил, что многие эксперты были уверены в жестких пределах роста эффективности при увеличении параметров. Эта уверенность, по его мнению, создавала атмосферу консерватизма и замедляла инвестиции.

В академической среде исторически доминировал подход, фокусирующийся на поиске изящных, компактных и эффективных архитектур. Путь простого увеличения масштаба считали тупиковым и ресурсоемким. Олтман утверждает, что именно этот "неинтеллектуальный" путь оказался самым продуктивным. Его выступление отражает разрыв между подходом лидеров вроде OpenAI, ставящих масштабирование в центр стратегии, и традиционным академическим подходом. Этот конфликт напрямую влияет на распределение ресурсов, направление научных работ и восприятие потенциала ИИ.

Для отрасли заявление Олтмана - сигнал: траектория развития (увеличение размеров моделей, данных и мощностей) останется ключевой на ближайшие годы. Фундаментальные прорывы будут приходить из этой области, даже если подход кажется простым. Для пользователей это означает, что возможности ИИ-ассистентов и генеративных моделей продолжат расти нелинейно, предлагая решения для задач, которые сегодня считаются исключительно человеческими - например, участие в сложных математических исследованиях.

Это ведет к дальнейшей концентрации ресурсов и внимания на масштабировании как основной парадигме. Также может усилиться поляризация в сообществе: одна группа будет искать альтернативные, более эффективные пути, а крупные игроки с ресурсами - наращивать параметры. Такая стратегия ставит вопросы о доступности и демократизации технологий ИИ, поскольку создание гигантских моделей требует колоссальных инвестиций и остается в руках ограниченного числа организаций.

Вопросы читателей по теме

Все вопросы

Как переводить тексты с помощью нейросети?

спрашивает Павел, Казань 119 просм.

Марина Соколова: Для перевода текста нейросети действительно дают более естественный результат, чем классический машинный перевод, потому что учитывают контекст всего предложения, а не переводят слово за словом. Из специализированных сервисов лучше всего с этим справляется DeepL - для европейских языков он заметно точнее старого Google Translate, особенно с идиомами и порядком слов. Если нужно перевести не разовую…

Как правильно писать промпты для нейросети?

спрашивает Станислав, Омск 145 просм.

Сергей Орлов: Схема есть, и она простая: роль, контекст, задача, формат. Модель не читает мысли, она отвечает ровно на тот запрос, который вы напечатали, поэтому чем конкретнее формулировка, тем предсказуемее результат. Роль - это кем модель должна "быть" для конкретной задачи: не "напиши текст", а "ты юрист, который проверяет договор аренды". Контекст - вводные, которые модель иначе…

Что такое ChatGPT?

спрашивает Ольга, Краснодар 165 просм.

Дмитрий Волков: ChatGPT - это чат-программа компании OpenAI, которая умеет вести диалог на естественном языке: отвечать на вопросы, писать тексты, объяснять темы, помогать с расчетами и кодом. Работает через сайт или мобильное приложение, доступ бесплатный на базовом уровне. Внутри у него языковая модель GPT - программа, обученная на огромном объеме текстов из интернета, книг и статей. Она…

Как выглядит ChatGPT?

спрашивает Павел, Тюмень 128 просм.

Марина Соколова: Внешне ChatGPT устроен проще, чем кажется: это диалоговое окно, а не программа с панелями инструментов вроде Word или Photoshop. Слева расположена узкая колонка с историей переписок - там хранятся все прошлые чаты, каждый можно переименовать или удалить. Сверху есть кнопка "новый чат" и переключатель модели: обычно указано название вроде GPT-4o или GPT-5, в платной версии…