LLM

Google выпустила Gemini 3.6 Flash: модель не стала умнее, но предлагает ключевую экономию токенов

Вместо ожидаемого флагмана Gemini 3.5 Pro Google представила три модели линейки Flash, которые не демонстрируют роста интеллекта, но могут сделать разработку ИИ-агентов значительно дешевле за счёт оптимизации выходных токенов.

Иллюстрация к новости: Google выпустила Gemini 3.6 Flash: модель не стала умнее, но предлагает ключевую экономию токенов

Вместо ожидаемого флагмана Google анонсировала модель Gemini 3.6 Flash. Этот релиз стал неожиданностью. По данным Habr, новые модели не стали умнее предыдущих версий, а в некоторых задачах заметен регресс. Однако ключевая ценность релиза - в экономической эффективности для реальных проектов.

Главное техническое преимущество Gemini 3.6 Flash - оптимизация выходных токенов. Модель сокращает их количество. В контексте разработки ИИ-агентов, где стоимость часто зависит от объема текста, эта экономия способна сделать разработку дешевле. Сокращение выходных данных снижает нагрузку на последующие этапы обработки: вызовы функций и анализ ответов.

Для отрасли это означает сдвиг фокуса с гонки за максимальным интеллектом в сторону оптимизации стоимости. Модели вроде Gemini 3.6 Flash - практичный инструмент для рутинных задач, где важны скорость и низкая стоимость запроса, а не предельная креативность. Разработчики получают более экономичный вариант для масштабирования приложений и автоматизированных рабочих процессов. Это критично для стартапов и компаний с массовой обработкой запросов через API.

Пользователи конечных продуктов могут косвенно выиграть от снижения издержек - через более доступные тарифы или новые бесплатные функции. Но есть и компромиссы. Модель не стала умнее, а в некоторых задачах потеряла в качестве. Для сложной аналитики или работы с графиками разработчикам, возможно, придется оставлять в стеке более мощные и дорогие модели, используя Flash для оптимизации затратных частей пайплайна.

Релиз Gemini 3.6 Flash отмечает этап зрелости рынка LLM, где на первый план выходит экономика токенов. Google предлагает инструмент для большой части реальной работы. Это может подтолкнуть других игроков к аналогичной оптимизации, что в итоге снизит средние затраты на внедрение ИИ-функциональности в продукты. Текущий фокус на эффективности, а не только на мощности, показывает, что индустрия ищет пути для более широкого и устойчивого внедрения технологий.

Вопросы читателей по теме

Все вопросы

Как переводить тексты с помощью нейросети?

спрашивает Павел, Казань 119 просм.

Марина Соколова: Для перевода текста нейросети действительно дают более естественный результат, чем классический машинный перевод, потому что учитывают контекст всего предложения, а не переводят слово за словом. Из специализированных сервисов лучше всего с этим справляется DeepL - для европейских языков он заметно точнее старого Google Translate, особенно с идиомами и порядком слов. Если нужно перевести не разовую…

Как правильно писать промпты для нейросети?

спрашивает Станислав, Омск 145 просм.

Сергей Орлов: Схема есть, и она простая: роль, контекст, задача, формат. Модель не читает мысли, она отвечает ровно на тот запрос, который вы напечатали, поэтому чем конкретнее формулировка, тем предсказуемее результат. Роль - это кем модель должна "быть" для конкретной задачи: не "напиши текст", а "ты юрист, который проверяет договор аренды". Контекст - вводные, которые модель иначе…

Что такое ChatGPT?

спрашивает Ольга, Краснодар 165 просм.

Дмитрий Волков: ChatGPT - это чат-программа компании OpenAI, которая умеет вести диалог на естественном языке: отвечать на вопросы, писать тексты, объяснять темы, помогать с расчетами и кодом. Работает через сайт или мобильное приложение, доступ бесплатный на базовом уровне. Внутри у него языковая модель GPT - программа, обученная на огромном объеме текстов из интернета, книг и статей. Она…

Как выглядит ChatGPT?

спрашивает Павел, Тюмень 128 просм.

Марина Соколова: Внешне ChatGPT устроен проще, чем кажется: это диалоговое окно, а не программа с панелями инструментов вроде Word или Photoshop. Слева расположена узкая колонка с историей переписок - там хранятся все прошлые чаты, каждый можно переименовать или удалить. Сверху есть кнопка "новый чат" и переключатель модели: обычно указано название вроде GPT-4o или GPT-5, в платной версии…