LLM

Nvidia выпускает компактную модель Nemotron 3.5 Lightning, ставя на скорость и эффективность

Nvidia представила открытую языковую модель Nemotron 3.5 Lightning с 3.6 миллиардами параметров, которая по ключевому индексу интеллекта догоняет гораздо более крупную модель OpenAI gpt-oss-120b, работая при этом вчетверо быстрее.

Иллюстрация к новости: Nvidia выпускает компактную модель Nemotron 3.5 Lightning, ставя на скорость и эффективность

Nvidia выпустила открытую языковую модель Nemotron 3.5 Lightning с 3.5 миллиардами параметров. По ключевому индексу интеллекта она сопоставима с гораздо более крупными моделями, при этом генерируя около 670 токенов в секунду - почти в четыре раза быстрее некоторых аналогов.

Модель доступна с открытыми весами для свободного использования и доработки. Ее архитектура оптимизирована для быстрого вывода, что критически важно для интерактивных чат-ботов, систем реального времени и приложений на периферийных устройствах. Контекстное окно модели составляет 2048 токенов.

Релиз отражает общий тренд в ИИ: смещение фокуса с пиковой производительности на стоимость владения, энергоэффективность и скорость отклика. Как ключевой поставщик аппаратного обеспечения, Nvidia предлагает инструмент для работы на более доступном оборудовании. Это демонстрирует стратегию компании по продвижению своих платформ через оптимизированное программное обеспечение.

Для разработчиков это снижает порог входа. Требования к вычислительным ресурсам и затратам падают, что может ускорить внедрение языковых моделей в конечные продукты. Открытые веса повышают прозрачность и способствуют инновациям в сообществе.

Успех подобной модели может подтолкнуть других игроков к аналогичной оптимизации. Приоритетом станут не только академические рекорды, но и практические метрики: скорость ответа, стабильность работы и гибкость развертывания. Модель показывает, что эффективность часто важнее абсолютного размера, открывая путь для более специализированных и доступных решений в отрасли.

Вопросы читателей по теме

Все вопросы

Как переводить тексты с помощью нейросети?

спрашивает Павел, Казань 119 просм.

Марина Соколова: Для перевода текста нейросети действительно дают более естественный результат, чем классический машинный перевод, потому что учитывают контекст всего предложения, а не переводят слово за словом. Из специализированных сервисов лучше всего с этим справляется DeepL - для европейских языков он заметно точнее старого Google Translate, особенно с идиомами и порядком слов. Если нужно перевести не разовую…

Как правильно писать промпты для нейросети?

спрашивает Станислав, Омск 145 просм.

Сергей Орлов: Схема есть, и она простая: роль, контекст, задача, формат. Модель не читает мысли, она отвечает ровно на тот запрос, который вы напечатали, поэтому чем конкретнее формулировка, тем предсказуемее результат. Роль - это кем модель должна "быть" для конкретной задачи: не "напиши текст", а "ты юрист, который проверяет договор аренды". Контекст - вводные, которые модель иначе…

Что такое ChatGPT?

спрашивает Ольга, Краснодар 165 просм.

Дмитрий Волков: ChatGPT - это чат-программа компании OpenAI, которая умеет вести диалог на естественном языке: отвечать на вопросы, писать тексты, объяснять темы, помогать с расчетами и кодом. Работает через сайт или мобильное приложение, доступ бесплатный на базовом уровне. Внутри у него языковая модель GPT - программа, обученная на огромном объеме текстов из интернета, книг и статей. Она…

Как выглядит ChatGPT?

спрашивает Павел, Тюмень 128 просм.

Марина Соколова: Внешне ChatGPT устроен проще, чем кажется: это диалоговое окно, а не программа с панелями инструментов вроде Word или Photoshop. Слева расположена узкая колонка с историей переписок - там хранятся все прошлые чаты, каждый можно переименовать или удалить. Сверху есть кнопка "новый чат" и переключатель модели: обычно указано название вроде GPT-4o или GPT-5, в платной версии…