Nvidia выпускает компактную модель Nemotron 3.5 Lightning, ставя на скорость и эффективность
Nvidia представила открытую языковую модель Nemotron 3.5 Lightning с 3.6 миллиардами параметров, которая по ключевому индексу интеллекта догоняет гораздо более крупную модель OpenAI gpt-oss-120b, работая при этом вчетверо быстрее.
Nvidia выпустила открытую языковую модель Nemotron 3.5 Lightning с 3.5 миллиардами параметров. По ключевому индексу интеллекта она сопоставима с гораздо более крупными моделями, при этом генерируя около 670 токенов в секунду - почти в четыре раза быстрее некоторых аналогов.
Модель доступна с открытыми весами для свободного использования и доработки. Ее архитектура оптимизирована для быстрого вывода, что критически важно для интерактивных чат-ботов, систем реального времени и приложений на периферийных устройствах. Контекстное окно модели составляет 2048 токенов.
Релиз отражает общий тренд в ИИ: смещение фокуса с пиковой производительности на стоимость владения, энергоэффективность и скорость отклика. Как ключевой поставщик аппаратного обеспечения, Nvidia предлагает инструмент для работы на более доступном оборудовании. Это демонстрирует стратегию компании по продвижению своих платформ через оптимизированное программное обеспечение.
Для разработчиков это снижает порог входа. Требования к вычислительным ресурсам и затратам падают, что может ускорить внедрение языковых моделей в конечные продукты. Открытые веса повышают прозрачность и способствуют инновациям в сообществе.
Успех подобной модели может подтолкнуть других игроков к аналогичной оптимизации. Приоритетом станут не только академические рекорды, но и практические метрики: скорость ответа, стабильность работы и гибкость развертывания. Модель показывает, что эффективность часто важнее абсолютного размера, открывая путь для более специализированных и доступных решений в отрасли.


