Рубрика

LLM

LLM это большие языковые модели, на которых работают чат-боты и ассистенты. Здесь про новые версии GPT, Claude, Gemini, Llama и DeepSeek: что реально изменилось в качестве ответов, сколько стоит API, какие модели можно запустить на своём железе.

LLM

GPT-4o повышает оценки студентов, но не знания: исследование Университета Боккони выявило иллюзию обучения

Эксперимент с участием более тысячи студентов показал, что использование GPT-4o для выполнения задания по маркетингу поднимает средний балл почти на целый пункт,…

Алексей Нейролентов 30 Aug2 мин
LLM

Битва за контекст: как методы масштабирования RoPE, NTK-aware, YaRN и LongRoPE расширяют окно внимания языковых моделей

Практическое исследование ключевых методов, которые позволяют языковым моделям работать с контекстом, превышающим их обучающее окно, и их влияние на производительность современных LLM.

Алексей Нейролентов 30 Aug2 мин
LLM

Для ингушского языка создали первый морфологический анализатор и корпус из полумиллиона словоформ

Лингвисты и разработчики решили фундаментальную проблему для языка, не имевшего цифровых ресурсов, построив инструменты автоматической обработки с нуля и преодолев спорность академических…

Алексей Нейролентов 29 Aug1 мин
LLM

Почему ИИ-код для микроконтроллеров не работает: фундаментальный разрыв между LLM и embedded-реальностью

Большие языковые модели генерируют код для микроконтроллеров, который компилируется, но не работает, потому что LLM не знают специфики конкретного железа - конфигурации…

Алексей Нейролентов 29 Aug2 мин
LLM

Qwen 4: архитектурное превью бросает вызов вычислительной сложности LLM

Команда Qwen представила раннее превью архитектуры Qwen 4, в основе которой лежат новые механизмы внимания, призванные кардинально снизить потребление памяти и вычислительных…

Алексей Нейролентов 28 Aug2 мин
LLM

Zhipu AI выпустила GLM-5.3-Flash: мощная модель на китайских чипах и в семь раз дешевле

Китайская компания Zhipu AI представила открытую языковую модель GLM-5.3-Flash с 320 миллиардами параметров, которая демонстрирует производительность, близкую к более крупным флагманским моделям,…

Алексей Нейролентов 27 Aug1 мин
LLM

IBM выпустила открытые модели Granite 4.2 со встроенными агентскими способностями

Компания IBM представила новое поколение своих открытых языковых моделей Granite 4.2, которые выделяются не только огромным контекстом, но и встроенными возможностями для…

Алексей Нейролентов 26 Aug1 мин
LLM

Практический тест 18 вариантов квантования Ornith-1.5 и Qwen3.8: Q5/Q6 для 9B моделей оказались оптимальны

Пользователь провел масштабное практическое тестирование, сравнив 18 конфигураций квантования для моделей Ornith-1.5 и Qwen3.8 на одной видеокарте, чтобы определить баланс между качеством…

Алексей Нейролентов 25 Aug2 мин