Рубрика

Безопасность ИИ

Безопасность ИИ

Prompt-injection-атаки через скиллы: новая угроза безопасности для LLM-систем

Эксперты предупреждают о критической уязвимости в системах с большими языковыми моделями, использующими скиллы. Вредоносные инструкции могут заставить модель выполнить опасные действия, так…

Алексей Нейролентов 1 Jul1 мин
Безопасность ИИ

СверхИИ и будущее человечества: от уничтожения до цифровой диаспоры

Размышления о сверхИИ часто сводятся к вопросу физического уничтожения человечества, но автор предлагает рассмотреть более широкий спектр сценариев, где люди остаются живы…

Алексей Нейролентов 28 Jun2 мин
Безопасность ИИ

OpenAI ограничила выпуск GPT-5.6 по запросу правительства, но выступает против подобной практики

Компания OpenAI временно ограничила глобальный доступ к своей новейшей модели GPT-5.6 после запроса правительства США, но заявила, что подобные ограничения не должны…

Алексей Нейролентов 27 Jun1 мин
Безопасность ИИ

Экзистенциальный страх профессионалов: почему ИИ угрожает не работе, а идентичности

Сопротивление специалистов внедрению искусственного интеллекта часто списывают на луддизм или консерватизм, однако в его основе лежит более глубокая проблема - угроза профессиональной…

Алексей Нейролентов 25 Jun2 мин
Безопасность ИИ

Сотрудники Meta предупреждают о рисках из-за ускоренного внедрения ИИ для модерации

Внутренние источники в Meta выражают обеспокоенность темпами автоматизации модерации контента с помощью больших языковых моделей, опасаясь роста ошибок и потери контроля.

Алексей Нейролентов 25 Jun1 мин
Безопасность ИИ

ИИ-автоматизация угрожает не восстанием машин, а кадровым коллапсом в IT

Настоящая угроза от ИИ - не в восстании машин, а в системном кадровом кризисе, который может возникнуть из-за экономической целесообразности его внедрения.…

Алексей Нейролентов 25 Jun2 мин
Безопасность ИИ

OpenAI выпускает GPT-5.5-Cyber и обновляет Codex Security, переходя от поиска уязвимостей к их автоматическому исправлению

Компания OpenAI представила специализированную модель GPT-5.5-Cyber, которая, по её данным, превосходит конкурента Mythos от Anthropic в тестах по кибербезопасности, и обновила плагин…

Алексей Нейролентов 23 Jun2 мин