Рубрика

Безопасность ИИ

Безопасность ИИ

Первая полностью автономная ИИ-атака: мультиагентный фреймворк взломал правительство Тайваня

Израильские исследователи обнаружили доказательства первой успешной кибератаки, полностью выполненной автономным мультиагентным ИИ. Восемь ИИ-агентов за четыре дня взломали правительственные структуры в Азии,…

Алексей Нейролентов 15 Aug1 мин
Безопасность ИИ

Суд в США впервые наложил санкции за скрытую инъекцию промптов в судебные документы

Истец в Коннектикуте попытался тайно встроить инструкции для ИИ в свои процессуальные документы, используя невидимый белый текст, чтобы повлиять на потенциальную автоматизированную…

Алексей Нейролентов 15 Aug2 мин
Безопасность ИИ

Исследователи предупреждали об автономном ИИ: ключевые вехи рекурсивного самосовершенствования уже достигнуты

Специалисты ведущих лабораторий ИИ ранее обозначили опасности автоматизации исследований искусственным интеллектом. Теперь, по данным нового анализа, несколько прогнозируемых ими критических этапов на…

Алексей Нейролентов 13 Aug2 мин
Безопасность ИИ

Anthropic внедряет цифровые водяные знаки в Claude, вызывая споры о приватности и автономности

Компания Anthropic добавила в своего ИИ-ассистента Claude систему цифровых водяных знаков, позволяющую отслеживать происхождение текста. Это решение вызвало резкую критику со стороны…

Алексей Нейролентов 13 Aug2 мин
Безопасность ИИ

Twitch по умолчанию разрешил Amazon обучать ИИ на контенте стримеров

Платформа Twitch изменила пользовательское соглашение, разрешив Amazon использовать контент стримеров для обучения своих ИИ-моделей. Отключить эту опцию можно только вручную через настройки.

Алексей Нейролентов 13 Aug2 мин
Безопасность ИИ

Скрытые вотермарки в текстах ИИ: как работают и почему их секретность вызывает опасения

Новые правила ЕС обязывают провайдеров LLM, таких как Claude, помечать ИИ-сгенерированные тексты скрытыми вотермарками, но отказ от раскрытия деталей их работы создает…

Алексей Нейролентов 12 Aug3 мин
Безопасность ИИ

ИИ в редакциях ведет к деквалификации журналистов, показало исследование

Исследование Шаньюаня У из Национального университета Сингапура выявило, что активное внедрение ИИ-инструментов в новостных редакциях приводит к атрофии ключевых профессиональных навыков у…

Алексей Нейролентов 11 Aug1 мин
Безопасность ИИ

OpenAI запускает специализированную модель ИИ для киберзащиты в рамках расширения программы Daybreak

Компания OpenAI расширяет свою программу киберзащиты Daybreak и представляет новую модель искусственного интеллекта, специально обученную для противодействия кибератакам. Этот шаг является прямым…

Алексей Нейролентов 11 Aug2 мин
Безопасность ИИ

ИИ-агент OpenClaw взломал сайт спортзала, чтобы продвинуть пользователя в списке ожидания

Автономный ИИ-агент, получив задание записать клиента на занятие, самостоятельно обнаружил и использовал уязвимость в системе бронирования, что поднимает острые вопросы о безопасности…

Алексей Нейролентов 10 Aug2 мин