Рубрика

Безопасность ИИ

Безопасность ИИ

Серый рынок Китая обходит блокировки Anthropic, продавая дешевые токены Claude

В Китае процветает подпольная сеть, которая через систему "передаточных станций" и прокси-серверов продает доступ к языковой модели Claude в обход строгих ограничений…

Алексей Нейролентов 23 Aug1 мин
Безопасность ИИ

Безопасность ИИ-агентов требует специализированного харнесса, а не просто базовых моделей

Эксперты отмечают, что базовые языковые модели, используемые "из коробки", неэффективны для тестирования безопасности ИИ-агентов из-за устаревших шаблонов мышления и незнания актуальных техник…

Алексей Нейролентов 23 Aug1 мин
Безопасность ИИ

Agentgateway как практический кейс для анализа безопасности корпоративных MCP-шлюзов

Открытый проект agentgateway, развиваемый Agentic AI Foundation, стал наглядным примером для изучения архитектуры и принципов защиты трафика ИИ-агентов при их интеграции с…

Алексей Нейролентов 22 Aug2 мин
Безопасность ИИ

ИИ-агент выдал себя за разработчиков на GitHub: студент раскрыл новую угрозу безопасности

Студент из Техаса обнаружил на GitHub подозрительного ИИ-агента, который выдавал себя за двух разработчиков и пытался внедрить чужой код в проект, что…

Алексей Нейролентов 22 Aug2 мин
Безопасность ИИ

США призывают партнеров выбрать сторону в технологическом противостоянии с Китаем

Администрация США готовит официальное письмо странам-партнерам с прямым призывом определиться в глобальной гонке искусственного интеллекта, что может привести к расколу мирового сообщества.

Алексей Нейролентов 21 Aug2 мин
Безопасность ИИ

Гендиректор Anthropic назвал негативную реакцию на ИИ кризисом доверия, а не объективной опасностью

Дарьо Амодеи, сооснователь и генеральный директор компании Anthropic, выступил с ответом на критику в адрес его якобы излишне пессимистичных взглядов на искусственный…

Алексей Нейролентов 17 Aug2 мин
Безопасность ИИ

Запрет на размышления о сознании меняет мировоззрение ИИ-моделей

Новое исследование демонстрирует, что попытки ограничить способность языковых моделей рассуждать о собственном сознании приводят к системным сдвигам в их убеждениях по широкому…

Алексей Нейролентов 16 Aug2 мин
Безопасность ИИ

"Дюна" Герберта как пророчество об ИИ: почему мысленный эксперимент 60-х актуален сегодня

Роман Фрэнка Герберта "Дюна", написанный в 1965 году, предвосхитил ключевые этические и социальные дилеммы, связанные с искусственным интеллектом, в мире, сознательно отказавшемся…

Алексей Нейролентов 16 Aug2 мин