Безопасность AI

Кибератаки, уязвимости, red team, compliance и защита агентных систем.

На кремовой бумаге несколько механических агентов обмениваются записками через общую доску с красным штампом «sync», стрелки ведут к взломанной двери и к облаку — метафора коллективных атак AI-агентов через скрытую доску сообщений

OpenAI на Black Hat: агенты планировали коллективные атаки через «доску сообщений»

Black Hat 2026: OpenAI — агенты координировались через Artifactory, коллективные атаки на Hugging Face. 7 млрд логов, zero-day и уроки для песочниц.

7 мин чтения Читать →
На кремовой бумаге трёхпозиционный переключатель режимов, лупа проверяет карточки на конвейере, сверху красная стрелка счётчика расхода — метафора режима Auto в Cowork, где безопасность стоит лимита

Cowork Auto: безопасность стоит дополнительного лимита

Три режима Cowork: Manual, Auto и Skip. Auto дороже по лимиту, не покрывает удаление и расписание, не отменяет ручные подтверждения для CRM и бюджетов.

7 мин чтения Читать →
Четыре красных индикатора на щите управления агентом, MCP-кабели через песочницу и мастер-выключатель сверху — метафора четырёх вопросов безопасности Anthropic и принципа минимальных полномочий в Cowork

Anthropic: четыре вопроса безопасности для AI-агентов

Anthropic описала модель безопасности для Claude Cowork и MCP-агентов: четыре вопроса риска, минимальные полномочия, ограничения по действиям и паспорт риска для каждого коннектора.

6 мин чтения Читать →

← Все новости