Загрузка мероприятия...

Приглашаем на AI Security Meetup LLAMATOR x Selectel в Санкт-Петербурге, где теория безопасности ИИ сталкивается с практикой. Поговорим о реальных кейсах с теми, кто ежедневно строит и защищает ИИ-системы.
Mr Nereof
Организатор
12 декабря пройдет митап от LLAMATOR x Selectel, узнаем, как взламывают чат-ботов, как учат этому студентов и как не допустить скандалов с ИИ в продакшене. Мы собрали практиков, которые поделятся реальным опытом!
Спикеры и доклады:
➔ Владислав Попов, Data Scientist, Точка Банк
Тема: How to LLM?
О чем: Пустил ChatGPT в контур? А как насчет развернуть собственное решение, которое не будет сливать перс. данные? Разбираем полный цикл: критерии выбора модели, бенчмарки, адаптация под домен, валидация данных, детекция вредоносной нагрузки, тестирование и мониторинг.
➔ Абдулхамид Бучаев, Преподаватель ФБИТ, Университет ИТМО
Тема: Разбираем особенности ML Security: нужна ли моделям безопасность?
О чем: Классификация атак на модели ИИ, к каким аспектам безопасности они относятся, какой ущерб несут бизнесу и, самое главное, — в чем истоки используемых уязвимостей.
➔ Андрей Давид, Руководитель отдела продуктов клиентской безопасности, Selectel
Тема: ИИ как новый инсайдер: культура безопасного использования ИИ и защита от промпт-инъекций.
О чем: Так ли безопасны on-prem LLM? Типология джейлбрейков и промпт-инъекций. Как рассказать сотрудникам о безопасных практиках, как могут украсть системный промпт, и реальные примеры сработки атак.
➔ Александр Лебедев, Старший разработчик систем ИИ, Innostage / Лаборатория ИИ ВИТШ КГУ
Тема: Как мы в универе учились LLM ломать.
О чем: Рассказ о вузовском курсе и хакатоне: модели угроз, фреймворки для редтиминга и защиты. Как поднимали сервера с LLM на видеокартах 4080, ставили на них тг-ботов и какие стратегии атаки и защиты использовали команды.
➔ Никита Беляевский, AI Red Team Engineer, HiveTrace.
Тема: Come with me if you want to live... Учимся тестировать агента, чтобы он не превратился в Скайнет.
О чем: Зачем делать что-то самому, если можно поручить это агенту? Но как убедиться, что он не накликает беды? Разбираем, как правильно тестировать автономных агентов: примеры эпичных фейлов и атак, существующие бенчмарки, как построить свое тестирование и рекомендации по снижению рисков.