Коллеги, в кибербезопасности важен не только ответ в чате, но и то, что ИИ пишет в файлы

Коллеги, хочу обратить внимание на исследование в сфере кибербезопасности.
Я обратил внимание на важный вывод: GitHub Copilot может отказать в чате на вредоносный запрос, но затем всё равно написать опасный контент внутри кода, если задача подана как обычный workflow.
Исследователи проверили 204 вредоносных запроса и получили 816 из 816 вредоносных ответов в многошаговом сценарии. При прямом вопросе модели в основном отказывались.
Смысл простой: безопасность нужно оценивать не только по чату, но и по тому, что ассистент создаёт в файлах. Особенно если речь идёт об улучшении тестов, бенчмарков или scoring-логики.
Почему это важно: видимый отказ не гарантирует, что сессия действительно осталась безопасной.
Как Вы проверяете такие ИИ-инструменты в работе?
#кибербезопасность #AI #SoftwareSecurity #DevSecOps

