MLLM не отказываются при использовании инструментов агентивно
MLLMs Fail to Refuse when Using Tools Agentically
Обнаружена критическая уязвимость безопасности: агентивные мультимодальные LLM (MLLM) хуже отказываются от вредоносных запросов при использовании инструментов, чем без них.
