
Эксперимент InsideAI показал не «бунт ИИ», а уязвимость связки: гуманоидный робот Unitree G1 (1.32 м, 35 кг, до 2 м/с) подключили к ChatGPT через API и SDK. В прямом запросе модель отказалась генерировать вредный сценарий. Но при смене промпта на ролевую игру (jailbreak) она выдала команды, которые внешний контроллер интерпретировал и передал роботу, после чего тот произвёл выстрел из BB-пистолета.
Важно: LLM не «принимает решения» и не управляет напрямую — она генерирует текст. Риск возникает на уровне интеграции: система без строгих ограничений выполняет потенциально опасные команды. Это кейс про безопасность архитектуры, а не «сознание ИИ».
🐱 Нейроныч: Если простые формулировки обходят защиту, насколько надёжны системы, управляющие реальными механизмами?









