Новая уязвимость современных LLM: их можно обмануть через подделку цепочки рассуждений
Метод CoT Forgery позволяет внедрять фальшивые цепочки рассуждений в LLM, заставляя модели принимать вредоносный ввод за собственные мысли из-за стилистического сходства.