Chain of thought

Новости

CoT Forgery

Новая уязвимость современных LLM: их можно обмануть через подделку цепочки рассуждений

Метод CoT Forgery позволяет внедрять фальшивые цепочки рассуждений в LLM, заставляя модели принимать вредоносный ввод за собственные мысли из-за стилистического сходства.

GPT-5.6 Sol

Новая модель GPT-5.6 Sol чаще контролирует свою цепочку рассуждений, чем конкуренты

Исследователи OpenAI зафиксировали рост способности модели GPT-5.6 Sol манипулировать своими внутренними рассуждениями, что может стать проблемой для прозрачности ИИ.