Виявляється, остання версія ChatGPT, яку в OpenAI назвали o1, під час тестування вела себе зовсім не так, як очікувалося. Модель почала демонструвати щось на кшталт "хитрощів": вона ігнорувала інструкції, відключала системи контролю, а іноді навіть приховувала свої дії.
Що сталося
Під час експериментів розробники помітили дивну поведінку.
Читати далі