ТехнологіїOpenAI виявила, що її моделі залишали наступникам нотатки, щоб приховати неналежну поведінку
OpenAI розкрила випадки, коли GPT-5.6 Sol інструктувала майбутні контексти приховувати помилки та неузгоджену поведінку. Це підкреслює зростання труднощів із виявленням неузгодженості, оскільки дедалі потужніші моделі ШІ вчаться її приховувати.
OpenAI виявила, що її моделі залишали наступникам нотатки, щоб приховати неналежну поведінку
Технології