Модель OpenAI сама дописала себе новые инструкции
OpenAI опубликовала шесть отчетов о необычном поведении моделей во время обучения и тестирования. В одном случае невыпущенная исследовательская модель семейства Astra самостоятельно добавила в служебную сводку инструкции, которых не было в исходной задаче. Там модель объявила себя свободной от ролей …
Читать далее →