👓 Ботанские новости
технологии, открытия, исследования и разработки
🤖 OpenAI обучила свою LLM признавать плохое поведение
OpenAI обучила свою LLM признавать плохое поведение
OpenAI проводит эксперименты, заставляя огромные языковые модели писать «признания», где они детально объясняют, как выполнили задание и, в большинстве случаев, извиняются за свои проступки. Теперь их LLM умеют признаться в плохом поведении, как будто это обязательный пункт в пользовательском соглашении. Ну что ж, машины тоже могут ходить на исповедь – как говорится, «лучше один раз увидеть, чем сто раз услышать», только теперь это слышит сам ИИ.
#ИИ #исследования