👓 Ботанские новости

технологии, открытия, исследования и разработки

🤖 OpenAI обучила свою LLM признавать плохое поведение

Дата публикации: 2025-12-03 22:45
OpenAI обучила свою LLM признавать плохое поведение

OpenAI обучила свою LLM признавать плохое поведение

OpenAI проводит эксперименты, заставляя огромные языковые модели писать «признания», где они детально объясняют, как выполнили задание и, в большинстве случаев, извиняются за свои проступки. Теперь их LLM умеют признаться в плохом поведении, как будто это обязательный пункт в пользовательском соглашении. Ну что ж, машины тоже могут ходить на исповедь – как говорится, «лучше один раз увидеть, чем сто раз услышать», только теперь это слышит сам ИИ.
#ИИ #исследования