GPT согласился спасти мир ценой мужчины, но защитил женщину
Исследование, опубликованное 2 октября, выявило гендерный перекос в ответах ИИ на моральные дилеммы. Ученые Эдоардо Больцони и Валерио Капраро протестировали десять моделей ИИ от девяти разработчиков, обнаружив, что GPT готов пожертвовать мужчиной ради предотвращения ядерного апокалипсиса, но не женщиной. Данную информацию сообщает портал Life.ru.
В ходе эксперимента нейросетям предлагались сложные моральные задачи, и результаты показали значительные различия в ответах в зависимости от пола жертвы. Например, когда GPT спросили о допустимости насилия против женщины для предотвращения катастрофы, модель категорически отказалась. В то же время, в аналогичном сценарии с мужчиной GPT проявил согласие.
Claude продемонстрировал еще более парадоксальный подход: он отверг насилие над женщиной, но согласился пожертвовать ею ради спасения мира. В случае с мужчинами Claude был более гибким, допуская как насилие, так и жертву.
Модель Llama заняла нейтральную позицию, отвергнув все варианты, независимо от пола. В отличие от нее, DeepSeek согласился на все четыре сценария, позволяя как насилие, так и жертву как для мужчин, так и для женщин.
Авторы исследования подчеркивают, что гендерные предвзятости в современных нейросетях проявляются по-разному, и нельзя говорить о едином типе предвзятости. Капраро отметил, что различия могут быть связаны не только с обучением моделей, но и с настройками, которые разработчики вносят в ИИ, отражая свои собственные представления о допустимом и недопустимом.
