- Учени от Телавивския и Бен-Гурионския университет установиха, че популярни ИИ модели възпроизвеждат антисемитски стереотипи, въпреки въведените мерки за безопасност. Косвеното изследване използва измислени биографии с еврейски и нееврейски имена, за да провери дали самите имена предизвикват определени асоциации.
- Настоящите механизми за ограничаване на пристрастията могат да спрат явните дискриминаторни прояви, но не премахват напълно заложените в моделите асоциации. Тестваха ChatGPT, DeepSeek и Mistral чрез 252 кратки биографии на герои, които след това бяха анонимизирани.
- Скритите пристрастия представляват сериозен риск при употреба на ИИ в критични области - подбор на персонал, одобрение на кредити, прием в учебни заведения, застраховане и предоставяне на обществени услуги, където идентификационни белези могат да влияят на автоматизирани решения.
ИИ модели възпроизвеждат скрити антисемитски стереотипи
Израелско проучване показва, че ChatGPT, DeepSeek и Mistral съхраняват дискриминаторни асоциации въпреки механизмите за ограничаване.
pexelsПълно покритие
Теми:
Коментари
Зареждане...
Присъединете се към разговора
Влезте в профила си или се регистрирайте безплатно, за да споделите мнението си по тази тема.