Технологии

ИИ модели възпроизвеждат скрити антисемитски стереотипи

Израелско проучване показва, че ChatGPT, DeepSeek и Mistral съхраняват дискриминаторни асоциации въпреки механизмите за ограничаване.

ИИ модели възпроизвеждат скрити антисемитски стереотипиpexels
Снимката е илюстративна
  • Учени от Телавивския и Бен-Гурионския университет установиха, че популярни ИИ модели възпроизвеждат антисемитски стереотипи, въпреки въведените мерки за безопасност. Косвеното изследване използва измислени биографии с еврейски и нееврейски имена, за да провери дали самите имена предизвикват определени асоциации.
  • Настоящите механизми за ограничаване на пристрастията могат да спрат явните дискриминаторни прояви, но не премахват напълно заложените в моделите асоциации. Тестваха ChatGPT, DeepSeek и Mistral чрез 252 кратки биографии на герои, които след това бяха анонимизирани.
  • Скритите пристрастия представляват сериозен риск при употреба на ИИ в критични области - подбор на персонал, одобрение на кредити, прием в учебни заведения, застраховане и предоставяне на обществени услуги, където идентификационни белези могат да влияят на автоматизирани решения.

Пълно покритие

Теми:
ТехнологииИзкуствен интелектДискриминацияПристрастияБезопасност на ИИ

Коментари

Зареждане...