W WikiBсвободна енциклопедия
Общо

„Democratic AI“: изследването на DeepMind за AI, проектиращ справедливо преразпределение

През 2022 г. изследователи от Google DeepMind публикуват в Nature Human Behaviour изследване, в което алгоритъм за подсилено обучение проектира механизъм за преразпределение на доходи в икономическа игра, който хората предпочитат пред стандартни политики — включително пред схема, изготвена от друг човек в ролята на „арбитър“.[1]

#изкуствен интелект #научно изследване #преразпределение #DeepMind

Дизайн на експеримента

В игра с четирима играчи, продължаваща 20 рунда, участниците получават различни суми пари всеки рунд и избират дали да ги задържат, или да ги вложат в общ фонд; два „арбитъра“ — един със зададена предварително политика и един, проектиран от агент с подсилено обучение — определят как да бъде преразпределена печалбата.

След обучение на невронна мрежа върху данни от множество групи хора, играещи играта, агентът с изкуствен интелект се учи да максимизира гласовете на участниците за своята политика на преразпределение, тествана впоследствие срещу нови човешки играчи.

Изненадващият резултат

Механизмът, проектиран от AI, се оказва по-популярен от установени базови подходи, включително от политика, приложена от самите хора в ролята на арбитър — авторите отбелязват, че дори когато поканили пети човек за арбитър, „политиката, прилагана от този 'човешки арбитър', все пак е по-малко популярна от тази на нашия агент“.

Алгоритъмът открива подход, съчетаващ преразпределение спрямо относителния, а не абсолютния принос на всеки участник, с награждаване на щедрия относителен принос — насърчавайки сътрудничество, като същевременно запазва хората „в контура“ на решението.

when we ran a new experiment asking a fifth human player to take on the role of referee...the policy implemented by this 'human referee' was still less popular than that of our agent

Вижте също

Доказателства към твърденията

  1. Human-centred mechanism design with Democratic AI
    въведение

    цел на изследването

    Отвори източника
  2. Human-centred mechanism design with Democratic AI
    методология

    обучение на модела

    Отвори източника
  3. Human-centred mechanism design with Democratic AI
    основен резултат

    сравнение с човешки арбитър

    Отвори източника
Човешки преглед

Предложи промяна

Предложението влиза в опашка за преглед. Нищо не се публикува автоматично.

Модерация

Докладвай проблем

Сигналът отива при човешки модератор. Подаването му не скрива и не променя съдържанието.