W WikiBсвободна енциклопедия
Общество · Демокрация

Колективен конституционен AI

Колективният конституционен AI (Collective Constitutional AI) е изследователски проект на компанията Anthropic и организацията Collective Intelligence Project от октомври 2023 г., при който около 1000 представителни за САЩ граждани чрез платформата Pol.is съвместно написват набор от принципи, вложени пряко в поведението на голям езиков модел — един от първите документирани случаи, при които масово гражданско участие директно оформя политика на конкретна AI система.[1]

#изкуствен интелект #обмислена демокрация #гражданско участие #управление на AI #Pol.is

Контекст: „Асамблеи за съгласуване“

Проектът е част от поредица „Alignment Assemblies“ на Collective Intelligence Project — процеси на колективен разум, целящи гражданите да имат думата по решения за управлението на изкуствения интелект, вместо те да се вземат само от тесен кръг компании и институции.[2]

През 2023 г. подобни асамблеи са проведени и с други партньори — сред тях Белия дом (по въпроса за влиянието на генеративния AI върху демокрацията), OpenAI (относно приоритети за безопасност на езиковите модели) и Министерството на цифровите въпроси на Тайван — контекст, близък до процесите, описани в статията за vTaiwan.[2]

Методология: Pol.is и масовото допитване

Anthropic и Collective Intelligence Project канят представителна извадка от възрастни американци по възраст, пол, доход и география, за да участват в отворена платформа за допитване Pol.is — същата класа инструменти за машинно подпомогнато обсъждане, използвани в процесите на обмислена демокрация.[3]

На участниците са предоставени 21 примерни твърдения; те могат да гласуват по съществуващи предложения или да подават нови собствени относно това как трябва да се държи AI чатбот. Общо близо 1000 души подават 1127 твърдения и подават 38 252 гласа — средно по 34 гласа на човек.[4]

Резултати: как гражданската „конституция“ се различава

Принципите, съставени от гражданите, съвпадат по концепции и ценности около 50% с първоначалната „конституция“ на Anthropic — останалата половина показва забележими разлики: по-силен акцент върху обективността и безпристрастността, по-голямо внимание към достъпността и склонност да се насърчава желано поведение, вместо само да се избягва нежелано.[5]

При тестване моделът, обучен по гражданските принципи, постига резултати, равностойни на стандартния модел по езикови и математически показатели, но показва по-ниски резултати за пристрастност по всичките девет социални измерения в оценъчния тест BBQ, без съществена разлика в полезността или безобидността на отговорите.[6]

Значение за прехода към пряка демокрация в управлението на технологиите

Проектът показва конкретен, измерим път, по който инструменти на пряката демокрация — масово гласуване по твърдения, а не представителство чрез избрани органи — могат да повлияят пряко върху дизайна на технология, използвана от милиони хора, вместо само върху текстове на закони или референдуми.

Същевременно експериментът остава ограничен по мащаб (около 1000 участници от една държава) и доброволен за компанията, която го провежда — разлика спрямо задължителните референдуми или народни инициативи, разгледани в статията за референдума и народната инициатива, където резултатът е обвързващ по закон.

Вижте също

Доказателства към твърденията

  1. Anthropic — Collective Constitutional AI: Aligning a Language Model with Public Input
    Overview, October 2023

    Anthropic и Collective Intelligence Project провеждат проекта през октомври 2023 г. с около 1000 участници.

    Отвори източника
  2. Collective Intelligence Project — Alignment Assemblies
    Notable Assemblies, 2023

    Партньорства през 2023 г. с Белия дом, OpenAI и Министерството на цифровите въпроси на Тайван.

    Отвори източника
  3. Anthropic — Collective Constitutional AI: Aligning a Language Model with Public Input
    Methodology — Polis platform

    Използване на платформата Pol.is и подбор на представителна извадка участници.

    Отвори източника
  4. Anthropic — Collective Constitutional AI: Aligning a Language Model with Public Input
    Participant statistics

    Мащаб на участие: около 1000 души, 1127 твърдения, 38 252 гласа.

    Отвори източника
  5. Collective Constitutional AI: Aligning a Language Model with Public Input (FAccT 2024)
    Results — comparison with baseline constitution

    Разлики между гражданската и оригиналната конституция на Anthropic.

    Отвори източника
  6. Collective Constitutional AI: Aligning a Language Model with Public Input (FAccT 2024)
    Results — model evaluation (BBQ benchmark)

    Резултати от тестовете за пристрастност, полезност и безобидност на модела.

    Отвори източника
Човешки преглед

Предложи промяна

Предложението влиза в опашка за преглед. Нищо не се публикува автоматично.

Модерация

Докладвай проблем

Сигналът отива при човешки модератор. Подаването му не скрива и не променя съдържанието.