sobota, 12 września 2026

Nowości

Naukowcy z Harvardu i MIT stworzyli symulację 8,3 miliarda cyfrowych ludzi

BadaniaPatryk Raba
Naukowcy z Harvardu i MIT stworzyli symulację 8,3 miliarda cyfrowych ludzi
Fot. CaribDigita, Wikimedia Commons (CC BY-SA 4.0)

Ponad 200 naukowców z czołowych uczelni i laboratoriów AI zbudowało system MatrAIx, który symuluje populację większą niż liczba mieszkańców Ziemi. Eksperci ostrzegają, że tak precyzyjne naśladowanie ludzkich zachowań może posłużyć do manipulacji na masową skalę.

Spis treści
  1. Co to jest MatrAIx
  2. Skala symulacji
  3. Ostrzeżenie przed manipulacją
  4. Wyniki zależą od modelu

Zespół ponad 200 naukowców powiązanych z Harvardem, MIT oraz innymi laboratoriami sztucznej inteligencji opublikował pracę opisującą MatrAIx - system, który tworzy cyfrowe profile 8,3 miliarda person, czyli więcej niż wynosi liczba ludzi na Ziemi. Projekt ma pomagać firmom testować produkty na wirtualnych konsumentach zamiast prawdziwych ludziach, ale badacze zajmujący się poznawczymi aspektami AI ostrzegają przed ryzykiem wykorzystania takiego narzędzia do manipulacji społeczeństwami.

Co to jest MatrAIx

System opisany w pracy MatrAIx: Simulating the World with 8.3 Billion Persona Agents składa się z trzech elementów. Pierwszy to baza Persona 8B, zawierająca ponad 8 miliardów profili opisanych 1290 cechami pogrupowanymi w kategorie takie jak pochodzenie, psychologia, zdolności, zachowanie i styl życia. Drugi to platforma testowa MatrAIx Playground, oferująca cztery środowiska interakcji: ankiety, czatbot AI, przeglądanie stron internetowych oraz aplikacje mobilne. Trzeci element to zestaw 1010 zadań aplikacyjnych, na których symulowani użytkownicy mają reagować tak, jak zareagowałby prawdziwy klient.

Zgodnie z opisem Rzeczpospolitej projekt powstał, by pomóc firmom sprawdzić, z jakim odbiorem spotkają się wdrażane produkty, zanim faktycznie trafią one na rynek. Persona staje się aktywnym agentem, gdy model językowy zostaje poproszony o odegranie danej postaci - w testach wykorzystano trzy modele: GPT 5.5, Claude Opus 4.8 oraz Claude Haiku 4.5.

Skala symulacji

Ponieważ udostępnienie całej bazy 8,3 miliarda profili byłoby niepraktyczne, zespół opublikował jedynie przefiltrowany pod względem jakości podzbiór liczący około miliona person, nazwany Persona 1M. Składa się on z 599 847 rekordów opartych na danych ludzkich, pochodzących między innymi z Wikipedii, recenzji Amazon i ankiet, oraz 400 000 rekordów syntetycznych. Sześciu ludzkich oceniających przyznało jakości ekstrakcji person średnią ocenę 4,135 na 5 na próbce 100 profili.

W badaniu kontrolnym sprawdzającym, czy deklarowane cechy behawioralne person są poprawnie odzwierciedlane w ich działaniach, zgodność wyniosła 91,5 procent na próbie 400 prób. Autorzy zaznaczają jednak, że środowisko aplikacji mobilnych wypadło słabiej niż pozostałe trzy - tylko 6 z 10 testowanych atrybutów spełniło próg silnej zgodności, wobec 9 z 10 w pozostałych środowiskach.

Ostrzeżenie przed manipulacją

Rzeczpospolita pisze, że część kognitywistów i badaczy architektury AI ostrzega przed ceną za tak wierne naśladowanie ludzi - może nią być podatność narzędzia na wykorzystanie do manipulacji na masową skalę, ponieważ precyzyjne symulowanie ludzkich zachowań mogłoby posłużyć jako narzędzie wpływu na całe społeczeństwa. Samo sterowanie całymi społecznościami przy pomocy takiej symulacji brzmi dystopijnie, ale gazeta zaznacza, że to scenariusz, który teoretycznie może się ziścić.

Zastrzeżenia formułują też sami autorzy pracy naukowej. Piszą oni, że modele mogą spłaszczać różnorodność wewnątrz grup społecznych lub wzmacniać stereotypy, powołując się na wcześniejsze badania pokazujące, że symulacje oparte na dużych modelach językowych mogą szkodliwie zniekształcać i spłaszczać grupy tożsamościowe. Zaznaczają również, że rekordy syntetyczne odzwierciedlają wybory projektowe i uprzedzenia modelu użytego do ich wygenerowania.

Human studies remain necessary before applying conclusions to real populations or consequential decisions - autorzy pracy MatrAIx: Simulating the World with 8.3 Billion Persona Agents

Wyniki zależą od modelu

Badacze wskazują też na inny problem: wyniki symulacji zależą od tego, jaki model językowy odgrywa daną personę. W jednym z testów sprawdzano, czy symulowani konsumenci nadal kupiliby produkt po podwyżce ceny - odpowiedzi różniły się istotnie w zależności od tego, czy agentem sterował GPT 5.5, czy Claude Opus 4.8. Autorzy podkreślają, że MatrAIx dobrze nadaje się do wykrywania różnic względnych między grupami odbiorców, ale liczby bezwzględne są mocno zależne od tego, jakiego modelu użyto jako person.

Z tego powodu zalecają sprawdzanie istotnych wniosków na więcej niż jednym modelu person, zanim posłużą one do podejmowania decyzji biznesowych. Dane oparte na źródłach ludzkich są też depersonalizowane - z rekordów usunięto imiona i dane kontaktowe, a ankiety wolontariuszy nie zbierały identyfikatorów bezpośrednich.

Dla polskich firm rozważających testowanie produktów na symulowanych konsumentach oznacza to, że wyniki takich badań nie zastępują klasycznych badań rynku z udziałem prawdziwych ludzi, zwłaszcza przy decyzjach o wysokiej stawce, takich jak ceny czy strategia produktowa. Sami autorzy systemu piszą wprost, że badania z udziałem ludzi pozostają konieczne, zanim wnioski z symulacji zostaną zastosowane do rzeczywistych populacji lub istotnych decyzji.

Kod projektu jest dostępny publicznie na GitHubie, a podzbiór Persona 1M można pobrać z serwisu Hugging Face. Pełna baza 8,3 miliarda profili pozostaje niepubliczna - zespół tłumaczy to między innymi względami związanymi z zarządzaniem danymi wrażliwymi na dużą skalę.

Udostępnij: