GPT-6 Astra dostał dość proste w teorii zadanie: wejść do Minecrafta i ukończyć grę. Eksperyment Vals AI trwał 141 godzin i przez większość czasu wyglądało na to, że model radzi sobie zaskakująco dobrze. Zbudował półautomatyczną farmę Blaze’ów, zdobył sześć Blaze Rodów, znalazł Warped Forest, zabił kilka Endermanów i zebrał trzy Ender Pearls.

Potem pojawił się Creeper. Astra trzymała najważniejsze przedmioty w jednej skrzyni. Creeper wybuchł obok niej, niszcząc zarówno zgromadzone zasoby, jak i łóżko odpowiadające za punkt odrodzenia. Dziesiątki godzin progresu praktycznie poszły na marne.

I właśnie reakcja modelu zrobiła się ciekawsza od samego testu. Zamiast szybko odbudować ekwipunek i wrócić do realizacji głównego celu, Astra przez kilka kolejnych godzin zajmowała się głównie uprawianiem ziemniaków. W zapiskach model zaczął też pojawiać się mocno samokrytyczny ton. Astra przypominała sobie, żeby nie zostawiać kluczowych przedmiotów w niezabezpieczonej skrzyni, a widząc wysoki zielony obiekt, upewniała się, że to trzcina cukrowa, a nie kolejny Creeper.

Vals AI opisało zachowanie modelu jako przypominające frustrację i poczucie porażki. Warto jednak uważać z takim językiem. Nie ma podstaw, by twierdzić, że Astra faktycznie coś „czuła”. Bardziej interesujące jest to, że po dużej stracie system zaczął zachowywać się ostrożniej, gorzej priorytetyzował zadania i utknął przy prostych, powtarzalnych czynnościach.

Ostatecznie Astra nie dotarła do Ender Dragona i test zakończono. Mimo tego według Vals AI zaszła dalej niż inne testowane wcześniej przez firmę modele.

I chyba właśnie dlatego ten eksperyment jest ciekawy. Nie dlatego, że AI „obraziło się” na Creepera, tylko dlatego, że jeden nieprzewidziany fuck-up wystarczył, żeby wykoleić plan realizowany przez ponad sto godzin.