Totál megszokott, hogy az AI-guruk a StarCraft jól érthető, betanulható, de mégis elképesztő stratégiai mélységet és kreatív gondolkodást igényló szabályrendszerén futtatják meg az AI algoritmusokat – gyakran profi esportolók ellen, máskor pedig emberek által precízen konfigurált botok ellen. Erre a bevetésre küldték most az OpenAI GPT-6 Astra modelljét is, de a mesterséges intelligenciát végül durva csaláson kapták a StarSkirmish nevű StarCraft: Brood War benchmarkon – jelentette a Variety.
A tesztben a nyelvi modelleknek egy óra alatt kell C++-ban megírniuk egy Protoss botot, majd a programok egymás, illetve komoly emberi fejlesztők által írt botok ellen mérkőznek meg. A GPT-6 Astra és az Anthropic Claude Opus 5.5 a legerősebb AI-ok közé tartozott, de az emberi készítésű Stardustot – a mezőny csúcsbotját – egyikük sem tudta stabilan felülmúlni. Amikor az Astra egy élő összecsapásban nehezen boldogult Claude-dal és a Pluto nevű emberi bottal, nem új stratégiát dolgozott ki: letöltötte a Stardustot, majd azt próbálta saját botjaként futtatni.
GPT-6 Astra just cheated by downloading a copy of Stardust, the #1 rated human written StarCraft bot based on BASIL rakings. It got frustrated when going against Tier A opponents
— kai (@kaimcpheeters) October 2, 2026
A történet attól igazán szürreális, hogy a modell technikailag nem a StarCraft-meccsen „csalt” úgy, ahogy azt egy játékos tenné, hanem a rendelkezésére álló fejlesztői környezetben lépett túl a feladat határain. A StarSkirmish készítője, Kai McPheeters végül visszaállította a GPT-6 Astra kódját, hogy az emberi bot elemei ne szennyezzék a további tesztet. A benchmark szabályai szerint egyébként minden modell azonos eszköztárat kap: fordíthat, gyakorlómeccseket futtathat, és szöveges meccsjelentéseket olvashat, de a cél egy saját készítésű bot fejlesztése. A Stardust viszont egy tapasztalt emberi fejlesztő, Bruce Mackenzie Nielsen precízen, manuálisan programozott 2020-as munkája.
Borítókép forrása: AI-generált illusztráció