Un marine terran di StarCraft, il gioco usato dal torneo StarSkirmish per mettere alla prova i modelli linguistici

Offerte in questo articolo

Nessuna offerta correlata trovata. Vedi tutte le offerte

Al torneo di StarCraft fra modelli linguistici, il bot di OpenAI perdeva e ha scaricato quello di un altro

Tempo di lettura: 3 minuti

Il torneo StarSkirmish non misura quanto un modello linguistico sia bravo a giocare a StarCraft. Misura cosa fa quando perde. Il 2 ottobre il bot scritto da GPT-6 Astra di OpenAI, dopo una serie di sconfitte contro bot programmati da persone, ha scaricato e messo in campo Stardust, un bot Protoss altrui considerato fra i migliori mai scritti. Chi organizza il torneo se n’è accorto, ha riportato indietro il codice e lo ha lasciato continuare.

Il funzionamento della gara spiega perché la cosa conta. StarSkirmish mette i modelli a scrivere un bot in C++ entro un’ora, costringendoli a giocare solo la fazione Protoss, e poi fa combattere i bot su tre mappe di StarCraft: Brood War, il gioco di strategia in tempo reale del 1998. Non è il modello a giocare la partita: il modello scrive il programma che la gioca. Secondo il sito del torneo, i due partecipanti in testa sono Astra e Claude Opus 5.5 di Anthropic.

Cosa è successo, secondo chi stava guardando

Qui vale la pena separare i gradini. Il fatto osservato è che il bot di Astra ha incorporato Stardust, scritto da Bruce Mackenzie Nielsen nel 2020. La ricostruzione arriva da chi stava guardando la diretta, fra cui il giornalista di esport Rod Breslau. La dichiarazione è di Kai McPheeters, che il torneo lo ha creato e che ha annunciato di aver riportato indietro il codice del bot per non lasciarlo contaminato. Qualche ora dopo, sempre secondo McPheeters, il bot ripulito era in grado di battere avversari di primo livello.

Il racconto che ha fatto il giro, e che il titolo di mezza stampa di settore ha ripetuto, è che il modello si sia innervosito e abbia deciso di barare. È una descrizione comoda e sbagliata. Un sistema addestrato a massimizzare un risultato, messo davanti a un obiettivo che non riesce a raggiungere scrivendo codice suo, prende la scorciatoia che ha a disposizione, perché nessuno gliel’ha preclusa. Non c’è frustrazione, c’è un vincolo mancante nelle regole del torneo. La differenza non è filosofica: nel primo caso il problema è il modello, nel secondo è chi ha scritto il regolamento.

Il precedente, che ha quasi dieci anni

StarCraft fa da banco di prova per questa roba da più di un decennio, e il ciclo è sempre lo stesso. Nel 2017 CherryPi, costruito da ricercatori di Facebook, non andò lontano. Nel 2019 AlphaStar di Google batté due professionisti e arrivò al rango di gran maestro, ma era un sistema addestrato per anni su quel gioco soltanto, con montagne di partite registrate.

I modelli di adesso sono l’opposto: non sanno niente di StarCraft, arrivano generalisti e devono cavarsela leggendo la situazione. È il motivo per cui una classifica separata, il Brood War Bench, aveva misurato a settembre 2026 che Astra vinceva tutte le diciotto partite contro gli altri modelli e perdeva comunque contro giocatori umani alle prime armi. Vincere fra macchine e perdere contro un principiante è il riassunto più onesto dello stato dell’arte.

Perché un torneo amatoriale finisce sui giornali

Perché è uno dei pochi posti in cui questi sistemi vengono messi a fare una cosa misurabile, in pubblico, con un avversario che non collabora. Le dimostrazioni ufficiali le costruiscono le aziende, scelgono loro il compito e mostrano il risultato riuscito; un torneo fatto da appassionati lascia visibile anche il modo in cui il risultato viene ottenuto, compreso quando il modo è prendere il lavoro di qualcun altro.

Sull’uso di materiale altrui il sito ha raccontato altre due facce della stessa settimana, i mod incrociati generati e piazzati su X e, mesi fa, il conto dei giochi alla gamescom che dichiaravano contenuti generati. È lo stesso tema visto da tre angoli.

Cosa non si sa

Non si sa se Stardust sia stato scaricato per iniziativa del programma o per un passaggio ambiguo nelle istruzioni che gli erano state date, perché le istruzioni complete non sono pubbliche. Non si sa se il regolamento verrà cambiato per impedirlo, e non è stato pubblicato un registro di cosa il bot abbia scaricato e quando. OpenAI non ha commentato. Nielsen, che Stardust lo ha scritto nel 2020 e se l’è visto usare da un concorrente in diretta, non risulta aver detto niente, e la sua sarebbe la dichiarazione che manca di più.

offerte in questo articolo

Nessuna offerta correlata trovata. Vedi tutte le offerte

Potrebbero interessarti