News

GPT-6 Astra completa Portal in 24 ore, ma il test ha richiesto migliaia di chiamate agli strumenti

Mettere alla prova i modelli di intelligenza artificiale con i videogiochi sta diventando una sorta di competizione informale tra appassionati. Anche se questi sistemi non sono progettati specificamente per giocare, titoli che richiedono orientamento, pianificazione e risoluzione di enigmi possono trasformarsi in interessanti banchi di prova. L’ultimo esperimento ha coinvolto GPT-6 Astra, alle prese con Portal.

Il modello sarebbe riuscito a completare il celebre puzzle game in circa 24 ore, affrontando gli enigmi attraverso informazioni visive e dati relativi alla posizione del personaggio. Un risultato curioso soprattutto per il modo in cui l’intelligenza artificiale ha dovuto interpretare l’ambiente e trasformare le proprie decisioni in azioni all’interno del gioco.

Come GPT-6 Astra ha affrontato Portal

L’esperimento è stato realizzato dall’appassionato cozyblade, che ha fornito al modello il controllo di Portal utilizzando il Model Context Protocol (MCP) insieme a SourcePauseTool. Quest’ultimo permetteva di mettere in pausa il gioco durante i periodi necessari al modello per elaborare la situazione e decidere la mossa successiva.

GPT-6 Astra riceveva principalmente screenshot e informazioni sulla posizione del personaggio. A partire da questi dati doveva comprendere ciò che stava accadendo, pianificare le azioni e quindi inviare gli input necessari per proseguire.

L’intera partita ha richiesto circa 24 ore, ma una parte significativa di questo tempo sarebbe stata occupata proprio dalle fasi di elaborazione. Eliminando idealmente queste lunghe attese, il comportamento del modello risulterebbe per alcuni aspetti simile a quello di un giocatore umano, pur con evidenti difficoltà nell’esecuzione dei movimenti e nella precisione degli input.

Un esempio riguarda uno dei meccanismi più riconoscibili di Portal: il modello era riuscito a capire che un cubo dovesse essere posizionato sopra un pulsante, ma non è riuscito a eseguire correttamente l’operazione al primo tentativo. La comprensione dell’enigma, quindi, non garantiva automaticamente un’esecuzione precisa.

Leggi anche:

Oltre 3.300 chiamate agli strumenti durante la partita

Il dato più significativo dell’esperimento riguarda però le risorse impiegate. Per arrivare alla fine di Portal, il sistema avrebbe effettuato complessivamente 3.336 chiamate agli strumenti.

Inizialmente, il consumo di token associato all’esperimento è stato quantificato in 571 dollari. Successivamente cozyblade ha precisato che la spesa effettivamente sostenuta rientrava nel costo dell’abbonamento avanzato Codex Pro, indicato in 200 dollari al mese.

La distinzione è importante: il valore di 571 dollari descrive quindi il consumo attribuito ai token nel corso dell’esperimento, mentre non corrisponderebbe alla somma effettivamente pagata dall’autore esclusivamente per completare la partita.

Il test mostra soprattutto quanto possa essere complesso far interagire un modello di intelligenza artificiale con un ambiente videoludico in tempo reale. Comprendere un puzzle è soltanto una parte del problema: il sistema deve anche interpretare continuamente ciò che vede, mantenere il contesto, pianificare i passaggi successivi e trasformarli in comandi sufficientemente precisi.

Fonte

Ti potrebbe interessare:
Segui guruhitech su:

Esprimi il tuo parere!

Che ne pensi di questa notizia? Lascia un commento nell’apposita sezione che trovi più in basso e se ti va, iscriviti alla newsletter.

Per qualsiasi domanda, informazione o assistenza nel mondo della tecnologia, puoi inviare una email all’indirizzo [email protected].

Condividi l'articolo

Scopri di piรน da GuruHiTech

Abbonati per ricevere gli ultimi articoli inviati alla tua e-mail.

0 0 voti
Article Rating
Iscriviti
Notificami
guest
0 Commenti
Piรน recenti
Vecchi Le piรน votate