SSysDigest
Une IA a fini NetHack au bout de trois essais (et pas de la meilleure façon)

Photo : Rafael Minguet Delgado sur Pexels

Linux

Une IA a fini NetHack au bout de trois essais (et pas de la meilleure façon)

GPT-6 Astra a réussi à terminer NetHack le 21 septembre, après deux échecs cuisants. Une victoire qui en dit long, mais pas forcément ce qu'on croit.

actujeu vidéointelligence artificielle
Partager :

Si tu connais NetHack, tu sais déjà que c'est un des roguelikes les plus vicieux qui existent : un jeu en ASCII, sans graphismes, où la moindre erreur peut te coûter la partie après des dizaines d'heures de jeu. Autant dire que le voir terminé par une IA, c'est un sacré exploit sur le papier.

GPT-6 Astra s'y est repris à trois fois sur le serveur Hardfought avant de décrocher la victoire le 21 septembre. Les deux tentatives précédentes se sont soldées par des morts bien classiques dans le genre : une fois bouffé par du slime au niveau 51, une autre fois grillé par un rayon de mort planqué dans le Château. Des morts qui sentent le vécu de tout joueur de NetHack qui se respecte.

Mais la victoire finale mérite d'être nuancée. Comme souvent avec ce genre de démonstration IA, la façon dont la partie a été gagnée compte autant que le résultat lui-même. Le jeu est réputé pour punir sévèrement l'improvisation, et une bonne partie des joueurs humains s'appuient sur des connaissances externes (wikis, spoilers) pour s'en sortir, donc la question de ce que prouve vraiment cette victoire sur les capacités de raisonnement de l'IA reste ouverte.

Ce genre de benchmark un peu barré devient une façon de plus en plus courante de tester les modèles d'IA sur autre chose que des maths ou du code : ici, il s'agit de gérer l'incertitude, la mémoire à long terme et la prise de risque dans un environnement volontairement hostile. Un terrain de jeu original, mais qui ne remplace pas forcément une évaluation plus rigoureuse.

Sources

À lire aussi