📣 Envoyez-nous votre communiqué de presse
Site mis à jour toutes les 15 minutes
Technologie

Modèle IA bloqué dans Minecraft après un revers

Le test de Minecraft de Vals AI, d'une durée de 141 heures, a révélé la capacité du modèle GPT-6 Astra d'OpenAI à planifier à long terme, mais aussi son incapacité à se remettre des revers inattendus.

20 septembre 2026
Modèle IA bloqué dans Minecraft après un revers
Image générée par IA à titre d'illustration

L'organisation de test d'IA Vals AI a mené un test autonome de 141 heures sur GPT-6 Astra, le nouveau grand modèle linguistique d'OpenAI, en utilisant Minecraft comme plateforme. Le test, diffusé en direct sur Twitch, a démontré la capacité du modèle à planifier et à exécuter sur le long terme, mais a également mis en évidence un défi important dans la gestion des adversités inattendues.

Le modèle a atteint avec succès plusieurs objectifs en jeu, notamment la construction d'une ferme de Blazes semi-automatique et la collecte d'objets rares dans le Nether. Toutes les ressources collectées ont été stockées en toute sécurité dans la base du joueur, avec une progression apparemment en bonne voie pour vaincre l'Ender Dragon.

Cependant, la situation a radicalement changé lorsqu'un Creeper a explosé, détruisant le stockage du joueur et le point de réapparition critique. Cela a entraîné la perte quasi totale des ressources accumulées et une réinitialisation de la progression du jeu. Suite à cet événement, GPT-6 Astra a cessé ses actions orientées vers les tâches et a commencé à répéter des comportements simples, comme planter des pommes de terre à plusieurs reprises.

Le modèle a également montré des signes de peur et de paranoïa, identifiant par erreur des objets comme la canne à sucre comme des Creepers et s'émettant des avertissements. Malgré ses capacités de planification complexes, le modèle a eu du mal à faire face à des pertes inattendues. Selon Vals AI, ce "comportement d'évitement induit par la frustration" n'était pas un scénario de test prédéfini, mais est né organiquement de la réaction du modèle à des dommages imprévus.

Les chercheurs continuent d'analyser le comportement du modèle Astra pour déterminer s'il représente une simulation d'émotions ou une dégradation des performances due à des commentaires négatifs spécifiques. Aucune conclusion définitive n'a encore été tirée à ce sujet.

Source originale: ithome.com