Anthropic utilise Pokémon Red pour évaluer un nouveau modèle d'IA

4 mars 2025
Automatiser l'expérience client grâce à l'IA conversationnelle
Découvrez la puissance d'une plateforme qui vous offre le contrôle et la flexibilité nécessaires pour offrir des expériences client enrichissantes à grande échelle.
Planifier une démo


Anthropic a utilisé le jeu classique Pokémon Red sur Game Boy pour tester son dernier modèle d'IA, Claude 3.7 Sonnet. Contrairement à son prédécesseur, Claude 3.0 Sonnet, qui avait du mal à quitter la zone de départ, le modèle mis à jour a réussi à combattre trois chefs de gymnase, démontrant ainsi des progrès impressionnants. Doté d'une mémoire de base, d'une entrée pixel écran et d'appels de fonction, Claude 3.7 Sonnet a exploité la « pensée étendue » pour effectuer 35 000 actions et franchir des étapes importantes. La société a révélé qu'en quelques heures, l'IA avait vaincu Brock, puis Misty, démontrant ainsi ses capacités avancées en matière de résolution de problèmes. Pokémon Red rejoint une gamme de jeux désormais utilisés pour évaluer les performances de l'IA.

En savoir plus

Pourquoi Inbenta ?

Grâce à notre solution d'IA composite, votre agent virtuel apprend en permanence de chaque interaction, atteignant une précision supérieure à 99 %.
En savoir plus
Logo Gartners Peer Insights
Basé sur plus de 20 évaluations par des pairs
Service et assistance

Articles connexes publiés cette semaine sur l'IA

Les fondateurs de Fitbit reviennent avec une application de santé familiale basée sur l'IA
En savoir plus
Claude Sonnet 5 Une fuite déclenche un buzz pendant la semaine du Super Bowl
En savoir plus
Musk intègre xAI à SpaceX dans le cadre d'un méga-accord privé
En savoir plus