Claude 3.7 Sonnet, el nuevo modelo de IA de razonamiento de Anthropic, está tratando de cumplir el sueño que han perseguido varias generaciones a nivel mundial: convertirse en el mejor entrenador Pokemon. Para ello, está jugando al videojuego Pokemon Rojo de Game Boy y su aventura está siendo retransmitida en directo en el canal de Twitch «ClaudePlaysPokemon».
Esta se trata de una forma creativa de poner a prueba las capacidades de Claude 3.7 Sonnet para solucionar problemas a través del razonamiento, sin haber sido entrenada previamente para jugar a este videojuego.
Para que Claude 3.7 Sonnet pueda jugar a Pokemon Rojo, Anthropic lo ha equipado con ciertas capacidades y herramientas especiales:
Así mismo, la retransmisión en Twitch muestra una doble pantalla para que la audiencia pueda entender mejor cómo funciona Claude 3.7 Sonnet. En la vista de la izquierda podemos ver en tiempo real el proceso de pensamiento por pasos de la IA y cómo resuelve problemas en un entorno interactivo. Mientras que la de la derecha muestra su avance en el juego en tiempo real.
A few researchers at Anthropic have, over the past year, had a part-time obsession with a peculiar problem. Can Claude play Pokémon? A thread: pic.twitter.com/K8SkNXCxYJ — Anthropic (@AnthropicAI) February 25, 2025
A few researchers at Anthropic have, over the past year, had a part-time obsession with a peculiar problem.
Can Claude play Pokémon?
A thread: pic.twitter.com/K8SkNXCxYJ
— Anthropic (@AnthropicAI) February 25, 2025
A pesar de no haber sido entrenada para jugar a Pokemon, Claude 3.7 Sonnet es capaz de avanzar en el videojuego gracias a sus capacidades de razonamiento. Estas le permiten analizar el contexto, ejecutar una planificación estratégica en los combates y a lo largo del juego, aprender la geografía de ese mundo virtual, recordar sus objetivos y adaptarse cuando sus estrategias iniciales fallan.
Sin embargo, este modelo está lejos de ser perfecto. En ocasiones se confunde con la navegación compleja y a veces le lleva mucho tiempo averiguar qué está sucediendo exactamente en la pantalla. Tal y como Anthropic explica en la descripción de su canal de Twitch: «Claude puede ser un poco tonto a veces».
Pero debemos recordar que, aunque a veces pueda parecer que Claude 3.7 Sonnet avanza por la aventura como un pokemon al que han atacado con un rayo confuso, lo cierto es que la IA emplea gran esfuerzo para razonar todos sus pasos.
El modelo 3.7 no ha sido el único de la familia Claude Sonnet con el que Anthropic ha intentado pasarse Pokemon Rojo, pero sí el que mejores resultados ha obtenido hasta la fecha. La versión Claude 3.0 Sonnet, por ejemplo, ni siquiera consiguió salir de la casa en Pueblo Paleta.
En junio de 2024, Anthropic testó Claude 3.5 Sonnet con este videojuego, pero la IA trató, reiteradamente, de huir de las batallas obligatorias contra entrenadores cuando estos le desafiaban. En otra ocasión, este modelo se quedó atrapado en una esquina y, al no ser capaz de salir, concluyó que el fallo era del juego y redactó una solicitud formal para reiniciarlo.
Posteriormente, probaron con la nueva versión de Claude 3.5 Sonnet presentada en octubre de ese año. Los resultados fueron más satisfactorios y la IA logró su primera victoria contra un rival y salió de Pueblo Paleta. Aunque, finalmente, terminó estancándose de nuevo.
Actualmente, Claude 3.7 Sonnet es el modelo que más lejos ha llegado, siendo su mayor hito obtener la medalla del Gimnasio del Teniente Surge, siendo este el tercer líder de gimnasio que derrota.
¿Logrará Claude hacerse con todos?
Foto: Canal de Twitch «ClaudePlaysPokemon»
Your email address will not be published. Required fields are marked *
Δ