El Prompt de IA con Peor Aspecto Acaba de Superar Meses de Ingeniería de Prompts para Diseño de Juegos
Justo dos días después del lanzamiento de Claude Opus 5, el inversor en IA y ex CEO de HyperWrite, Matt Shumer, publicó un video de un juego de disparos en primera persona completamente jugable que el modelo había creado por sí solo.
"Claude Opus 5 hizo este juego de un solo tiro", escribió, añadiendo que no se utilizó ningún recurso externo en la construcción.
Ahora, podrías pensar que un resultado de tan buena calidad requería un prompt largo, detallado y cuidadoso para guiar a los modelos de IA a través de las complejidades de construir un juego de disparos en primera persona pulido.
Piénsalo de nuevo.
El prompt detrás de esto consistía en tres párrafos cortos, publicados en su totalidad en GitHub. Le decía a Opus 5 que construyera un shooter al nivel de los juegos más recientes de Call of Duty, que desplegara subagentes—trabajadores que cada uno tiene su propia memoria separada y un trabajo específico—para abordar piezas individualmente, y que siguiera iterando sobre cada pieza con un crítico separado y severo hasta que se mantuviera al nivel de las imágenes reales de Call of Duty en una comparación ciega lado a lado. El resultado, según el prompt, debería ser "totalmente perfecto".
Eso es una inversión de cómo los ingenieros de prompts han enseñado a las personas a trabajar. El consejo durante el auge de la codificación de vibras era especificar criterios en lugar de adjetivos: decir qué significa "bueno" en lugar de simplemente pedirlo. Qué debería considerar el código en lugar de decir "AAA".
La versión de Shumer hace casi lo opuesto, pidiendo a sus propios subagentes que estén "totalmente impresionados", y dejando la definición real a un crítico que Opus 5 construyó para sí mismo.
Dos características de Claude Code llevan ese bucle. Los subagentes se despliegan en ventanas de contexto aisladas con sus propias instrucciones y acceso a herramientas, por lo que un crítico que califica el modelo de arma no hereda las excusas del constructor sobre por qué se ve de la manera en que lo hace. Ultracode es una configuración de Claude Code que empuja al modelo a su máximo esfuerzo de razonamiento y le permite escribir su propio plan de orquestación, distribuyendo el trabajo entre hasta 16 agentes a la vez, con un límite de 1,000 por ejecución.
La habilidad /loop incorporada de Anthropic, diseñada para ciclos repetidos de prueba-ajuste, es lo que evitó que la ejecución se detuviera en el momento en que el juego se veía decente. Shumer nunca especificó un número de rondas. Dejó que el crítico siguiera nombrando una nueva brecha y mantuvo al constructor persiguiéndola durante horas antes de cerrar la sesión él mismo.
La construcción final se ejecuta en Three.js y WebGL2 puro, con aproximadamente 55,000 líneas de código distribuidas en 11 subsistemas. Cada textura, malla, animación y sonido se genera dentro del navegador en el momento de la carga—sin modelos descargados, HDRIs, archivos de imagen o archivos de audio. El propio registro de críticos publicado por Shumer muestra la puntuación subiendo de 3.59 sobre 10 hacia poco más de 5, aún detrás del juego real en cada ronda.
Los escépticos asumieron horas de codificación manual oculta, así que Shumer publicó todo el prompt y la base de código. Ahí fue cuando comenzaron los imitadores.
James Altucher, el ex gerente de fondos de cobertura y podcaster, ejecutó el mismo prompt e informó haber gastado "un poco más de diez horas" y aproximadamente 1.3 millones de tokens en Opus 5 para llegar allí. Su construcción, Operation Blackout, se juega gratis en el navegador y se ve impresionante.
El desarrollador de Prompt Silo, dirigió la misma solicitud a la insignia rival de OpenAI, publicando "Sol 5.6 Ultra con el mismo prompt"—Sol siendo el nivel superior de la familia de modelos GPT-5.6 que OpenAI hizo generalmente disponible el 9 de julio junto con versiones más baratas de Terra y Luna.
El desarrollador Leon Lin intentó el movimiento opuesto, optando por el habitual prompt detallado. En lugar de copiar la versión corta de Shumer, se propuso "ingeniar un prompt para este juego", produciendo un documento que abarca unas 20 secciones que detallan todo, desde la física de ragdoll hasta los mapas de sombras en cascada. Alimentó eso en Cursor usando Opus 5 en alto esfuerzo, sin subagentes y sin ultracode, y el resultado—un shooter de calle de mercado llamado Dust Corridor—también se juega en el navegador y también se ve genial.
Ninguna de las construcciones de seguimiento ha enfrentado la prueba ciega que Shumer realizó en su propio proyecto. Su registro de críticos aún muestra a Call of Duty real ganando cada ronda que registró—la barra que Altucher y Atom Tan Studio están persiguiendo con su exacto prompt de tres párrafos, y la que Leon Lin está persiguiendo con aproximadamente 20 secciones propias.
¿Cuánto de esto es realmente nuevo?
Las herramientas de codificación agentivas como Claude Code escriben software de la manera en que un ingeniero junior supervisado podría hacerlo: leen archivos, ejecutan código, miran las capturas de pantalla que generan y entregan partes del trabajo a subagentes y críticos que verifican el resultado contra un objetivo declarado. Ese bucle es real, y el Gauntlet Loop de Shumer es una forma genuina de estructurarlo. Nada de eso, por sí solo, prueba que el modelo diseñó un juego desde la imaginación en lugar de recombinar patrones de código que ya había absorbido.
Eso no hace que Claude of Duty sea falso, pero hace que "construido desde cero" sea una afirmación más difícil de acreditar completamente, así que toma esos resultados con un grano de sal.
Los investigadores que estudian modelos generadores de código tienen un nombre para el problema más amplio: contaminación de datos, cuando un modelo tiene éxito en una tarea principalmente porque ejemplos casi idénticos ya estaban en sus datos de entrenamiento, no porque razonara algo nuevo.
Ninguna de las construcciones de disparos en primera persona publicó un chequeo para ese tipo de contaminación. El propio repositorio de Shumer contiene la propia creatividad de Claude, si es justo llamarlo así. Esa es una razón para leer "hizo un juego AAA de un solo tiro" como un agente capaz trabajando dentro de uno de los géneros más documentados en programación, no como prueba de que una IA diseñó un shooter sin arte previo en que apoyarse.
Este contenido se ofrece únicamente con fines informativos generales y no constituye asesoramiento financiero, de inversión, legal ni fiscal. Cualquier evento, recompensa, promoción en línea o información relacionada que se mencione en el presente documento no debe considerarse como una recomendación, solicitud o invitación a comprar, vender, tradear o de negociar de otra manera con cualquier criptoactivo. Los criptoactivos son sumamente volátiles y pueden provocar pérdidas. La disponibilidad de los servicios, productos y eventos relacionados de WEEX puede variar según la región. Tienes la responsabilidad de asegurarte de que tu participación esté de acuerdo con las leyes y regulaciones locales vigentes.
También te puede interesar

OpenAI y Anthropic impulsan una revisión de 30 días para modelos de IA de frontera

Escaneé toda la cadena de bloques de Bitcoin en busca de imágenes. Lo que encontré te sorprenderá

Dejó su Tesla Cybertruck enchufado dos semanas y no volvió a encender: ¿qué pasó realmente?

Qué es y cómo funciona "Apple Upgrade", el plan oficial de alquiler de iPhones, iPad y Macbooks

Matemáticas Rápidas Sobre las Recompras de STRC: La Verdad Sobre el Bitcoin Neto Por Acción y la Apreciación

Robinhood Chain Supera a Solana en Volumen de Acciones Tokenizadas a Través de Pares de Memecoins

Entre las sanciones económicas y los bombardeos, la estrategia de EEUU para negociar con Irán

Irán difundió un video con amenazas contra Melania y Barron Trump: crece la tensión con EEUU

Inteligencia Artificial: Vint Cerf quiere dar una identidad a cada agente de IA

Ondo abandona su blockchain L1 y ahora se enfoca en la ejecución fuera de la cadena

SBI se expande más allá de Ripple con la unidad de Canton Network

Michael Saylor: Bitcoin ya ha ganado, pero debe evitar la corrupción interna

Clear Creek revela un portafolio de ETF de Bitcoin y criptomonedas de $15 millones

Flare hace que XRPFi sea accesible con una sola firma mediante cuentas inteligentes v1.3

Bitcoin: ¿el enfrentamiento entre ballenas y pequeños tenedores anuncia un suelo?

La startup de Ethereum EthSystems apuesta a que la privacidad es clave para que los bancos se unan a las blockchains públicas

El CEO de Nansen apuesta a que los agentes de IA superarán a los traders humanos en dos años

AmericanFortress propone un esquema de billetera criptográfica a prueba de quantum

Arthur Hayes compra $6.39 millones más en ETH a pesar de una pérdida en papel de $301K: esto es en lo que está apostando

Fuerte impacto de la volatilidad global: 8 de cada 10 inversores refuerzan posiciones defensivas

Emirates lanza el pago en criptomonedas con Crypto.com

Hyperliquid lleva los futuros perpetuos de criptomonedas a la tierra de 'LEGO del dinero' en DeFi

"Más allá de la billetera hacia las finanzas en cadena"... Exilist destaca la estrategia de expansión de 'acciones tokenizadas' de MEW

Ethereum: BitMine ya posee el 4,8% de la oferta de ETH

Raoul Pal: La correlación del 87% de Bitcoin con la liquidez global supera las ganancias y los titulares

Crédito opaco: Chanos expone la fraude encubierta que amenaza al mercado

Consumo en supermercados: qué productos dejaron de comprar los argentinos y por qué

Perro dorado 800x, "sacar cartas" salva el comercio de NFT

Salarios de bancarios: cuánto cobrarán en agosto de 2026 tras el último acuerdo de la paritaria











