
Opus 5 crea una escena de Tolkien con 5.500 líneas, pero no hay una versión pública para probarla
El investigador de inteligencia artificial Andrej Karpathy dijo que Claude Opus 5, de Anthropic, convirtió el primer párrafo de El Señor de los Anillos (The Lord of the Rings) en una escena tridimensional para navegador, pero ninguna versión pública demuestra que se pueda jugar.
La historia continúa

Usuarios de Claude Opus 5 denuncian que deja tareas sin terminar
11 de agosto de 2026Anthropic lanzó el 24 de julio un modelo más barato pensado para trabajos largos de programación y otras tareas con poca supervisión, pero las quejas ponen a prueba esa promesa.
Quiénes participan
Andrej Karpathy
Destacado investigador de inteligencia artificial y empleado de Anthropic que dirigió y difundió el experimento
quiere → mostrar qué puede construir un agente de programación de Claude durante una ejecución prolongada e identificar sus limitaciones
Anthropic
Empresa de inteligencia artificial que desarrolla Claude Opus 5 y emplea a Karpathy
quiere → consolidar Opus 5 como un modelo destacado y rentable para tareas complejas de programación autónoma
am.will, conocido en internet como LLMJunky
Desarrollador independiente que publicó una prueba anterior de Opus 5 con un juego para navegador y materiales verificables
quiere → documentar la capacidad del modelo para crear y probar un juego interactivo con Three.js
Claude Opus 5
Principal modelo de Anthropic para programación, razonamiento y tareas prolongadas de agentes
quiere → demostrar su rendimiento, autonomía y fiabilidad
Competidores de modelos de vanguardia
Sistemas como GPT-5.6 Sol, de OpenAI, y otros modelos destacados de programación comparados con Opus 5
quiere → atraer a los desarrolladores mediante un código, una fiabilidad, una velocidad o un coste mejores
En resumen
El experimento muestra la rapidez con la que un modelo avanzado de inteligencia artificial puede convertir un texto en un mundo tridimensional rudimentario, pero la ausencia del código y de los registros impide reproducir el resultado o compararlo de forma justa.
La demostración probablemente seguirá siendo una exhibición y no una prueba de referencia fiable salvo que Karpathy publique la versión creada, la instrucción utilizada y el historial completo de la ejecución. La evidencia disponible se limita a un vídeo y a su descripción de la sesión.
Karpathy dijo que Claude Opus 5 recibió un presupuesto de un millón de tokens, trabajó durante unas dos horas y escribió cerca de 5.500 líneas de Three.js, una biblioteca para crear gráficos tridimensionales en un navegador web. El vídeo muestra un mundo animado, pero no una partida controlada por el usuario.
Antecedentes de esta historia

Anthropic lanza Claude Opus 5: 5 dólares por millón de tokens de entrada y 25 por los de salida
24 de julio de 2026Anthropic presentó Claude Opus 5 el 24 de julio con una ventana de contexto de un millón de tokens, un máximo de salida de 128.000 y el mismo precio estándar que Opus 4.8.
Cómo se desarrolló
Anthropic lanza Opus 5 para tareas prolongadas de programación
Anthropic abrió la historia con el lanzamiento de Claude Opus 5, que promocionó por su capacidad para afrontar tareas prolongadas de programación, manejar un contexto de un millón de tokens y generar mejores resultados visuales. Desarrolladores independientes probaron esas afirmaciones con juegos para navegador pocas horas después. Karpathy informó por primera vez del experimento de Tolkien en X a las 03:00 UTC del 2 de agosto, lo que llevó a medios especializados y foros de desarrolladores a debatir qué demostraba realmente el vídeo.
Las pruebas públicas fijan un criterio más claro
Tras el lanzamiento y antes de la escena de Tolkien de Karpathy aparecieron pruebas informales de programación. Anthropic documentó una ventana de contexto de un millón de tokens, una salida máxima de 128.000 tokens y varios niveles de esfuerzo, pero esos límites no revelaban cómo se había ejecutado cada experimento. Artificial Analysis situó Opus 5 entre los modelos más potentes, aunque sin un liderazgo general claro. El desarrollador am.will ofreció una prueba más abierta con Rocket Arena: un juego creado con Three.js, código fuente publicado, una versión accesible y un intento posterior de permitir que el modelo jugara a su propia creación. Eso facilitaba una reproducción significativa mucho más que la posterior demostración cerrada de Karpathy.
Karpathy muestra la escena de Tolkien
Nueve días después del lanzamiento del modelo, Karpathy publicó un breve vídeo de un mundo con pocos polígonos inspirado en el párrafo inicial de El Señor de los Anillos. Dijo que Opus 5 recibió un presupuesto de un millón de tokens, trabajó durante unas dos horas y produjo alrededor de 5.500 líneas de código Three.js. Describió el resultado como «tosco, pero divertido», y lo presentó claramente como un experimento, no como el desarrollo de un juego listo para su comercialización. El vídeo reforzó el atractivo del modelo, pero no acreditó un rendimiento reproducible.
La falta de pruebas debilita la afirmación
La atención pasó pronto del resultado visual a las pruebas ausentes. Karpathy dijo que el modelo inspeccionaba el mundo mediante capturas de pantalla y se confundía con frecuencia, lo que mostró que podía crear recursos tridimensionales y animaciones con mayor rapidez de la que podía verlos y probarlos de forma fiable. No apareció ningún repositorio público, instrucción completa, transcripción del agente, versión jugable, registro detallado del uso ni explicación de los reintentos y las correcciones manuales. Los desarrolladores también cuestionaron que el número de líneas y la novedad revelaran algo sobre la facilidad de mantenimiento, la jugabilidad o la calidad comparativa del código. Cada omisión redujo la posibilidad de considerar el ejercicio una prueba fiable.
Dónde están las cosas
A 3 de agosto de 2026, la prueba confirmada más sólida es el vídeo de Karpathy y su relato de la ejecución. El resultado parece real, pero no se ha confirmado que el modelo consumiera cerca de un millón de tokens, porque la publicación describía un presupuesto y no el uso medido. Tampoco está demostrado que se trate de un mundo jugable: no se ha publicado ningún enlace interactivo ni repositorio, y el material disponible muestra una representación animada, no una partida controlada por el usuario.
Se desconoce cuántas veces se redirigió al agente, si se descartaron intentos fallidos, qué niveles de esfuerzo y configuraciones de herramientas de Opus 5 se utilizaron, cuánto contexto estaba almacenado en caché, qué entorno de ejecución sostuvo el proceso y si el código es coherente o fácil de mantener. Una comparación creíble con GPT-5.6 Sol, Fable u otros sistemas de vanguardia exigiría emplear la misma instrucción, las mismas herramientas y el mismo límite de tokens en varias ejecuciones, seguidas de una revisión independiente del código y de pruebas de precisión visual, rendimiento, estabilidad e interactividad.