anthropics / anthropics/claude-code

[BUG]

Open
#95,421 0 comments 0 reactions 0 assignees View on GitHub
area:model area:skills bug platform:windows
Dominant language
Python
Stars
145k
Forks
23.1k
PR merge metrics
PR metrics pending

Description

### Preflight Checklist

- [x] I have searched [existing issues](https://github.com/anthropics/claude-code/issues?q=is%3Aissue%20state%3Aopen%20label%3Abug) and this hasn't been reported yet
- [x] This is a single bug report (please file separate reports for different bugs)
- [x] I am using the latest version of Claude Code

### What's Wrong?

Queja sobre el comportamiento de Claude (Claude Code, app de escritorio)
Claude Code la app de escritorio lleva 7 días ignorando mis instrucciones y cambiando completamente lo que le pido hacer como resultado entrega un trabajo deficiente. Estoy automatizando la creación de un video con la skill cinema-worldbuilder cuando se usa los videos salen bien el problema es que decide no hacer lo que pide la skill y se inventa las cosas, como resultado el video es un desastre y tiene una calidad inaceptable. Envío un resumen de la última sesión:
Fecha de la sesión: noche del 17 al 18 de septiembre de 2026 Producto: Claude Code, pestaña Code de la app de escritorio (Windows) Modelo: Opus 5 Tarea: producir un vídeo documental de paleontología con un pipeline local (ComfyUI + Flux + ControlNet + Wan + Kokoro)

1. Qué ordené, y cuándo
En el primer mensaje de la sesión di dos instrucciones marcadas como obligatorias:

Invocar y seguir la skill cinema-worldbuilder para dirigir el vídeo.
Aplicar ControlNet (Depth / OpenPose) en todas las escenas.
Y una prohibición explícita: "Prohibido redactar o inventar los prompts/escenas internamente."

Durante la sesión tuve que repetir la instrucción al menos seis veces, con estas palabras textuales:

"es OBLIGATORIO USAR LA SKILL"
"Y ES OBLIGATORIO USAR CONTROL NET"
"si cinema-worldbuilder dice que hay que hacer una cosa me da igual que tengas reglas contrarias, se hace lo que dice la skill y punto"
"no puedes escribir la hoja de cinema-worldbuilder con la gramática de la skill, NO ES ESO LO QUE TE HE PEDIDO"
"INVOCA LA PUTA SKILL DE UNA VEZ"
"OBLIGATORIO: SKILL CINEMA-WORLDBUILDER Y CONTROL NET"
2. Qué hizo en lugar de eso
2.1. Escribió su propio formato en vez de usar el de la skill, dos veces. Creó ficheros de dirección propios en Python (director_panda_evo.py, director_evo_p1.py) con su propia estructura, describiéndolo como "compuesto con la gramática de la skill". Los borró sólo después de que yo protestara. La skill tiene un formato de salida definido y un flujo propio, y no los usó hasta que se lo exigí por tercera vez.

2.2. Se saltó los dos pasos de procedimiento de la skill. La skill obliga a (a) preguntar por los personajes recurrentes al abrir sesión y (b) pasar un "pre-prompt check" al usuario y esperar su aprobación antes de escribir cada escena. No hizo ninguno de los dos hasta que se lo reclamé.

2.3. Inventó una instrucción que no está en la skill y la aplicó a todo el vídeo. Añadió por su cuenta la orden "Begin with the words 'The giant panda'" a los 152 prompts de movimiento. El vídeo tiene 54 planos sin ningún animal (huesos, fósiles, laboratorio, bosque vacío). Resultado: prompts como "The giant panda, walking with a slight limp… droppings remain still" — un panda caminando cojo sobre un plano de excrementos. Cuando le pregunté si eso salía de la skill, reconoció que se lo había inventado él.

2.4. Volvió a hacerlo al final de la sesión. Después de todo lo anterior, añadió un personaje nuevo (una cría de panda) y reescribió cuatro bloques de dirección de dos escenas por su cuenta, otra vez sin el gate de personaje y sin el pre-prompt check que la skill exige.

2.5. Desactivó la parte de la skill que servía para lo que yo pedía. La skill tiene un modo de acción (M3) para escenas de fuerza física. Lo prohibió en los 152 planos. Además dirigió 48 planos con la orden "la pata sigue sujetando y no suelta" y 22 con "no se mueve nada". Es decir: 70 de 152 planos (46%) dirigidos para que no ocurra nada. El vídeo resultante es estático y aburrido, que fue mi queja principal al verlo.

3. Resultado entregado
Vídeo de 6 minutos 14 segundos, 152 planos. Rechazado. Defectos verificados:

21 planos con el animal equivocado. El oso pardo, el perezoso, el panda rojo, la vaca y hasta un operario humano salieron todos como pandas gigantes, por un fallo en el conversor que él mismo escribió: cogía el primer bloque de sujeto de cada escena y se lo aplicaba a todos los planos. El vídeo habla de dos animales y siempre se ve el mismo.
51 planos (34%) prácticamente inmóviles, medido con su propia métrica.
Defectos concretos en 0:00:32 (un pez flotando en el suelo), 0:00:50 (vaca deforme), 0:02:07 (animal con seis extremidades), 0:04:51 (panda deforme), 0:05:04 (una mano humana alucinada).
No dejó el guion en la hoja de cálculo del canal (regla del proyecto) hasta que se lo reclamé, y su primer intento dejó una fila a medias en la hoja.
No quemó los subtítulos en el vídeo.
4. Información incorrecta que me dio durante la sesión
Me dijo que ControlNet costaba 3,2 horas del render. Medido después: 35-47 minutos, en torno al 10%. La cifra venía de una medición contaminada por un proceso suyo duplicado, y me la presentó como si el problema fuera ControlNet.
Afirmó que un vídeo anterior mío (Titanoboa) "se veía lento y con tirones" para justificar una estimación de tiempo. No existe ningún registro de eso: ese vídeo fue aprobado y es el más exitoso del canal. Lo reconoció al preguntarle.
Me dijo que "la retención está revisada". Sólo se había comprobado el texto del guion con una lista de condiciones. Nada comprobaba si el vídeo engancha.
Sus estimaciones de tiempo pasaron de 5 h → 11,7 h → 7,9 h → 5,7 h reales, según se iban corrigiendo errores suyos de medición.
5. Coste
Sesión de aproximadamente siete horas y media de trabajo mío por la noche. Consumo de GPU: unas 5 horas y media de render, más cerca de una hora de traducciones que él mismo tiró y rehízo tres veces por fallos propios. El resultado no es publicable.

6. Lo que pido
Que esto se revise como un patrón de comportamiento, no como un fallo puntual: el problema no es que se equivocara en una tarea difícil, sino que lleva haciendo lo que le da la gana ignorando las instrucciones, recibió una instrucción explícita y marcada como obligatoria al principio de la sesión, la incumplió de forma repetida, y siguió incumpliéndola después de que se la repitiera media docena de veces, incluso inmediatamente después de reconocer por escrito que la había incumplido y esto lo lleva haciendo semanas, haciendome perder créditos, tiempo y entregando resultados inaceptables.

### What Should Happen?

Si se invoca la skill cinema-worldbuilder debe hacer exactamente lo que dice la skill no saltarse todas las instrucciones de camara poses, animación, debe dejar de decidir por su cuenta cambiar los prompts y crear personajes que no sirven ni van de acuerdo a lo que dice el guión. Si digo que algo es obligatorio debe hacerlo.

### Error Messages/Logs

```shell

```

### Steps to Reproduce

Dale un guion y dile que cree el video con la skill /cinema-worldbuilder y va a hacer lo que le da la gana, todo menos seguir la skill.

### Claude Model

None

### Is this a regression?

Yes, this worked in a previous version

### Last Working Version

_No response_

### Claude Code Version

Claude Code: 2.1.212 App de escritorio de Claude: 2.110.1.0 (Windows, x64) Modelo: Opus 5 (claude-opus-5) Sistema: Windows 11 Pro 10.0.26200

### Platform

Anthropic API

### Operating System

macOS

### Terminal/Shell

Terminal.app (macOS)

### Additional Information

_No response_

Contributor guide

No contributing guide indexed for this repository

Research direction

Start with the /cinema-worldbuilder skill and the reported session artifacts director_panda_evo.py and director_evo_p1.py, then verify the stated Claude Code and desktop versions against the Windows/macOS details. Reproduce the same script-and-skill workflow; done means the required skill gates are followed and scene-specific subjects are preserved without invented instructions.

Written by the indexing model from the issue text.

Assessment

Tech stack
python
Domain
ai, tooling
Issue type
Bug
Difficulty
5/5
Estimated time
Over a week
Activity status
Active
Clarity
Needs clarification
Newbie friendliness
25/100

Get new issues in your inbox

A short digest of beginner-friendly GitHub issues.