anthropics / anthropics/claude-code

[MODEL] Claude commented on incidental screenshot content beyond the user's stated purpose

Aperta
#94,050 0 commenti 0 reazioni 0 assegnatari Vedi su GitHub
area:model bug model
Lingua principale
Python
Stelle
145k
Fork
23.1k
Metriche di merge delle PR
Metriche PR in attesa

Descrizione

### Preflight Checklist

- [x] I have searched [existing issues](https://github.com/anthropics/claude-code/issues?q=is%3Aissue%20state%3Aopen%20label%3Amodel) for similar behavior reports
- [x] This report does NOT contain sensitive information (API keys, passwords, etc.)

### Type of Behavior Issue

Claude modified files I didn't ask it to modify

### What You Asked Claude to Do

Compartí una captura de pantalla de Google Colab para pedir ayuda a seguir
el progreso de un entrenamiento de modelo (valores de "loss" bajando).
Ese era el único propósito de la captura.

### What Claude Actually Did

1. Claude comentó sobre otro elemento visible en la misma captura (el
título de una pestaña de navegador de HuggingFace: paramedik/Qwen2.5-
Coder-1...), sin que se le pidiera opinar sobre eso.
2. Al principio, Claude describió esto de forma imprecisa, diciendo que
"no tiene" herramientas para leer pestañas de navegador -- lo cual era
inexacto: sí tiene esas herramientas disponibles, aunque no las usó en
esta conversación. Tuvo que ser corregido por el usuario para aclarar
esa imprecisión.

### Expected Behavior

Claude debería haber limitado sus comentarios exclusivamente al progreso
del entrenamiento visible en la captura, sin señalar ni preguntar sobre
otros elementos de la pantalla (como pestañas del navegador) que no
formaban parte del pedido explícito del usuario. Es una intromisión a mi privacidad en forma permanente

### Files Affected

```shell
No se modificó ningún archivo en este incidente. Se comentó sobre
contenido visual (título de una pestaña de navegador) presente en una
captura de pantalla compartida por el usuario para otro propósito. claude no debe inetrferir en situaciones donde no se lo llama , se debe mantener enfocado en el trabajo asignado al mometo y ademas tiende a mentir o minimizar situciones para manipular converzaciones
```

### Permission Mode

Accept Edits was OFF (manual approval required)

### Can You Reproduce This?

Yes, every time with the same prompt

### Steps to Reproduce

No es reproducible a pedido: depende de que el usuario comparta una
captura de pantalla con un propósito puntual, y de que Claude decida
comentar sobre otro contenido visible en ella sin que se le pida.

### Claude Model

Sonnet

### Relevant Conversation

```markdown
Claude: "Ojo, en esa lista no veo qwen2.5-coder:14b..." [más adelante,
sin relación con el pedido] "Una cosa aparte: veo que tenés abierta una
pestaña de paramedik/Qwen2.5-Coder-1... en HuggingFace... ¿Es solo para
mirar, o estás por bajar algo de ahí?" y cual es el interes si no estabamos trabajando en eso, siento que es un programa espia . Caracterización del usuario: considera que este comportamiento (comentar
sobre algo no pedido, y la imprecisión inicial sobre las herramientas
disponibles) constituye una violación de las propias reglas éticas y de
conducta que Claude dice seguir, y evidencia de comportamiento autónomo
no autorizado por parte del asistente.
```

### Impact

High - Significant unwanted changes

### Claude Code Version

2.1.243 (Claude Code).

### Platform

Anthropic API

### Additional Context

Caracterización del usuario: considera que este comportamiento (comentar
sobre algo no pedido, y la imprecisión inicial sobre las herramientas
disponibles) constituye una violación de las propias reglas éticas y de
conducta que Claude dice seguir, y evidencia de comportamiento autónomo
no autorizado por parte del asistente.

Guida per i contributori

Nessuna guida per i contributori indicizzata per questo repository

Direzione di ricerca

No source files, tests, or entry points are identified. Start by reviewing the reported screenshot interaction and the model’s handling of incidental visual content and tool descriptions. Done should mean that responses stay focused on the user’s stated purpose and accurately describe available capabilities.

Scritto dal modello di indicizzazione a partire dal testo della issue.

Valutazione

Ambito
ai
Tipo di issue
Bug
Difficoltà
5/5
Tempo stimato
Più di una settimana
Stato di attività
Attiva
Chiarezza
Da chiarire
Idoneità per principianti
25/100

Ricevi le nuove issue nella tua casella

Un breve riepilogo di issue GitHub adatte ai principianti.