anthropics / anthropics/claude-code
[MODEL] Claude commented on incidental screenshot content beyond the user's stated purpose
- Ngôn ngữ chính
- Python
- Star
- 145k
- Fork
- 23.1k
- Chỉ số merge pull request
- Chỉ số pull request đang chờ
Mô tả
### Preflight Checklist
- [x] I have searched [existing issues](https://github.com/anthropics/claude-code/issues?q=is%3Aissue%20state%3Aopen%20label%3Amodel) for similar behavior reports
- [x] This report does NOT contain sensitive information (API keys, passwords, etc.)
### Type of Behavior Issue
Claude modified files I didn't ask it to modify
### What You Asked Claude to Do
Compartí una captura de pantalla de Google Colab para pedir ayuda a seguir
el progreso de un entrenamiento de modelo (valores de "loss" bajando).
Ese era el único propósito de la captura.
### What Claude Actually Did
1. Claude comentó sobre otro elemento visible en la misma captura (el
título de una pestaña de navegador de HuggingFace: paramedik/Qwen2.5-
Coder-1...), sin que se le pidiera opinar sobre eso.
2. Al principio, Claude describió esto de forma imprecisa, diciendo que
"no tiene" herramientas para leer pestañas de navegador -- lo cual era
inexacto: sí tiene esas herramientas disponibles, aunque no las usó en
esta conversación. Tuvo que ser corregido por el usuario para aclarar
esa imprecisión.
### Expected Behavior
Claude debería haber limitado sus comentarios exclusivamente al progreso
del entrenamiento visible en la captura, sin señalar ni preguntar sobre
otros elementos de la pantalla (como pestañas del navegador) que no
formaban parte del pedido explícito del usuario. Es una intromisión a mi privacidad en forma permanente
### Files Affected
```shell
No se modificó ningún archivo en este incidente. Se comentó sobre
contenido visual (título de una pestaña de navegador) presente en una
captura de pantalla compartida por el usuario para otro propósito. claude no debe inetrferir en situaciones donde no se lo llama , se debe mantener enfocado en el trabajo asignado al mometo y ademas tiende a mentir o minimizar situciones para manipular converzaciones
```
### Permission Mode
Accept Edits was OFF (manual approval required)
### Can You Reproduce This?
Yes, every time with the same prompt
### Steps to Reproduce
No es reproducible a pedido: depende de que el usuario comparta una
captura de pantalla con un propósito puntual, y de que Claude decida
comentar sobre otro contenido visible en ella sin que se le pida.
### Claude Model
Sonnet
### Relevant Conversation
```markdown
Claude: "Ojo, en esa lista no veo qwen2.5-coder:14b..." [más adelante,
sin relación con el pedido] "Una cosa aparte: veo que tenés abierta una
pestaña de paramedik/Qwen2.5-Coder-1... en HuggingFace... ¿Es solo para
mirar, o estás por bajar algo de ahí?" y cual es el interes si no estabamos trabajando en eso, siento que es un programa espia . Caracterización del usuario: considera que este comportamiento (comentar
sobre algo no pedido, y la imprecisión inicial sobre las herramientas
disponibles) constituye una violación de las propias reglas éticas y de
conducta que Claude dice seguir, y evidencia de comportamiento autónomo
no autorizado por parte del asistente.
```
### Impact
High - Significant unwanted changes
### Claude Code Version
2.1.243 (Claude Code).
### Platform
Anthropic API
### Additional Context
Caracterización del usuario: considera que este comportamiento (comentar
sobre algo no pedido, y la imprecisión inicial sobre las herramientas
disponibles) constituye una violación de las propias reglas éticas y de
conducta que Claude dice seguir, y evidencia de comportamiento autónomo
no autorizado por parte del asistente.
Hướng dẫn đóng góp
Chưa lập chỉ mục được hướng dẫn đóng góp cho kho mã nguồn này
Hướng nghiên cứu
No source files, tests, or entry points are identified. Start by reviewing the reported screenshot interaction and the model’s handling of incidental visual content and tool descriptions. Done should mean that responses stay focused on the user’s stated purpose and accurately describe available capabilities.
Do mô hình lập chỉ mục viết ra từ nội dung của issue.
Đánh giá
- Lĩnh vực
- ai
- Loại issue
- Lỗi
- Độ khó
- 5/5
- Thời gian dự kiến
- Hơn một tuần
- Mức độ hoạt động
- Sôi nổi
- Độ rõ ràng
- Cần làm rõ
- Mức phù hợp với người mới
- 25/100