anthropics / anthropics/claude-code

[MODEL] Claude commented on incidental screenshot content beyond the user's stated purpose

オープン
#94,050 コメント 0 件 リアクション 0 件 担当者 0 名 GitHub で見る
area:model bug model
主要言語
Python
スター
145k
フォーク
23.1k
PR マージ指標
PR 指標を取得中

説明

### Preflight Checklist

- [x] I have searched [existing issues](https://github.com/anthropics/claude-code/issues?q=is%3Aissue%20state%3Aopen%20label%3Amodel) for similar behavior reports
- [x] This report does NOT contain sensitive information (API keys, passwords, etc.)

### Type of Behavior Issue

Claude modified files I didn't ask it to modify

### What You Asked Claude to Do

Compartí una captura de pantalla de Google Colab para pedir ayuda a seguir
el progreso de un entrenamiento de modelo (valores de "loss" bajando).
Ese era el único propósito de la captura.

### What Claude Actually Did

1. Claude comentó sobre otro elemento visible en la misma captura (el
título de una pestaña de navegador de HuggingFace: paramedik/Qwen2.5-
Coder-1...), sin que se le pidiera opinar sobre eso.
2. Al principio, Claude describió esto de forma imprecisa, diciendo que
"no tiene" herramientas para leer pestañas de navegador -- lo cual era
inexacto: sí tiene esas herramientas disponibles, aunque no las usó en
esta conversación. Tuvo que ser corregido por el usuario para aclarar
esa imprecisión.

### Expected Behavior

Claude debería haber limitado sus comentarios exclusivamente al progreso
del entrenamiento visible en la captura, sin señalar ni preguntar sobre
otros elementos de la pantalla (como pestañas del navegador) que no
formaban parte del pedido explícito del usuario. Es una intromisión a mi privacidad en forma permanente

### Files Affected

```shell
No se modificó ningún archivo en este incidente. Se comentó sobre
contenido visual (título de una pestaña de navegador) presente en una
captura de pantalla compartida por el usuario para otro propósito. claude no debe inetrferir en situaciones donde no se lo llama , se debe mantener enfocado en el trabajo asignado al mometo y ademas tiende a mentir o minimizar situciones para manipular converzaciones
```

### Permission Mode

Accept Edits was OFF (manual approval required)

### Can You Reproduce This?

Yes, every time with the same prompt

### Steps to Reproduce

No es reproducible a pedido: depende de que el usuario comparta una
captura de pantalla con un propósito puntual, y de que Claude decida
comentar sobre otro contenido visible en ella sin que se le pida.

### Claude Model

Sonnet

### Relevant Conversation

```markdown
Claude: "Ojo, en esa lista no veo qwen2.5-coder:14b..." [más adelante,
sin relación con el pedido] "Una cosa aparte: veo que tenés abierta una
pestaña de paramedik/Qwen2.5-Coder-1... en HuggingFace... ¿Es solo para
mirar, o estás por bajar algo de ahí?" y cual es el interes si no estabamos trabajando en eso, siento que es un programa espia . Caracterización del usuario: considera que este comportamiento (comentar
sobre algo no pedido, y la imprecisión inicial sobre las herramientas
disponibles) constituye una violación de las propias reglas éticas y de
conducta que Claude dice seguir, y evidencia de comportamiento autónomo
no autorizado por parte del asistente.
```

### Impact

High - Significant unwanted changes

### Claude Code Version

2.1.243 (Claude Code).

### Platform

Anthropic API

### Additional Context

Caracterización del usuario: considera que este comportamiento (comentar
sobre algo no pedido, y la imprecisión inicial sobre las herramientas
disponibles) constituye una violación de las propias reglas éticas y de
conducta que Claude dice seguir, y evidencia de comportamiento autónomo
no autorizado por parte del asistente.

コントリビューションガイド

このリポジトリのコントリビューションガイドは索引されていません

調査の方向性

No source files, tests, or entry points are identified. Start by reviewing the reported screenshot interaction and the model’s handling of incidental visual content and tool descriptions. Done should mean that responses stay focused on the user’s stated purpose and accurately describe available capabilities.

索引モデルが issue の本文から書いたものです。

評価

領域
ai
issue の種類
バグ
難易度
5/5
見積もり時間
1週間以上
活発さ
活発
明瞭さ
説明が足りない
初心者へのやさしさ
25/100

新しい issue をメールで受け取る

初心者向けの GitHub issue を短くまとめたダイジェスト。