Auto mode using a safety classifier for tool calls
Nadie ha tomado este issue todavía.
Evaluación
- Dificultad
- 5/5
- Tiempo estimado
- Más de una semana
- Aptitud para principiantes
- 30/100
Línea de trabajo
No se nombran archivos, pruebas ni puntos de entrada concretos. Empieza por localizar los modos de edición y de planificación existentes y la funcionalidad que permite ejecutar automáticamente los comandos aprobados. Se consideraría terminado al definir un Auto Mode que evalúe las llamadas a herramientas con un clasificador de seguridad configurable por el usuario y evite aprobaciones manuales innecesarias.
Escrito por el modelo de indexación a partir del texto del issue.
Descripción
Feature Description
Instead of just having edit and plan modes, introduce a new mode called "Auto Mode". This would use an automatic safety classifier for things like bash commands and such, similar to what Claude Code has, so that users don't have to constantly babysit the harness when it's running commands. It would likely be powered by a cheap open source model, like DeepSeek V4 Flash or Qwen 3.8 Flash to keep costs low, but the classifier model should be able to be changed by the user at any point.
Use Case
Allows for users who are working to step back while the agent does its own thing, instead of having to manually accept bash commands and the like. There is already functionality for allowing the agent to run specific commands on its own, after it's been allowed, but I find that often doesn't work very well for one reason or another. In workflows where the user may be doing multiple things at once, it can get annoying to have to go back and allow things in order to stop the agent from hanging on a single bash command request for potentially minutes on end while the user isn't aware it's even there.
Additional Context
No response
How important is this to you?
Important for my workflow
- Lenguaje dominante
- Sin datos de lenguaje
- Estrellas
- 4k
- Forks
- 350
- Métricas de merge de PR
- Sin PR fusionados en 30 d
Guía de contribución
No hay ninguna guía de contribución indexada para este repositorio
Primeros pasos
- Lee el issue completo y luego la guía de contribución del proyecto.
- Comenta en el issue que vas a ocuparte — evita que dos personas hagan lo mismo.
- Haz un fork del repositorio y trabaja en una rama.
- Abre un pull request que haga referencia al número del issue.
Más de CommandCodeAI/command-code
-
Dificultad 2/5 1-3 horas Aptitud para principiantes 68/100
CommandCodeAI/command-code#855 ·
-
Dificultad 2/5 1-3 horas Aptitud para principiantes 78/100
CommandCodeAI/command-code#841 · 1 comentario ·
-
Dificultad 2/5 1-3 horas Aptitud para principiantes 68/100
CommandCodeAI/command-code#655 · 1 comentario ·
-
Dificultad 2/5 1-3 horas Aptitud para principiantes 68/100
CommandCodeAI/command-code#608 ·
-
Dificultad 3/5 1-2 días Aptitud para principiantes 70/100
CommandCodeAI/command-code#893 ·
Todos los issues de CommandCodeAI/command-code
Issues similares
-
enhancement
Dificultad 2/5 1-3 horas Aptitud para principiantes 68/100
JuliusBrussee/caveman#1102 · 1 comentario ·
-
Dificultad 2/5 1-3 horas Aptitud para principiantes 78/100
use-agent-os/agent-os#3263 ·
-
[Bug]: context-limit error parsing has no pattern for llama.cpp's "context size (N tokens)" phrasing Abiertoarea/compression area/local-models area/sessions comp/agent duplicate P2 sweeper:risk-session-state type/bug
Dificultad 2/5 1-3 horas Aptitud para principiantes 82/100
NousResearch/hermes-agent#117793 · 1 comentario ·
-
possible bug
Dificultad 2/5 1-3 horas Aptitud para principiantes 88/100
Mintplex-Labs/anything-llm#6415 · 1 comentario ·
-
Dificultad 2/5 1-3 horas Aptitud para principiantes 82/100