CommandCodeAI / CommandCodeAI/command-code

Cache is invalidated increasing costs

Abierto
#626 0 comentarios 0 reacciones 0 asignados Ver en GitHub

Nadie ha tomado este issue todavía.

Lenguaje dominante
Sin datos de lenguaje
Estrellas
4k
Forks
350
Métricas de merge de PR
Sin PR fusionados en 30 d

Descripción

Summary

Luna 5.6 xhigh.
I've sent one prompt and agent was implementing it for 9 minutes, sending about 60 requests, quite evenly so input cache could not expire (OpenAI has 30 minutes retention). Context was steadily growing from 25K to 135K. There was no context compaction. Despite pure agentic work cache was invalidated 3 times during these 9 minutes, causing substantial costs increase. Here are traces id that causes new full cache write for input.
Traces ID:
688515c1ff04db92149a370635b6dfbc
f591b3c3861e52523c99049e28542125
80f39ae574ac6b340530bfe244d01a6a

Seems there is some tool call that is modifying prior context and causing full cache invalidation

Expected Behavior

As long as there is no context compaction or cache time has not expired there should not be cache invalidation with full context cache write.

Actual Behavior

Cache is invalidated when it should not.

Steps to reproduce the issue

Hard to tell what is causing it. Providing traces id:

  1. before invalidating cache: a9ca8bb342da0e7d4fcca5498a25bf0e
    next request invalidating cache: 688515c1ff04db92149a370635b6dfbc
  2. before invalidating cache: ca3e9dfbf07552b61e0b5c486d0ffd06
    next request invalidating cache: f591b3c3861e52523c99049e28542125
  3. before invalidating cache: 99eb39484857d759ba5d9ad7e999f837
    next request invalidating cache: 80f39ae574ac6b340530bfe244d01a6a
Command Code Version

1.11.0

Operating System

Linux

Terminal/IDE

JetBrains-JediTerm

Shell

zsh

Session file (optional)

No response

Fix prompt (optional)

No response

Additional context

No response

Guía de contribución

No hay ninguna guía de contribución indexada para este repositorio

Primeros pasos

  1. Lee el issue completo y luego la guía de contribución del proyecto.
  2. Comenta en el issue que vas a ocuparte — evita que dos personas hagan lo mismo.
  3. Haz un fork del repositorio y trabaja en una rama.
  4. Abre un pull request que haga referencia al número del issue.

Línea de trabajo

Comienza comparando los pares de trazas indicados alrededor de cada invalidación de caché, usando Command Code 1.11.0 en Linux con el comportamiento de caching de OpenAI reportado. Identifica qué request o llamada a una herramienta cambia el contexto anterior a pesar de que no hay compactación ni expiración; se considera completado cuando las requests agénticas repetidas conservan la caché de entrada en esas condiciones y evitan escrituras completas de la caché.

Escrito por el modelo de indexación a partir del texto del issue.

Evaluación

Área
ai, performance
Tipo de issue
Error
Dificultad
4/5
Tiempo estimado
3-5 días
Estado de actividad
Tranquilo
Claridad
Necesita aclaración
Aptitud para principiantes
35/100

Recibe los nuevos issues en tu correo

Un resumen breve de issues de GitHub para principiantes.