Cache is invalidated increasing costs
Dieses Issue hat noch niemand übernommen.
Bewertung
- Schwierigkeit
- 4/5
- Geschätzter Aufwand
- 3-5 Tage
- Anfängerfreundlichkeit
- 35/100
- Issue-Typ
- Bug
- Klarheit
- Muss geklärt werden
- Aktivitätsstatus
- Ruhig
- Bereich
- ai, performance
Rechercherichtung
Beginne damit, die aufgeführten Trace-Paare rund um jede Cache-Invalidierung zu vergleichen, und verwende dabei Command Code 1.11.0 unter Linux mit dem gemeldeten OpenAI-Caching-Verhalten. Ermittle, welcher Request oder Tool-Aufruf den vorherigen Kontext verändert, obwohl weder eine Komprimierung noch ein Ablauf stattfindet; abgeschlossen ist die Aufgabe, wenn wiederholte agentische Requests unter diesen Bedingungen den Input-Cache beibehalten und vollständige Cache-Schreibvorgänge vermeiden.
Vom Indexierungsmodell aus dem Issue-Text verfasst.
Beschreibung
Summary
Luna 5.6 xhigh.
I've sent one prompt and agent was implementing it for 9 minutes, sending about 60 requests, quite evenly so input cache could not expire (OpenAI has 30 minutes retention). Context was steadily growing from 25K to 135K. There was no context compaction. Despite pure agentic work cache was invalidated 3 times during these 9 minutes, causing substantial costs increase. Here are traces id that causes new full cache write for input.
Traces ID:
688515c1ff04db92149a370635b6dfbc
f591b3c3861e52523c99049e28542125
80f39ae574ac6b340530bfe244d01a6a
Seems there is some tool call that is modifying prior context and causing full cache invalidation
Expected Behavior
As long as there is no context compaction or cache time has not expired there should not be cache invalidation with full context cache write.
Actual Behavior
Cache is invalidated when it should not.
Steps to reproduce the issue
Hard to tell what is causing it. Providing traces id:
- before invalidating cache: a9ca8bb342da0e7d4fcca5498a25bf0e
next request invalidating cache: 688515c1ff04db92149a370635b6dfbc - before invalidating cache: ca3e9dfbf07552b61e0b5c486d0ffd06
next request invalidating cache: f591b3c3861e52523c99049e28542125 - before invalidating cache: 99eb39484857d759ba5d9ad7e999f837
next request invalidating cache: 80f39ae574ac6b340530bfe244d01a6a
Command Code Version
1.11.0
Operating System
Linux
Terminal/IDE
JetBrains-JediTerm
Shell
zsh
Session file (optional)
No response
Fix prompt (optional)
No response
Additional context
No response
- Vorherrschende Sprache
- Keine Sprachdaten
- Sterne
- 4k
- Forks
- 350
- PR-Merge-Kennzahlen
- Keine gemergten PRs in 30 T.
Beitragsleitfaden
Für dieses Repository ist kein Beitragsleitfaden indexiert
Erste Schritte
- Lesen Sie das ganze Issue und danach den Beitragsleitfaden des Projekts.
- Schreiben Sie ins Issue, dass Sie es übernehmen — das erspart doppelte Arbeit.
- Forken Sie das Repository und arbeiten Sie in einem Branch.
- Öffnen Sie einen Pull Request, der die Issue-Nummer nennt.
Mehr aus CommandCodeAI/command-code
-
Schwierigkeit 2/5 1-3 Stunden Anfängerfreundlichkeit 68/100
CommandCodeAI/command-code#855 ·
-
Schwierigkeit 2/5 1-3 Stunden Anfängerfreundlichkeit 78/100
CommandCodeAI/command-code#841 · 1 Kommentar ·
-
Schwierigkeit 2/5 1-3 Stunden Anfängerfreundlichkeit 68/100
CommandCodeAI/command-code#655 · 1 Kommentar ·
-
Schwierigkeit 2/5 1-3 Stunden Anfängerfreundlichkeit 68/100
CommandCodeAI/command-code#608 ·
-
Schwierigkeit 3/5 1-2 Tage Anfängerfreundlichkeit 70/100
CommandCodeAI/command-code#893 ·
Alle Issues in CommandCodeAI/command-code
Ähnliche Issues
-
bug-unconfirmed
Schwierigkeit 2/5 1-3 Stunden Anfängerfreundlichkeit 76/100
-
enhancement
Schwierigkeit 2/5 1-3 Stunden Anfängerfreundlichkeit 68/100
JuliusBrussee/caveman#1102 · 1 Kommentar ·
-
Schwierigkeit 2/5 1-3 Stunden Anfängerfreundlichkeit 78/100
use-agent-os/agent-os#3263 ·
-
[Bug]: context-limit error parsing has no pattern for llama.cpp's "context size (N tokens)" phrasing Offenarea/compression area/local-models area/sessions comp/agent duplicate P2 sweeper:risk-session-state type/bug
Schwierigkeit 2/5 1-3 Stunden Anfängerfreundlichkeit 82/100
NousResearch/hermes-agent#117793 · 1 Kommentar ·
-
possible bug
Schwierigkeit 2/5 1-3 Stunden Anfängerfreundlichkeit 88/100
Mintplex-Labs/anything-llm#6415 · 1 Kommentar ·