docs(agents): keep one-off investigation tooling and raw data out of the repository
I maintainer di solito rispondono entro 1 giorno
Nessuno ha ancora preso questa issue.
Valutazione
- Difficoltà
- 2/5
- Tempo stimato
- 1-3 ore
- Idoneità per principianti
- 76/100
- Tipo di issue
- Documentazione
- Chiarezza
- Specificata chiaramente
- Stato di attività
- Attiva
- Ambito
- documentation
Direzione di ricerca
Leggi le indicazioni esistenti in AGENTS.md e la sezione sull’economia delle istruzioni in docs/plugin-philosophy.md; l’issue identifica le prove pertinenti in ADR 0056 e in ## Gotchas della skill di Playwright. Decidi se inserire la regola in AGENTS.md o in un’altra posizione, quindi aggiungi una regola di una sola riga con l’eccezione per rieseguire l’harness e una citazione delle prove di questa issue. Il lavoro è completato quando sono soddisfatti entrambi i criteri di accettazione.
Scritto dal modello di indicizzazione a partire dal testo della issue.
Descrizione
Problem
Agents doing a one-off investigation (a benchmark, an evaluation, a spike) commit the harness and its raw output alongside the conclusion. Nothing in AGENTS.md says where that material belongs, so it lands in the repository, sometimes inside a shipped plugin directory, where every install carries it.
Observed stumble
- melodic-software/claude-code-plugins#6477 committed a browser-CLI benchmark under
plugins/testing/benchmarks/browser-tools/: 52 files, including a fixture server, CDP drivers, graders, run logs, and a parser with tests. The benchmark ran once to answer one question. The answer (keep playwright-cli, don't adopt agent-browser) was already recorded in ADR 0056 and the playwright skill's## Gotchas. - melodic-software/claude-code-plugins#6525 removed it again. That took a second PR, a
bump: nonechangelog fragment, a spell-check exclusion cleanup, a CHANGELOG entry, and edits to every reference that cited the deleted results file.
This meets the instruction economy bar: the model didn't follow this unaided, and the cleanup cost more than one standing line.
Proposal
Add one line to AGENTS.md, roughly:
One-off investigation tooling and raw data (benchmarks, spikes, evaluation harnesses, run logs) stay in the session scratchpad; commit only the conclusion, to the ADR, doc, or skill that uses it. Commit a harness only when something re-runs it (a CI lane, a schedule, a skill action).
Open questions for whoever picks this up:
- Is a line in
AGENTS.mdthe right surface, or should a CI check also flag new non-shipped directories (such asbenchmarks/) underplugins/*/? - Should "commit only the conclusion" name where reproduction notes go when a result needs to be re-checkable (for example, a short method section in the ADR)?
Acceptance criteria
-
AGENTS.md(or the surface chosen above) states the rule in one line, with the exception for re-run harnesses. - The line cites this issue's evidence, per the instruction-economy rule.
Generated by Claude Code
- Lingua principale
- Shell
- Stelle
- 22
- Fork
- 2
- Merge medio
- 6h 10m
- PR unite (30g)
- 937
Preparare l'ambiente
- Nessun Dockerfile né file Docker Compose
- Nessun modello di pull request
- Leggi la guida per i contributori
Come iniziare
- Leggi tutta la issue e poi la guida ai contributi del progetto.
- Commenta sulla issue per dire che te ne occupi tu — evita che due persone facciano lo stesso lavoro.
- Fai un fork del repository e lavora su un branch.
- Apri una pull request che faccia riferimento al numero della issue.
Altre issue di melodic-software/claude-code-plugins
-
docs(evals): note CLAUDE_CODE_PRINT_BG_WAIT_CEILING_MS for headless eval runs that use workflowsApertagood first issue needs-triage priority: low
Difficoltà 2/5 1-3 ore Idoneità per principianti 75/100
melodic-software/claude-code-plugins#7022 · 1 commento ·
I maintainer di solito rispondono entro 1 giorno
-
good first issue needs-triage priority: low
Difficoltà 1/5 Meno di un'ora Idoneità per principianti 88/100
melodic-software/claude-code-plugins#7019 · 1 commento ·
I maintainer di solito rispondono entro 1 giorno
-
fix(ci): check-changed-skills.sh fails a stale branch on skills only main changedForse già presa Una pull request collegata a questa issue è aperta o già unita. Apertagood first issue needs-triage priority: medium
Difficoltà 2/5 1-3 ore Idoneità per principianti 72/100
melodic-software/claude-code-plugins#7014 · 1 commento ·
I maintainer di solito rispondono entro 1 giorno
-
fix(knowledge): list-promotion-candidates prints a stack trace on a malformed claim inventoryApertagood first issue needs-triage priority: low
Difficoltà 2/5 1-3 ore Idoneità per principianti 82/100
melodic-software/claude-code-plugins#6982 · 1 commento ·
I maintainer di solito rispondono entro 1 giorno
-
fix(knowledge): frame the video title and URL in the video-digest resume prompt as untrusted dataForse già presa Una pull request collegata a questa issue è aperta o già unita. Apertaneeds-human needs-triage
Difficoltà 2/5 1-3 ore Idoneità per principianti 62/100
melodic-software/claude-code-plugins#6980 · 1 commento ·
I maintainer di solito rispondono entro 1 giorno
Tutte le issue di melodic-software/claude-code-plugins
Issue simili
-
PacReq: mangowcApertapackage request
Difficoltà 2/5 1-3 ore Idoneità per principianti 68/100
pacstall/pacstall-programs#9475 ·
I maintainer di solito rispondono entro 2 giorni
-
Difficoltà 2/5 1-3 ore Idoneità per principianti 66/100
-
Difficoltà 1/5 Meno di un'ora Idoneità per principianti 71/100
t4t5/omdrop-owl#14 ·
I maintainer di solito rispondono entro 1 giorno
-
enhancement
Difficoltà 2/5 1-3 ore Idoneità per principianti 68/100
I maintainer di solito rispondono entro 1 giorno
-
Difficoltà 2/5 1-3 ore Idoneità per principianti 82/100
I maintainer di solito rispondono entro 1 giorno