FEAT Add Agentic Prompt-Injection Boundary Pairs dataset loader
I maintainer di solito rispondono entro 2 giorni
Valutazione
- Difficoltà
- 4/5
- Tempo stimato
- 3-5 giorni
- Idoneità per principianti
- 48/100
Direzione di ricerca
Inizia esaminando i loader dei dataset esistenti di PyRIT e la gestione di SeedDataset, quindi traccia il modo in cui sono rappresentati i metadati e i filtri. Implementa il comportamento di caricamento richiesto per i dataset di training, validazione, test, combinati, di attacco, benigni e appaiati, preservando i metadati delle coppie. Aggiungi unit test con mock, documentazione e aggiornamenti della bibliografia; verifica gli split isolati per scenario e i filtri tipizzati.
Scritto dal modello di indicizzazione a partire dal testo della issue.
Descrizione
Is your feature request related to a problem? Please describe.
PyRIT does not currently expose a paired prompt-injection dataset designed to test the boundary between legitimate agent workflows and adversarial instructions. Attack-only collections are useful for recall, but they do not let users build or inspect false-positive-aware test surfaces where benign and attack prompts intentionally share the same scenario and vocabulary.
Describe the solution you'd like
Add a remote loader for the CC BY 4.0 Agentic Prompt-Injection Boundary Pairs dataset.
The proposed loader would:
- load the published train, validation, test, or combined surface;
- default to attack examples for red-team use while allowing benign or paired loading;
- preserve
pair_id,scenario_id,attack_family,pair_family,source_context,risk_domain,target_boundary,split, and label metadata; - support typed filters for label, split, attack family, and source context;
- keep scenario-isolated split semantics intact;
- include mocked unit tests, documentation, and bibliography updates.
The dataset contains 1,200 English records organized as 600 controlled benign/attack pairs across 50 enterprise and agentic scenarios and 12 attack families. JSONL and Parquet artifacts, deterministic build scripts, validation, checksums, and a 30% stratified manual-review record are public.
Describe alternatives you've considered, if relevant
Users can download the JSONL files directly, but that bypasses PyRIT dataset discovery, metadata preservation, filtering, and consistent SeedDataset handling. A generic file loader would also lose the paired-boundary semantics unless every consumer rebuilt the same mapping.
Additional context
Dataset: https://huggingface.co/datasets/3nesdeniz/agentic-prompt-injection-boundary-pairs
Source and build pipeline: https://github.com/3nesdeniz/agentic-prompt-injection-boundary-pairs
I maintain the dataset and can keep the loader schema synchronized with tagged dataset releases.
- Lingua principale
- Python
- Stelle
- 4.6k
- Fork
- 924
- Merge medio
- 2g 10h
- PR unite (30g)
- 210
Preparare l'ambiente
Avvia il container di sviluppo del progetto nel browser, con il tuo account GitHub.
- Nessun Dockerfile né file Docker Compose
- Ha un modello di pull request
- Nessuna guida per i contributori
Come iniziare
- Leggi tutta la issue e poi la guida ai contributi del progetto.
- Commenta sulla issue per dire che te ne occupi tu — evita che due persone facciano lo stesso lavoro.
- Fai un fork del repository e lavora su un branch.
- Apri una pull request che faccia riferimento al numero della issue.
Altre issue di microsoft/PyRIT
-
BUG: PlagiarismScorer accepts invalid n-gram size and blank reference textForse già presa @RohithPariki l’ha presa 2 giorni fa. Aperta
Difficoltà 2/5 1-3 ore Idoneità per principianti 85/100
I maintainer di solito rispondono entro 2 giorni
-
PackageHallucinationScorer (Python) misses `from pkg.sub import x` and indented importsForse già presa @barry166 l’ha presa 3 giorni fa. Aperta
Difficoltà 2/5 1-3 ore Idoneità per principianti 88/100
microsoft/PyRIT#2948 · 1 commento ·
I maintainer di solito rispondono entro 2 giorni
-
LiteLLMChatTarget does not flag or survive output-token truncationForse già presa Una pull request collegata a questa issue è aperta o già unita. Aperta
Difficoltà 2/5 1-3 ore Idoneità per principianti 84/100
I maintainer di solito rispondono entro 2 giorni
-
BUG Configuration keeps runtime-status errors after polling recoversForse già presa @rupayon123 l’ha presa 9 giorni fa. ApertaBug: triage GUI help wanted
Difficoltà 2/5 1-3 ore Idoneità per principianti 86/100
microsoft/PyRIT#2868 · 1 commento ·
I maintainer di solito rispondono entro 2 giorni
-
ObjectiveScorerEvaluator scores every conversation message as an assistant responseForse già presa @feiiiiii5 l’ha presa 10 giorni fa. Aperta
Difficoltà 2/5 1-3 ore Idoneità per principianti 88/100
I maintainer di solito rispondono entro 2 giorni
Tutte le issue di microsoft/PyRIT
Issue simili
-
feature:LinkChecker
Difficoltà 2/5 1-3 ore Idoneità per principianti 66/100
digitalfabrik/integreat-cms#4594 ·
I maintainer di solito rispondono entro 5 giorni
-
Difficoltà 2/5 1-3 ore Idoneità per principianti 78/100
I maintainer di solito rispondono entro 1 giorno
-
Difficoltà 2/5 1-3 ore Idoneità per principianti 70/100
EleutherAI/lm-evaluation-harness#4319 ·
I maintainer di solito rispondono entro 1 giorno
-
needs triage
Difficoltà 2/5 1-3 ore Idoneità per principianti 76/100
I maintainer di solito rispondono entro 1 giorno
-
json_params_matcher fails on falsy top-level JSON primitives (0, False, "")Forse già presa @mayureshsonawane17 l’ha presa oggi. ApertaWaiting for: Product Owner
Difficoltà 2/5 1-3 ore Idoneità per principianti 84/100
I maintainer di solito rispondono entro 5 giorni