Hacktoberfest 2026: le issue che i maintainer hanno segnato per ottobre, aperte e adatte ai principianti. Sfoglia le issue Hacktoberfest

How to format FIM prompts with multiple imported files for context?

Aperta
#12 6 commenti 14 reazioni 0 assegnatari Vedi su GitHub

Nessuno ha ancora preso questa issue.

Valutazione

Difficoltà
3/5
Tempo stimato
1-2 giorni
Idoneità per principianti
35/100
Tipo di issue
Documentazione
Chiarezza
Abbastanza chiara
Stato di attività
Ferma
Ambito
documentation

Direzione di ricerca

Inizia con le descrizioni del paper relative alla costruzione del contesto a livello di repository, dei commit e di CrossCode, quindi confrontale con l’eventuale documentazione esistente sull’inferenza di Seed-Coder. Documenta il formato del prompt multi-file, le convenzioni in fase di training, gli esempi e le indicazioni sui limiti di token richieste nell’issue; il lavoro sarà considerato completato quando una persona alle prime armi potrà formattare l’esempio Python fornito senza ulteriori chiarimenti.

Scritto dal modello di indicizzazione a partire dal testo della issue.

Descrizione

I'm trying to use Seed-Coder for Fill-in-the-Middle inference and want to understand the proper way to format prompts when including multiple files from imports along with the current file.

According to the paper, during training you used different approaches for multi-file context:

  • Repository-level data with topological concatenation based on file dependencies
  • Commits data with BM25-retrieved top-5 relevant files
  • CrossCode evaluation with cross-file context

However, I couldn't find clear documentation on how to format the inference prompt when I have:

  1. A current file with imports
  2. Multiple imported files that I want to include as context
  3. A specific location where I want the model to fill in code

Example

# utils.py
def helper_function():
    return "helper"

class DataProcessor:
    def process(self, data):
        return data.upper()

# config.py  
DATABASE_URL = "sqlite:///app.db"
DEBUG = True

# main.py (current file)
from utils import helper_function, DataProcessor
from config import DATABASE_URL

def main():
    # <-- WANT TO FILL HERE
    return result

Request

Could you provide:

  • Official guidance on multi-file FIM prompt formatting
  • Examples of best practices
  • Any specific format that was used during training
  • Token limit recommendations when including multiple files

Thank you!

Lingua principale
Nessun dato sulla lingua
Stelle
759
Fork
60
Metriche di merge delle PR
Nessuna PR unita negli ultimi 30g

Preparare l'ambiente

Questo progetto non fornisce container di sviluppo, Dockerfile né guida per i contributori, quindi l'ambiente è a tuo carico: parti dal suo README e consulta la nostra guida al primo contributo per i passaggi generali.

Come iniziare

  1. Leggi tutta la issue e poi la guida ai contributi del progetto.
  2. Commenta sulla issue per dire che te ne occupi tu — evita che due persone facciano lo stesso lavoro.
  3. Fai un fork del repository e lavora su un branch.
  4. Apri una pull request che faccia riferimento al numero della issue.

Altre issue di ByteDance-Seed/Seed-Coder

Tutte le issue di ByteDance-Seed/Seed-Coder

Issue simili

Altre issue su Documentation

Ricevi le nuove issue nella tua casella

Un breve riepilogo di issue GitHub adatte ai principianti.