[BOT ISSUE] Google GenAI embedContent spans lack embedding-specific input, metrics, and span type
Nessuno ha ancora preso questa issue.
Valutazione
- Difficoltà
- 3/5
- Tempo stimato
- 1-2 giorni
- Idoneità per principianti
- 74/100
- Tipo di issue
- Bug
- Chiarezza
- Specificata chiaramente
- Stato di attività
- Tranquilla
- Stack tecnologico
- java
- Ambito
- observability
Direzione di ricerca
Inizia da braintrust-sdk/instrumentation/genai_1_18_0/src/main/java/com/google/genai/BraintrustApiClient.java, in particolare da tagSpan() e getOperation(). Esamina BraintrustGenAITest.java e i formati della richiesta e della risposta di embedContent di Google GenAI. Il lavoro è completo quando gli span di embedding acquisiscono i campi di input richiesti e la metrica dei caratteri fatturabili, utilizzano un tipo di span di embedding e dispongono di una copertura dei test mirata.
Scritto dal modello di indicizzazione a partire dal testo della issue.
Descrizione
Summary
When client.models.embedContent() is called through the instrumented Google GenAI client, the call is captured at the HTTP level but the span contains almost no useful embedding-specific detail. The tagSpan() method in BraintrustApiClient only extracts fields relevant to generateContent (like contents, generationConfig, usageMetadata), which are absent from embedding requests and responses.
The span is created with the correct operation name (embed_content) but has:
- Empty
input_json: only{"model": "..."}— the actualcontentbeing embedded,taskType,title, andoutputDimensionalityare not extracted - No metrics: embedding responses use
metadata.billableCharacterCountinstead ofusageMetadata, so no token/character counts are captured - Incorrect span type: marked as
type: "llm"rather thantype: "embedding"(or equivalent)
The full response is stored in output_json as a raw dump, so the embedding vector data is technically present but not meaningfully structured.
What is missing
In BraintrustApiClient.tagSpan() (lines 50–161):
Request parsing (lines 97–112):
- Checks for
contents(generateContent field) but embedContent usescontent(singular) - Checks for
generationConfigbut embedContent usestaskType,title,outputDimensionality - Result:
input_jsononly contains{"model": "..."}for embedding calls
Response parsing (lines 116–149):
- Checks for
usageMetadatawithpromptTokenCount/candidatesTokenCountbut embedContent responses havemetadatawithbillableCharacterCount - Result: no metrics are captured
Span attributes (line 156):
- Hardcodes
type: "llm"for all calls including embeddings
Braintrust docs status
- The Braintrust Gemini integration docs at
braintrust.dev/docs/integrations/ai-providers/geminido not mention embeddings: not_found - No embeddings instrumentation is documented for any provider in Java
Upstream sources
- Google GenAI embeddings docs: https://ai.google.dev/gemini-api/docs/embeddings — documents
embedContentas a stable, first-class API with models likegemini-embedding-001 - Google GenAI Java SDK:
client.models.embedContent()is available withEmbedContentConfig(taskType, title, outputDimensionality) and returnsEmbedContentResponsewithembeddingsandmetadata - embedContent request format: uses
content(singular),taskType,title,outputDimensionality— none of which match the generateContent fields currently extracted - embedContent response format: returns
embedding.valuesarray andmetadata.billableCharacterCount— notusageMetadata
Local files inspected
braintrust-sdk/instrumentation/genai_1_18_0/src/main/java/com/google/genai/BraintrustApiClient.java— lines 50–161 (tagSpanonly extracts generateContent-relevant fields), lines 325–333 (getOperationcorrectly parsesembedContenttoembed_content)braintrust-sdk/instrumentation/genai_1_18_0/src/test/java/dev/braintrust/instrumentation/genai/v1_18_0/BraintrustGenAITest.java— no embedContent test existsbraintrust-sdk/instrumentation/genai_1_18_0/src/main/java/com/google/genai/BraintrustInstrumentation.java— wraps ApiClient generically, no embedding-specific logic
- Lingua principale
- Java
- Stelle
- 21
- Fork
- 5
- Merge medio
- 2g 7h
- PR unite (30g)
- 8
Guida per i contributori
Apri la guida per i contributori
Come iniziare
- Leggi tutta la issue e poi la guida ai contributi del progetto.
- Commenta sulla issue per dire che te ne occupi tu — evita che due persone facciano lo stesso lavoro.
- Fai un fork del repository e lavora su un branch.
- Apri una pull request che faccia riferimento al numero della issue.
Altre issue di braintrustdata/braintrust-sdk-java
-
Difficoltà 2/5 1-3 ore Idoneità per principianti 82/100
-
Difficoltà 2/5 1-3 ore Idoneità per principianti 82/100
-
Difficoltà 2/5 1-3 ore Idoneità per principianti 82/100
-
Difficoltà 2/5 1-3 ore Idoneità per principianti 78/100
-
Difficoltà 2/5 1-3 ore Idoneità per principianti 68/100
Tutte le issue di braintrustdata/braintrust-sdk-java
Issue simili
-
certification
Difficoltà 1/5 Meno di un'ora Idoneità per principianti 80/100
-
Difficoltà 2/5 1-3 ore Idoneità per principianti 75/100
-
[BUG] ECR GetAuthorizationToken returns a proxyEndpoint for the default region, not the request's Apertabug ecr
Difficoltà 2/5 1-3 ore Idoneità per principianti 75/100
-
Needs: Triage Type: Feature request
Difficoltà 2/5 1-3 ore Idoneità per principianti 70/100
AntennaPod/AntennaPod#8794 ·
-
agentic-workflows
Difficoltà 2/5 1-3 ore Idoneità per principianti 65/100
github/copilot-sdk#2760 ·