[BOT ISSUE] Google GenAI embedContent spans lack embedding-specific input, metrics, and span type
Nadie ha tomado este issue todavía.
Evaluación
- Dificultad
- 3/5
- Tiempo estimado
- 1-2 días
- Aptitud para principiantes
- 74/100
- Tipo de issue
- Error
- Claridad
- Bien especificado
- Estado de actividad
- Tranquilo
- Stack tecnológico
- java
- Área
- observability
Línea de trabajo
Comienza en braintrust-sdk/instrumentation/genai_1_18_0/src/main/java/com/google/genai/BraintrustApiClient.java, especialmente en tagSpan() y getOperation(). Revisa BraintrustGenAITest.java y los formatos de solicitud y respuesta de embedContent de Google GenAI. El trabajo estará terminado cuando los spans de embedding capturen los campos de entrada solicitados y la métrica de caracteres facturables, utilicen un tipo de span de embedding y tengan una cobertura de pruebas específica.
Escrito por el modelo de indexación a partir del texto del issue.
Descripción
Summary
When client.models.embedContent() is called through the instrumented Google GenAI client, the call is captured at the HTTP level but the span contains almost no useful embedding-specific detail. The tagSpan() method in BraintrustApiClient only extracts fields relevant to generateContent (like contents, generationConfig, usageMetadata), which are absent from embedding requests and responses.
The span is created with the correct operation name (embed_content) but has:
- Empty
input_json: only{"model": "..."}— the actualcontentbeing embedded,taskType,title, andoutputDimensionalityare not extracted - No metrics: embedding responses use
metadata.billableCharacterCountinstead ofusageMetadata, so no token/character counts are captured - Incorrect span type: marked as
type: "llm"rather thantype: "embedding"(or equivalent)
The full response is stored in output_json as a raw dump, so the embedding vector data is technically present but not meaningfully structured.
What is missing
In BraintrustApiClient.tagSpan() (lines 50–161):
Request parsing (lines 97–112):
- Checks for
contents(generateContent field) but embedContent usescontent(singular) - Checks for
generationConfigbut embedContent usestaskType,title,outputDimensionality - Result:
input_jsononly contains{"model": "..."}for embedding calls
Response parsing (lines 116–149):
- Checks for
usageMetadatawithpromptTokenCount/candidatesTokenCountbut embedContent responses havemetadatawithbillableCharacterCount - Result: no metrics are captured
Span attributes (line 156):
- Hardcodes
type: "llm"for all calls including embeddings
Braintrust docs status
- The Braintrust Gemini integration docs at
braintrust.dev/docs/integrations/ai-providers/geminido not mention embeddings: not_found - No embeddings instrumentation is documented for any provider in Java
Upstream sources
- Google GenAI embeddings docs: https://ai.google.dev/gemini-api/docs/embeddings — documents
embedContentas a stable, first-class API with models likegemini-embedding-001 - Google GenAI Java SDK:
client.models.embedContent()is available withEmbedContentConfig(taskType, title, outputDimensionality) and returnsEmbedContentResponsewithembeddingsandmetadata - embedContent request format: uses
content(singular),taskType,title,outputDimensionality— none of which match the generateContent fields currently extracted - embedContent response format: returns
embedding.valuesarray andmetadata.billableCharacterCount— notusageMetadata
Local files inspected
braintrust-sdk/instrumentation/genai_1_18_0/src/main/java/com/google/genai/BraintrustApiClient.java— lines 50–161 (tagSpanonly extracts generateContent-relevant fields), lines 325–333 (getOperationcorrectly parsesembedContenttoembed_content)braintrust-sdk/instrumentation/genai_1_18_0/src/test/java/dev/braintrust/instrumentation/genai/v1_18_0/BraintrustGenAITest.java— no embedContent test existsbraintrust-sdk/instrumentation/genai_1_18_0/src/main/java/com/google/genai/BraintrustInstrumentation.java— wraps ApiClient generically, no embedding-specific logic
- Lenguaje dominante
- Java
- Estrellas
- 21
- Forks
- 5
- Merge medio
- 2 d 7 h
- PR fusionados (30 d)
- 8
Guía de contribución
Primeros pasos
- Lee el issue completo y luego la guía de contribución del proyecto.
- Comenta en el issue que vas a ocuparte — evita que dos personas hagan lo mismo.
- Haz un fork del repositorio y trabaja en una rama.
- Abre un pull request que haga referencia al número del issue.
Más de braintrustdata/braintrust-sdk-java
-
Dificultad 2/5 1-3 horas Aptitud para principiantes 82/100
-
Dificultad 2/5 1-3 horas Aptitud para principiantes 82/100
-
Dificultad 2/5 1-3 horas Aptitud para principiantes 82/100
-
Dificultad 2/5 1-3 horas Aptitud para principiantes 78/100
-
Dificultad 2/5 1-3 horas Aptitud para principiantes 68/100
Todos los issues de braintrustdata/braintrust-sdk-java
Issues similares
-
Dificultad 2/5 1-3 horas Aptitud para principiantes 85/100
HL7/fhir-ig-publisher#1375 ·
-
Dificultad 2/5 1-3 horas Aptitud para principiantes 74/100
-
Flaky: a relaunched catch-up replay can still report catching up right after its marker is written Abiertobug
Dificultad 2/5 1-3 horas Aptitud para principiantes 78/100
johanhaleby/occurrent#1134 ·
-
bug
Dificultad 2/5 1-3 horas Aptitud para principiantes 78/100
objectionary/jeo-maven-plugin#1811 ·
-
Dificultad 2/5 1-3 horas Aptitud para principiantes 88/100