[bot] Bedrock Runtime plugin does not minimize output or capture token metrics for embedding models (Titan Embeddings, Cohere Embed)
Los mantenedores suelen responder en 1 día
Evaluación
- Dificultad
- 3/5
- Tiempo estimado
- 1-2 días
- Aptitud para principiantes
- 68/100
- Tipo de issue
- Error
- Claridad
- Bastante claro
- Estado de actividad
- Activo
- Stack tecnológico
- aws, typescript
- Área
- observability
Línea de trabajo
Comienza en js/src/instrumentation/plugins/bedrock-runtime-plugin.ts, en extractBedrockRuntimeOutput y parseBedrockRuntimeMetrics; después, revisa bedrock-runtime-common.ts y el manejo de embeddings en openai-plugin.ts. Se considera terminado cuando las respuestas de embeddings de Bedrock se resumen mediante la longitud del embedding en lugar de registrar los vectores, y el inputTextTokenCount de Titan se muestra como uso de tokens para las llamadas a invokeModel.
Escrito por el modelo de indexación a partir del texto del issue.
Descripción
Summary
The @aws-sdk/client-bedrock-runtime InvokeModelCommand surface is used both for text-generation models and for embeddings models (Amazon Titan Text Embeddings V2, Cohere Embed v3/v4 on Bedrock). This repo's Bedrock Runtime plugin treats every invokeModel call identically — it does not detect embeddings responses, so it logs the full raw embedding vector(s) as span output instead of a minimized summary, and it fails to extract token-usage metrics for Titan Embeddings because the plugin's usage-parsing logic only looks for a nested usage/metrics object, which Titan's response does not have.
This is a "materially less detail / less consistent" gap relative to every other embeddings-capable provider already instrumented in this repo: OpenAI, Cohere (direct), Mistral, Groq, and HuggingFace all special-case their embeddings endpoints to log { embedding_length: N } (or equivalent) instead of the raw vector, and to parse token usage from the embeddings response. Bedrock's invokeModel path has no such special-casing at all.
What instrumentation is missing
In js/src/instrumentation/plugins/bedrock-runtime-plugin.ts:
extractBedrockRuntimeOutput(line 151): foroperation === "invokeModel"it doesparseJsonBody(response?.body) ?? summarizeBody(response?.body)— fully generic, no branch for embedding responses.extractBedrockRuntimeResponseMetrics(line 205) →parseBedrockRuntimeMetrics(line 229): looks forinputTokens/inputTokenCount/input_tokens/prompt_tokensinside ausage(ormetadata.usage) object. Titan Embeddings V2's response is{ "embedding": [...], "inputTextTokenCount": <int> }— there is nousageobject at all, and the field is namedinputTextTokenCount, which none of the recognized aliases match. As a result, no token metric is captured for Titan Embeddings calls.bedrock-runtime-common.ts'sgetBedrockRuntimeOperation/buildBedrockRuntimeSpanInfodispatch purely on AWS SDK command class name (InvokeModelCommand, etc.) and model-agnostic operation strings ("invokeModel"); there is no notion of "this invokeModel call is an embeddings call" anywhere in the plugin.
Concretely, for amazon.titan-embed-text-v2:0 (default 1024-dim, non-normalized-off) or cohere.embed-english-v3 (1024-dim, up to 96 texts per call), the full float array(s) — e.g. {"embedding": [0.0123, -0.0456, ... 1024 floats]} or {"embeddings": [[1024 floats], [1024 floats], ...], "id", "response_type", "texts"} — get logged verbatim as span output, and (for Titan) the inputTextTokenCount field is silently dropped rather than surfaced as a prompt_tokens/tokens metric.
Compare to the OpenAI plugin's embeddings handling (js/src/instrumentation/plugins/openai-plugin.ts, embeddingsCreate channel):
extractOutput: (result) => {
const embedding = result?.data?.[0]?.embedding;
return Array.isArray(embedding)
? { embedding_length: embedding.length }
: undefined;
},
No equivalent exists for Bedrock's invokeModel embeddings path.
Braintrust docs status
not_found — https://www.braintrust.dev/docs/integrations/ai-providers/bedrock documents general Bedrock model access (chat models, tool calls, multimodal) but does not mention embeddings models or Titan/Cohere Embed specifically. A broader search of braintrust.dev/docs turned up no page describing Bedrock embeddings tracing/logging behavior. General Bedrock chat/Converse instrumentation is otherwise documented and implemented (see closed issue braintrustdata/braintrust-sdk-javascript#1741).
Upstream sources
- Titan Text Embeddings V2 model card (request/response shape,
inputTextTokenCountfield): https://docs.aws.amazon.com/bedrock/latest/userguide/model-card-amazon-titan-text-embeddings-v2.html - Titan Embeddings G1 parameters: https://docs.aws.amazon.com/bedrock/latest/userguide/model-parameters-titan-embed-text.html
- Cohere Embed v3 on Bedrock (request/response shape,
embeddings/response_typefields): https://docs.aws.amazon.com/bedrock/latest/userguide/model-parameters-embed-v3.html
Braintrust local repo files inspected
js/src/instrumentation/plugins/bedrock-runtime-plugin.ts(extractBedrockRuntimeOutput,extractBedrockRuntimeResponseMetrics,parseBedrockRuntimeMetrics)js/src/instrumentation/plugins/bedrock-runtime-common.ts(getBedrockRuntimeOperation,buildBedrockRuntimeSpanInfo)js/src/instrumentation/plugins/openai-plugin.ts(embeddings comparison baseline,embeddingsCreatechannel)js/src/instrumentation/plugins/cohere-plugin.ts,mistral-plugin.ts,groq-plugin.ts,huggingface-plugin.ts(confirmed each special-cases embeddings output minimization; grepped forSpanTypeAttribute.EMBEDDING/embeddingusage acrossjs/src/instrumentation/plugins/)
- Lenguaje dominante
- TypeScript
- Estrellas
- 29
- Forks
- 16
- Merge medio
- 1 d 20 h
- PR fusionados (30 d)
- 70
Preparar el entorno
- Incluye un Dockerfile o un archivo de Docker Compose
- Sin plantilla de pull request
- Sin guía de contribución
Primeros pasos
- Lee el issue completo y luego la guía de contribución del proyecto.
- Comenta en el issue que vas a ocuparte — evita que dos personas hagan lo mismo.
- Haz un fork del repositorio y trabaja en una rama.
- Abre un pull request que haga referencia al número del issue.
Más de braintrustdata/braintrust-sdk-javascript
-
typescript
Dificultad 4/5 3-5 días Aptitud para principiantes 55/100
braintrustdata/braintrust-sdk-javascript#2578 ·
Los mantenedores suelen responder en 1 día
-
typescript
Dificultad 4/5 3-5 días Aptitud para principiantes 55/100
braintrustdata/braintrust-sdk-javascript#2577 ·
Los mantenedores suelen responder en 1 día
-
Dificultad 4/5 3-5 días Aptitud para principiantes 55/100
braintrustdata/braintrust-sdk-javascript#2527 · 1 comentario ·
Los mantenedores suelen responder en 1 día
-
Dificultad 4/5 3-5 días Aptitud para principiantes 65/100
braintrustdata/braintrust-sdk-javascript#2526 ·
Los mantenedores suelen responder en 1 día
-
Dificultad 4/5 3-5 días Aptitud para principiantes 56/100
braintrustdata/braintrust-sdk-javascript#2482 ·
Los mantenedores suelen responder en 1 día
Todos los issues de braintrustdata/braintrust-sdk-javascript
Issues similares
-
effort:S priority:P2
Dificultad 2/5 1-3 horas Aptitud para principiantes 72/100
Los mantenedores suelen responder en 1 día
-
Dificultad 2/5 1-3 horas Aptitud para principiantes 82/100
cameri/nostream#811 · 1 comentario ·
Los mantenedores suelen responder en 1 día
-
Dificultad 2/5 1-3 horas Aptitud para principiantes 62/100
dam-agents/dam#4562 ·
Los mantenedores suelen responder en 1 día
-
bug p3 triaged
Dificultad 2/5 1-3 horas Aptitud para principiantes 70/100
Los mantenedores suelen responder en 1 día
-
bug javascript P2-medium python release:v3.1
Dificultad 2/5 1-3 horas Aptitud para principiantes 68/100
adrirubio/claude-deck#546 ·
Los mantenedores suelen responder en 1 día