[bot] Bedrock Runtime plugin does not minimize output or capture token metrics for embedding models (Titan Embeddings, Cohere Embed)
I maintainer di solito rispondono entro 1 giorno
Valutazione
- Difficoltà
- 3/5
- Tempo stimato
- 1-2 giorni
- Idoneità per principianti
- 68/100
- Tipo di issue
- Bug
- Chiarezza
- Abbastanza chiara
- Stato di attività
- Attiva
- Stack tecnologico
- aws, typescript
- Ambito
- observability
Direzione di ricerca
Inizia in js/src/instrumentation/plugins/bedrock-runtime-plugin.ts da extractBedrockRuntimeOutput e parseBedrockRuntimeMetrics, quindi esamina bedrock-runtime-common.ts e la gestione degli embeddings in openai-plugin.ts. Il lavoro è completato quando le risposte degli embeddings di Bedrock vengono riepilogate tramite la lunghezza dell'embedding invece di registrare i vettori e inputTextTokenCount di Titan viene esposto come utilizzo dei token per le chiamate a invokeModel.
Scritto dal modello di indicizzazione a partire dal testo della issue.
Descrizione
Summary
The @aws-sdk/client-bedrock-runtime InvokeModelCommand surface is used both for text-generation models and for embeddings models (Amazon Titan Text Embeddings V2, Cohere Embed v3/v4 on Bedrock). This repo's Bedrock Runtime plugin treats every invokeModel call identically — it does not detect embeddings responses, so it logs the full raw embedding vector(s) as span output instead of a minimized summary, and it fails to extract token-usage metrics for Titan Embeddings because the plugin's usage-parsing logic only looks for a nested usage/metrics object, which Titan's response does not have.
This is a "materially less detail / less consistent" gap relative to every other embeddings-capable provider already instrumented in this repo: OpenAI, Cohere (direct), Mistral, Groq, and HuggingFace all special-case their embeddings endpoints to log { embedding_length: N } (or equivalent) instead of the raw vector, and to parse token usage from the embeddings response. Bedrock's invokeModel path has no such special-casing at all.
What instrumentation is missing
In js/src/instrumentation/plugins/bedrock-runtime-plugin.ts:
extractBedrockRuntimeOutput(line 151): foroperation === "invokeModel"it doesparseJsonBody(response?.body) ?? summarizeBody(response?.body)— fully generic, no branch for embedding responses.extractBedrockRuntimeResponseMetrics(line 205) →parseBedrockRuntimeMetrics(line 229): looks forinputTokens/inputTokenCount/input_tokens/prompt_tokensinside ausage(ormetadata.usage) object. Titan Embeddings V2's response is{ "embedding": [...], "inputTextTokenCount": <int> }— there is nousageobject at all, and the field is namedinputTextTokenCount, which none of the recognized aliases match. As a result, no token metric is captured for Titan Embeddings calls.bedrock-runtime-common.ts'sgetBedrockRuntimeOperation/buildBedrockRuntimeSpanInfodispatch purely on AWS SDK command class name (InvokeModelCommand, etc.) and model-agnostic operation strings ("invokeModel"); there is no notion of "this invokeModel call is an embeddings call" anywhere in the plugin.
Concretely, for amazon.titan-embed-text-v2:0 (default 1024-dim, non-normalized-off) or cohere.embed-english-v3 (1024-dim, up to 96 texts per call), the full float array(s) — e.g. {"embedding": [0.0123, -0.0456, ... 1024 floats]} or {"embeddings": [[1024 floats], [1024 floats], ...], "id", "response_type", "texts"} — get logged verbatim as span output, and (for Titan) the inputTextTokenCount field is silently dropped rather than surfaced as a prompt_tokens/tokens metric.
Compare to the OpenAI plugin's embeddings handling (js/src/instrumentation/plugins/openai-plugin.ts, embeddingsCreate channel):
extractOutput: (result) => {
const embedding = result?.data?.[0]?.embedding;
return Array.isArray(embedding)
? { embedding_length: embedding.length }
: undefined;
},
No equivalent exists for Bedrock's invokeModel embeddings path.
Braintrust docs status
not_found — https://www.braintrust.dev/docs/integrations/ai-providers/bedrock documents general Bedrock model access (chat models, tool calls, multimodal) but does not mention embeddings models or Titan/Cohere Embed specifically. A broader search of braintrust.dev/docs turned up no page describing Bedrock embeddings tracing/logging behavior. General Bedrock chat/Converse instrumentation is otherwise documented and implemented (see closed issue braintrustdata/braintrust-sdk-javascript#1741).
Upstream sources
- Titan Text Embeddings V2 model card (request/response shape,
inputTextTokenCountfield): https://docs.aws.amazon.com/bedrock/latest/userguide/model-card-amazon-titan-text-embeddings-v2.html - Titan Embeddings G1 parameters: https://docs.aws.amazon.com/bedrock/latest/userguide/model-parameters-titan-embed-text.html
- Cohere Embed v3 on Bedrock (request/response shape,
embeddings/response_typefields): https://docs.aws.amazon.com/bedrock/latest/userguide/model-parameters-embed-v3.html
Braintrust local repo files inspected
js/src/instrumentation/plugins/bedrock-runtime-plugin.ts(extractBedrockRuntimeOutput,extractBedrockRuntimeResponseMetrics,parseBedrockRuntimeMetrics)js/src/instrumentation/plugins/bedrock-runtime-common.ts(getBedrockRuntimeOperation,buildBedrockRuntimeSpanInfo)js/src/instrumentation/plugins/openai-plugin.ts(embeddings comparison baseline,embeddingsCreatechannel)js/src/instrumentation/plugins/cohere-plugin.ts,mistral-plugin.ts,groq-plugin.ts,huggingface-plugin.ts(confirmed each special-cases embeddings output minimization; grepped forSpanTypeAttribute.EMBEDDING/embeddingusage acrossjs/src/instrumentation/plugins/)
- Lingua principale
- TypeScript
- Stelle
- 29
- Fork
- 16
- Merge medio
- 1g 20h
- PR unite (30g)
- 70
Preparare l'ambiente
- Include un Dockerfile o un file Docker Compose
- Nessun modello di pull request
- Nessuna guida per i contributori
Come iniziare
- Leggi tutta la issue e poi la guida ai contributi del progetto.
- Commenta sulla issue per dire che te ne occupi tu — evita che due persone facciano lo stesso lavoro.
- Fai un fork del repository e lavora su un branch.
- Apri una pull request che faccia riferimento al numero della issue.
Altre issue di braintrustdata/braintrust-sdk-javascript
-
typescript
Difficoltà 4/5 3-5 giorni Idoneità per principianti 55/100
braintrustdata/braintrust-sdk-javascript#2578 ·
I maintainer di solito rispondono entro 1 giorno
-
typescript
Difficoltà 4/5 3-5 giorni Idoneità per principianti 55/100
braintrustdata/braintrust-sdk-javascript#2577 ·
I maintainer di solito rispondono entro 1 giorno
-
Difficoltà 4/5 3-5 giorni Idoneità per principianti 55/100
braintrustdata/braintrust-sdk-javascript#2527 · 1 commento ·
I maintainer di solito rispondono entro 1 giorno
-
Difficoltà 4/5 3-5 giorni Idoneità per principianti 65/100
braintrustdata/braintrust-sdk-javascript#2526 ·
I maintainer di solito rispondono entro 1 giorno
-
Difficoltà 4/5 3-5 giorni Idoneità per principianti 56/100
braintrustdata/braintrust-sdk-javascript#2482 ·
I maintainer di solito rispondono entro 1 giorno
Tutte le issue di braintrustdata/braintrust-sdk-javascript
Issue simili
-
Difficoltà 2/5 1-3 ore Idoneità per principianti 78/100
JoviDeCroock/pracht#432 ·
I maintainer di solito rispondono entro 1 giorno
-
Add: CNN en Espanol SDApertaapproved check:passed streams:add
Difficoltà 1/5 Meno di un'ora Idoneità per principianti 75/100
I maintainer di solito rispondono entro 1 giorno
-
Hardware attribute name "app Connection Support" has inconsistent casingForse già presa Una pull request collegata a questa issue è aperta o già unita. Aperta
Difficoltà 1/5 Meno di un'ora Idoneità per principianti 88/100
walletbeat/walletbeat#1628 ·
I maintainer di solito rispondono entro 1 giorno
-
bug go
Difficoltà 2/5 1-3 ore Idoneità per principianti 82/100
genkit-ai/genkit#6761 · 1 commento ·
I maintainer di solito rispondono entro 2 giorni
-
Difficoltà 2/5 1-3 ore Idoneità per principianti 72/100
NousResearch/hermes-agent#136483 ·
I maintainer di solito rispondono entro 1 giorno