Salta al contenuto principale
Privacy on-premLangChain · LlamaIndex · OpenTelemetryJSON / JSONL · max 10 MBNessun SDK required

Carica Trace File

Formati supportati

LC
LangChain

JSON con run_id e child_runs annidati.

OT
OpenTelemetry

OTLP JSON con resourceSpans o flat JSONL con traceId+spanId.

LI
LlamaIndex

JSONL con event_type e parent_id (CBEventType).

Come funziona

Esporta il trace

Da LangChain usa FileCallbackHandler. Da LlamaIndex, CBEventHandler. Da OpenTelemetry, otlp-json exporter.

Carica il file

JSON o JSONL fino a 10 MB. Il parser rileva il formato automaticamente.

Esplora il tree

Espandi i nodi, clicca per dettaglio: input, output, latency, tokens, costo EUR, errori.

Privacy garantita

Tutto avviene nel browser. Nessun dato inviato al server. Nessun SDK richiesto.

USP vs LangSmith / Helicone

FeatureQuesto toolLangSmithHelicone
SDK obbligatorioNoSiSi
Dati al cloudMaiSempreSempre
Multi-formatLC+OT+LISolo LCParziale
CostoGratuitoFreemiumFreemium

Come utilizzare AI Agent Trace Viewer

Esporta il trace dal tuo framework

Da LangChain usa FileCallbackHandler o l'export LangSmith, da LlamaIndex il CBEventHandler, da OpenTelemetry l'exporter otlp-json. Ottieni un file .json, .jsonl o .ndjson.

Trascina o carica il file trace

Usa la drop zone o clicca per selezionare il file (max 10 MB). Il parser riconosce automaticamente il formato: LangChain, LlamaIndex oppure OpenTelemetry.

Esplora l'albero delle chiamate

Espandi o comprimi i nodi (LLM call, tool call, observation, decision). Clicca su un nodo per aprire il pannello dettaglio con input, output, latency, token e costo stimato.

Analizza le statistiche globali e gli errori

In cima ai risultati trovi latenza totale, token totali, costo stimato in EUR, error rate e numero di nodi: utile per identificare rapidamente colli di bottiglia o fallimenti nell'agente.

Suggerimenti

  • Usa "Espandi tutto" per avere una panoramica completa dell'albero prima di concentrarti sui nodi con error rate o latenza alta.
  • Ordina mentalmente l'analisi per i nodi con la barra latency-slow (oltre 8 secondi): sono i candidati migliori per ottimizzazioni di performance.
  • Se lavori con trace molto grandi in JSONL, verifica che il file non superi le 5000 righe: oltre quel limite valuta di dividerlo in più export.

Domande frequenti

Quali formati di trace supporta il viewer?

Supporta tre formati: LangChain (JSON con run_id e child_runs annidati), OpenTelemetry (OTLP JSON con resourceSpans o JSONL flat con traceId+spanId) e LlamaIndex (JSONL con event_type e parent_id dalla callback CBEventType).

I miei dati vengono inviati a un server o a un cloud esterno?

No. Il parsing è interamente client-side: il file viene letto ed elaborato nel browser tramite FileReader, senza alcuna chiamata di rete. È pensato come alternativa privacy-first a strumenti cloud come LangSmith o Helicone.

Cosa rappresenta il costo stimato in EUR per nodo?

È una stima del costo della chiamata LLM basata sui token in ingresso/uscita registrati nel trace. Se il trace non contiene informazioni sul provider/modello o l'inferenza è on-prem, il costo può risultare €0.

Perché il tool ha un limite di 10 MB e 5000 righe JSONL?

È un limite tecnico per garantire un parsing e un rendering fluidi nel browser, dato che tutta l'elaborazione avviene client-side senza streaming server-side. Per trace molto grandi, valuta di filtrare o segmentare l'export prima del caricamento.

Serve installare un SDK per usare questo viewer?

No, a differenza di strumenti come LangSmith o Helicone non serve integrare alcun SDK proprietario nel tuo codice: basta esportare il trace nei formati standard già supportati dal tuo framework (LangChain, LlamaIndex, OpenTelemetry) e caricarlo qui.