Retrieval Recall
91%
4,2 Pkt. vs. letzter Lauf
Retrieval Precision
68%
1,8 Pkt. vs. letzter Lauf
Answer Quality
Sehr gut 58%
Gut 30%
Mäßig 8%
Schlecht 4%
Tool Calls
| Tool | Anteil an allen Calls | Total | Unexpected | Recall | Precision |
|---|---|---|---|---|---|
| search_documents | 118 | 21 | 0,96 | 0,82 | |
| exact_search | 27 | 1 | 0,81 | 0,96 | |
| ersatzteile_query | 23 | 2 | 0,91 | 0,91 | |
| metadata_search | 13 | 3 | 0,71 | 0,77 | |
| list_documents | 9 | 5 | 0,80 | 0,44 | |
| Gesamt | 190 Calls · 60 Testfälle | 190 | 32 | 0,91 | 0,84 |
Selected Message Trace
0 ms1 s2 s3 s4 s
agent.runservice-agent
4 180 ms
chatgpt-oss-120b · plan
620 ms
execute_toolsearch_documents
210 ms
embeddingsnomic-embed-text-v2
38 ms
vector_db.queryhybrid
92 ms
rerankbge-reranker-v2-m3
71 ms
execute_toolersatzteile_query
84 ms
sql_engine.queryparquet
61 ms
chatgpt-oss-120b · answer
3 140 ms
guardrail.output_checkpii+toxicity
28 ms