Planned

Testverlauf und Antwortvergleich für KI-Agenten

AANWB Golf
5 days ago
0 comments

Problemstellung

Derzeit gibt es keine Möglichkeit, die Antworten von KI-Agenten über verschiedene Testsitzungen hinweg nachzuverfolgen oder zu vergleichen. Wenn Benutzer Wissensdatenbank-Quellen oder Anweisungen aktualisieren, können sie Verbesserungen nicht einfach validieren, da frühere Testergebnisse verloren gehen. Das macht eine manuelle Dokumentation oder Screenshots erforderlich, um „Vorher-Nachher“-Vergleiche durchzuführen.

Gewünschtes Ergebnis

Ein sichtbarer Verlauf oder ein Protokoll im Testbereich des KI-Agenten, in dem vergangene Fragen und die dazugehörigen Antworten gespeichert werden. Dies würde es den Nutzern ermöglichen, frühere Iterationen einzusehen und zu überprüfen, ob bestimmte Änderungen an der Wissensdatenbank die Ausgabe des KI-Agenten tatsächlich verbessert haben.

💡

Reminder: Insights help guide our direction. Votes and discussions help us understand demand, but don't guarantee development. Every insight receives a response within 30 days.

Discussion (0)

Sign in to join the discussion