Eval & LLMOps

Evaluations-Harnesses, Tracing, Observability, Guardrails und Prompt-Management.

Werkzeuge in dieser Kategorie

Eval & LLMOps ★ 34.7k

Open Code Review

Hybride Code-Überprüfung, die deterministische Regeln vorrangig behandelt und das LLM zweitrangig – die einzige Reihenfolge, die eine Unternehmenssic…

Teams, die eine KI-Code-Überprüfung benötigen, die eine Sicherheitsprüfung besteht, und nicht nur in einer Demo beeindruckend aussieht Weiterlesen →

Guardrails AI

Überprüft die Modellausgabe gegen ein Schema, anstatt zu hoffen – und stellt erneut eine Frage, wenn die Überprüfung fehlschlägt.

Strukturierte Ausgaben, die zuverlässig geparst werden müssen, und Überprüfungen von personenbezogenen Informationen oder Richtlinien vor dem Erreichen von Inhalten durch einen Benutzer Weiterlesen →

OpenLLMetry

LLM-Spuren als Standard-OpenTelemetry-Spuren – damit sie im Observability-Stack landen, für den Sie bereits bezahlen.

Organisationen mit einem bestehenden OpenTelemetry-Stack, die keinen zweiten Beobachtbarkeits-Silo wünschen Weiterlesen →
Eval & LLMOps ★ 15.0k

Langfuse

Selbsthostbare Tracing-, Evaluations- und Promptverwaltung – die meist vergessene Observierbarkeitsebene der meisten Teams.

Tracing, Promptversionierung und Produktionsbewertungen Weiterlesen →
Eval & LLMOps ★ 11.0k

Ragas

Metrik-Suite für RAG: Treue, Kontextgenauigkeit, Recall – die Zahlen, die Sie vor einer Live-Überprüfung benötigen.

RAG-Regressions-Tests und Live-Metriken Weiterlesen →
Eval & LLMOps ★ 9.0k

Arize Phoenix

Beobachtbarkeit auf Notebook-Basis mit Clustering, das Fehlermodi aufdeckt, die Sie nicht getestet haben.

Lokale Fehlersuche und Entdeckung von Fehlermodi Weiterlesen →
Eval & LLMOps ★ 7.0k

Helicone

Drop-in-Proxy, der jeden Anfrageverlauf protokolliert und die Kosten pro Benutzer, pro Funktion und pro Tag anzeigt.

Schnelle Kostenzuordnung und Anfrageprotokollierung Weiterlesen →

Beiträge in dieser Kategorie