Werkzeugkasten · 45

Alle Werkzeuge

Eval & LLMOps ★ 34.7k

Open Code Review

Hybride Code-Überprüfung, die deterministische Regeln vorrangig behandelt und das LLM zweitrangig – die einzige Reihenfolge, die eine Unternehmenssic…

Teams, die eine KI-Code-Überprüfung benötigen, die eine Sicherheitsprüfung besteht, und nicht nur in einer Demo beeindruckend aussieht Weiterlesen →

Worktrunk

Git-Worktree-Plumbing für das gleichzeitige Ausführen mehrerer Codieragenten ohne Konflikte im Arbeitsverzeichnis.

Jeder, der parallele Codieragenten gegen ein Repository ausführt Weiterlesen →

Agent Skills

Eine kuratierte Sammlung wiederverwendbarer Fähigkeiten für Codieragenten – der Unterschied zwischen einem Agenten, der Aufgaben erledigt, und einem,…

Teams, die das Verhalten mehrerer Ingenieure-Agents über einen Codebasis standardisieren Weiterlesen →

Claude Code

Der terminalnative Agent, der das agente Coden zum Mainstream gemacht hat – und der Referenzpunkt, an dem jeder andere Coding-Agent gemessen wird.

Ingenieure, die agentes Coden innerhalb bestehender Terminal- und Git-Workflows möchten Weiterlesen →

Orca

Führt viele Codieragenten parallel aus, ohne dass Sie neue Abonnements abschließen müssen – das Kostenmodell ist das Produkt.

Teams, deren Durchsatz durch Parallelität und nicht durch die Modellfähigkeit begrenzt ist Weiterlesen →

9router

Eine Routing-Schicht, die Ihren Coding-Agenten am Laufen hält, wenn ein Anbieter eine Rate-Limit erreicht – allein der Fallback lohnt sich.

Einzelne und kleine Teams, die bei intensiven Agentensitzungen auf Anbieter-Rate-Limits stoßen Weiterlesen →

Humanizer

Entfernt den verräterischen Rhythmus von Modellausgaben aus generiertem Text — nützlich und ein Hinweis darauf, dass die Merkmale nun allgemein bekan…

Bereinigung Ihrer eigenen Entwürfe vor einem menschlichen Bearbeitungsdurchgang Weiterlesen →

no-ai-slop

Eine explizite, lesbare Liste von etwa zwanzig Mustern, die darauf hindeuten, dass Text automatisch generiert wurde – nützlicher als Filter ist sie a…

Für das Erstellen von Review-Richtlinien für das Schreibteam oder eines internen Style-Linters Weiterlesen →

Chroma

Der kürzeste Weg von pip install zu einem funktionierenden Retriever – deshalb beginnt fast jedes RAG-Tutorial hier.

Prototypen, Notebooks und Single-Node-Anwendungen mit weniger als einigen Millionen Vektoren Weiterlesen →

Guardrails AI

Überprüft die Modellausgabe gegen ein Schema, anstatt zu hoffen – und stellt erneut eine Frage, wenn die Überprüfung fehlschlägt.

Strukturierte Ausgaben, die zuverlässig geparst werden müssen, und Überprüfungen von personenbezogenen Informationen oder Richtlinien vor dem Erreichen von Inhalten durch einen Benutzer Weiterlesen →

Mem0

Bietet einem Agenten Kontinuität über Sitzungen hinweg — das fehlende Puzzlestück, wenn Benutzer erwarten, dass es sie erkennt.

Assistenten und Agenten, bei denen Kontinuität über Sitzungen hinweg eine Produktanforderung ist Weiterlesen →

OpenLLMetry

LLM-Spuren als Standard-OpenTelemetry-Spuren – damit sie im Observability-Stack landen, für den Sie bereits bezahlen.

Organisationen mit einem bestehenden OpenTelemetry-Stack, die keinen zweiten Beobachtbarkeits-Silo wünschen Weiterlesen →

TensorRT-LLM

Die letzten paar Prozent der GPU-Durchsatzrate, erkauft mit erhöhter Build-Komplexität und Hardware-Abhängigkeit.

Hochvolumige Bereitstellung eines stabilen Modell-Satzes auf festgelegter NVIDIA-Hardware Weiterlesen →
RAG & Wissen ★ 25.4k

WeKnora

Document-to-RAG-Pipeline im Komplett-Paket, von einem Team, das es im Tencent-Maßstab betreibt.

Teams, die eine selbstgehostete Wissensdatenbank über interne Dokumente benötigen, insbesondere mit chinesischsprachigen Korpora Weiterlesen →
RAG & Wissen ★ 184.8k

MarkItDown

Die unglamouröse Parsingschicht, die entscheidet, ob Ihr RAG überhaupt funktioniert.

Die Ingest-Phase jedes RAG-Systems, das reale Office-Dokumente verarbeitet Weiterlesen →

Open WebUI

Die Benutzeroberfläche, die Sie den Anwendern zur Verfügung stellen, wenn die Modellschicht bereits fertiggestellt ist.

Interne Chat-Deployments auf Basis selbst gehosteter Modelle mit echten Benutzerkonten Weiterlesen →

LibreChat

Multi-Benutzer-, Multi-Anbieter-Chat-Plattform mit bereits integrierten Agenten und MCP.

Teams und Abteilungen, die eine gemeinsame Bereitstellung über mehrere Modelanbieter hinweg teilen Weiterlesen →

Agent-Reach

Webzugriff für Agenten ohne Kosten pro Anruf – einschließlich Plattformen ohne nutzbare API.

Interne Recherche- und Überwachungsagenten, bei denen die API-Kosten pro Anruf den Einsatzfall unmöglich machen Weiterlesen →

context-mode

Behandelt das Kontextfenster als Budget mit einer einzelnen Position, nicht als einen Behälter, in den ständig hineingefüllt wird.

Lang laufende Coding-Agent-Sitzungen, bei denen die Tool-Ausgabe den Kontext ertränkt Weiterlesen →

Spec Kit

Stellt die Spezifikation wieder an die Spitze des Codes, die einzige Möglichkeit, dass die Ausgabe des Agents überprüfbar bleibt.

Teams, die von einer ad-hoc-Agenten-Nutzung zu einem überprüfbaren Prozess wechseln Weiterlesen →

Superpowers

Nicht ein Werkzeug, sondern eine Methode: Codiere, wie dein Team arbeitet, und lasse den Agenten diesem Prozess folgen.

Teams, die sich grundsätzlich auf einen Prozess einigen, aber diesen in jeder Sitzung neu diskutieren Weiterlesen →

Knowledge Work Plugins

Von Herstellern veröffentlichte Plugins für die Aufgaben, die Wissensarbeiter tatsächlich ausführen – ein verwendbares Starttemplate.

Erweiterung der Agent-Implementierung über die Engineering-Abteilung hinaus in Bereiche wie Finanzen, Recht und Betrieb Weiterlesen →

vLLM

Hochleistungs-LLM-Schlußfolgerungsmotor mit PagedAttention – die Standardwahl, wenn Sie eine GPU optimal auslasten müssen.

Selbstgehostete Produktionsinferenz auf NVIDIA-/AMD-GPUs Weiterlesen →

Ollama

Ein Befehl, um ein LLM auf einem Laptop auszuführen – der schnellste Weg, um ein Modell vor einem Kunden zu präsentieren.

Lokale Demos, air-gapped-Piloten, Entwicklermaschinen Weiterlesen →

SGLang

Servicing-Engine, entwickelt für strukturierte Ausgaben und intensive Präfix-Wiederverwendung.

Strukturierte Ausgaben, Workloads mit gemeinsamen Präfixen, Agents Weiterlesen →

LiteLLM

Eine OpenAI-ähnliche Schnittstelle für über 100 Modelanbieter, plus ein Proxy, der den Ausgaben pro Schlüssel nachverfolgt.

Routing mit mehreren Anbietern, Ausgabenkontrolle, Fallbacks Weiterlesen →
RAG & Wissen ★ 44.0k

LlamaIndex

Datenframework für die Aufnahme, Indizierung und Abrufung — am stärksten bei dokumentlastigen RAG.

Dokumentlastige Unternehmens-RAG-Pipelines Weiterlesen →
RAG & Wissen ★ 11.0k

Unstructured

Wandelt PDFs, HTML und Scans in saubere, strukturierte Elemente um, die Ihr Retriever tatsächlich nutzen kann.

PDF-/Office-Import und Dokumentenparsing Weiterlesen →
RAG & Wissen ★ 21.0k

RAGFlow

End-to-End-RAG-Motor mit templatebasierter Chunking, der für Kunden präsentierbar ist.

Teams, die erklärbares, anpassbares Chunking benötigen Weiterlesen →

LangGraph

Modellieren Sie Agenten als explizite Zustandsgraphen — der Unterschied zwischen einer Demo-Schleife und einem steuerbaren System.

Lang laufende, zustandsbehaftete Agenten, die eine Steuerungsfluss benötigen Weiterlesen →

Dify

Selbsthostbare LLMOps-Plattform mit visuellen Workflows, RAG und Prompt-Verwaltung in einem Paket.

Interne Tools, selbstgehostete No-Code/Low-Code-KI-Anwendungen Weiterlesen →

CrewAI

Rollenbasierte Orchestrierung mehrerer Agenten — verständlich, wenn Sie es einem Manager erklären müssen.

Automatisierung mehrerer Agenten in Form von Geschäftsprozessen Weiterlesen →
Eval & LLMOps ★ 15.0k

Langfuse

Selbsthostbare Tracing-, Evaluations- und Promptverwaltung – die meist vergessene Observierbarkeitsebene der meisten Teams.

Tracing, Promptversionierung und Produktionsbewertungen Weiterlesen →
Eval & LLMOps ★ 11.0k

Ragas

Metrik-Suite für RAG: Treue, Kontextgenauigkeit, Recall – die Zahlen, die Sie vor einer Live-Überprüfung benötigen.

RAG-Regressions-Tests und Live-Metriken Weiterlesen →
Eval & LLMOps ★ 9.0k

Arize Phoenix

Beobachtbarkeit auf Notebook-Basis mit Clustering, das Fehlermodi aufdeckt, die Sie nicht getestet haben.

Lokale Fehlersuche und Entdeckung von Fehlermodi Weiterlesen →
Eval & LLMOps ★ 7.0k

Helicone

Drop-in-Proxy, der jeden Anfrageverlauf protokolliert und die Kosten pro Benutzer, pro Funktion und pro Tag anzeigt.

Schnelle Kostenzuordnung und Anfrageprotokollierung Weiterlesen →