Synthszr Charts — die großen AI-Marken im Wettkampf ums Podium
synthszr charts
deepeval

Deepeval · seit Erste PyPI-Veröffentlichung: 15. August 2023 (als "deepeval") · 3× · zuletzt 05. Okt. 2026

33
Momentum

DeepEval ist ein Open-Source-Framework von Confident AI zur Evaluierung und zum Testen von LLM-Anwendungen (RAG, Chatbots, AI-Agenten, Voice). Es bietet über 50 vorgefertigte, forschungsbasierte Metriken (u.a. Halluzination, Faithfulness, Answer Relevancy, G-Eval) und lässt sich Pytest-artig in CI/CD-Pipelines integrieren. DeepEval läuft lokal/self-hosted und kann optional mit der kommerziellen Cloud-Plattform Confident AI für Dashboards, Tracing und Team-Kollaboration verbunden werden. Als LLM-Judge unterstützt es praktisch beliebige Modell-Provider wie OpenAI, Anthropic, Gemini, Azure OpenAI, Ollama und über LiteLLM mehr als 100 weitere Modelle.

Momentum-Verlauf
10.07.08.10.

Features

LizenzOpen Source, Apache License 2.0
PlattformPython-Bibliothek (pip install deepeval); TypeScript-SDK seit Kurzem in Beta
PreisDeepEval (Open Source): kostenlos. Confident AI Cloud: Free-Tier, Starter ab $9,99–$19,99/Nutzer/Monat
Protokoll-KompatibilitätNative OpenTelemetry/OTLP-Unterstützung für Tracing; Metriken für MCP-Interaktionen von AI-Agenten
Release-DatumErste Version am 15. August 2023 auf PyPI veröffentlicht
Unterstützte Modelle/ProviderBeliebiger LLM-Judge: OpenAI (Standard), Anthropic, Gemini, Azure OpenAI, Ollama, Amazon Bedrock, Vertex AI, Grok, sowie 100+ Modelle via LiteLLM

Weitere Produkte in dieser Kategorie: Observability & Evals

Belege (3)

Subscribe free. Unsubscribe the second it sucks.

High-signal news across AI, business, UX, and tech. Every morning.