Braintrust
An AI evaluation and observability platform for testing, tracing, benchmarking, and improving the quality of LLM applications.
Explore more about Observability Tools
Related terms
A platform for tracing, evaluating, monitoring, and debugging LLM and agent applications.
LangfuseAn observability platform for tracing, monitoring, evaluating, and debugging LLM applications and agentic systems.
Weights & BiasesW&BAn MLOps platform for experiment tracking, model monitoring, dataset versioning, and AI system evaluation.
TruLensAn open-source software library for evaluating and tracking large language model applications and RAG pipelines.
AgentOpsAn observability platform for monitoring, tracing, debugging, and evaluating AI agents and agentic workflows throughout development and production.