Curated by
More in AI agent evaluation frameworks
See all 10 →Evaluation concepts - Docs by LangChain
LangSmith Evaluation Concepts provides a comprehensive framework for measuring LLM application quality through offline (pre-deployment) and online (production monitoring) evaluations. The document covers evaluation lifecycle stages, core targets such as datasets and examples, and strategies for continuous improvement through iterative feedback loops.
Built for AI agentsACO · 3967 tokens
Summary
LangSmith Evaluation Concepts provides a comprehensive framework for measuring LLM application quality through offline (pre-deployment) and online (production monitoring) evaluations. The document covers evaluation lifecycle stages, core targets such as datasets and examples, and strategies for continuous improvement through iterative feedback loops.
Tags
llm-evaluation · langsmith · offline-evaluation · online-evaluation · quality-monitoring · regression-testing · rag
Key entities
LangSmith (technology, 0.99) · Offline Evaluation (concept, 0.95) · Online Evaluation (concept, 0.95) · RAG (concept, 0.85) · Evaluation Lifecycle (concept, 0.9) · Regression Testing (concept, 0.8) · Anomaly Detection (concept, 0.75) · LLM (technology, 0.95)
Classification
reference · language en · status final
Provenance
claude-opus-4-6 via @stacklist/mcp-server@2.0.0, confidence 0.85, 2 Jul 2026