
AI Engineer World's Fair 20251:25:08
[Evals Workshop] Mastering AI Evaluation: From Playground to Production
Braintrust solutions engineers Carlos Esteban and Doug lead a hands-on AI evaluation workshop covering platform and SDK workflows, longitudinal experiments, code-based scoring, OpenAI configuration, TypeScript evaluation files, CI integration, prompt loading, and human review. Audience discussions examine confidence in LLM-as-a-judge results, traditional…
Carlos Esteban · Doug
APIs, MCP, and protocols · Evals · Coding and developer tools