All courses
33 published courses. Narrow by subject, role, level or format, or search by the outcome you are after.
Filter3
Filter courses
DoneSubject1
For your role1
AI for Engineers2AI for Product Managers2AI for Leaders0AI for Designers0AI for Marketers0AI for Data & Analysts2AI for Founders1
Competency1
Prompt Engineering3Agentic AI2Claude Code0Context & RAG2AI Evals2MCP & Integrations0Responsible AI2Workflows3
Format
Several filters in one group widen the results; filters in different groups narrow them.
Matching courses
foundationalAI Literacy
LLM Guardrails, Evals and Agentic MemoryLearn to take LLM applications from prototype to production.
intermediateAI Literacy
Evaluating LLM Output QualityHow to tell whether an LLM feature is actually working.
Matching modules
17 modules- Module 6Evaluation for Task Completionin Building Your First Production Agent · 3 lessonsai-for-engineersai-for-data-analystsagentic-aiai-evalsquickintermediate
- Module 1Start Herein Building an Eval Harness · 1 lessonai-for-data-analystsai-evalsstandardintermediate
- Module 2Foundations of Eval Harnessesin Building an Eval Harness · 4 lessonsai-for-data-analystsai-evalsstandardintermediate
- Module 3Building the Test Datasetin Building an Eval Harness · 3 lessonsai-for-data-analystsai-evalsstandardintermediate
- Module 4Writing Graders and Scoring Rubricsin Building an Eval Harness · 4 lessonsai-for-data-analystsai-evalsstandardintermediate
- Module 5Thresholds, Regressions, and Comparisonsin Building an Eval Harness · 4 lessonsai-for-data-analystsai-evalsstandardintermediate
- Module 6Diagnosing Failures and Operationalizing the Harnessin Building an Eval Harness · 6 lessonsai-for-data-analystsai-evalsstandardintermediate
- Module 1Why LLM Outputs Break: Understanding Prompt Driftin Evaluating LLM Output Quality · 3 lessonsai-for-engineersai-for-product-managersai-for-data-analystsprompt-engineeringai-evalsquickfoundational
- Module 2Structured Output as a Contractin Evaluating LLM Output Quality · 3 lessonsai-for-engineersai-for-data-analystsprompt-engineeringai-evalsquickfoundational
- Module 3Corrective Retries: Recovering from Validation Failuresin Evaluating LLM Output Quality · 3 lessonsai-for-engineersai-for-data-analystsprompt-engineeringai-evalsworkflowsquickintermediate
- Module 4Measuring What Matters: Evaluation Metricsin Evaluating LLM Output Quality · 4 lessonsai-for-engineersai-for-product-managersai-for-data-analystsprompt-engineeringai-evalsquickintermediate
- Module 5Putting It Together: A Production-Ready Evaluation Pipelinein Evaluating LLM Output Quality · 3 lessonsai-for-engineersai-for-product-managersai-for-data-analystsprompt-engineeringai-evalsworkflowsquickadvanced
- Module 2LLM Evaluation (Evals): Building Rigorous Testing Pipelinesin LLM Guardrails, Evals and Agentic Memory · 4 lessonsai-for-engineersai-for-data-analystscontext-ragai-evalsquickintermediate
- Module 1Start Herein LLM-as-Judge Lab: Calibration and Drift · 1 lessonai-for-data-analystsai-evalsworkshopadvanced
- Module 2Designing and Implementing an LLM Judgein LLM-as-Judge Lab: Calibration and Drift · 4 lessonsai-for-data-analystsai-evalsworkshopadvanced
- Module 3Calibrating the Judge Against Human Ratersin LLM-as-Judge Lab: Calibration and Drift · 3 lessonsai-for-data-analystsai-evalsworkshopadvanced
- Module 4Monitoring Drift and Comparing Judgesin LLM-as-Judge Lab: Calibration and Drift · 6 lessonsai-for-data-analystsai-evalsworkshopadvanced