All courses
33 published courses. Narrow by subject, role, level or format, or search by the outcome you are after.
Filter3
Filter courses
DoneSubject1
For your role
Competency1
Format
Several filters in one group widen the results; filters in different groups narrow them.
Matching courses
intermediateTechnical AI
Building an Eval HarnessFor AI-savvy data analysts moving from ad hoc prompt testing to a real evaluation practice, this course builds a working eval harness end to end: a labeled test dataset, deterministic and LLM-as-judge graders, pass/fail thresholds tied to real stakes, regression detection, and a CI-wired scorecard.
intermediateTechnical AI
Building Your First Production AgentA hands-on course for engineers who already call LLM APIs and want to ship a tool-using agent that survives production: recovering from failed tool calls, capping runaway spend, extending itself with an MCP server, passing task-completion evals, and deploying with logging enabled.
Matching modules
12 modules- Module 3Failure-Resilient Agent Loopsin Building Your First Production Agent · 4 lessonsai-for-engineersagentic-aiai-evalsworkflowsquickintermediate
- Module 6Evaluation for Task Completionin Building Your First Production Agent · 3 lessonsai-for-engineersai-for-data-analystsagentic-aiai-evalsquickintermediate
- Module 1Start Herein Building an Eval Harness · 1 lessonai-for-data-analystsai-evalsstandardintermediate
- Module 2Foundations of Eval Harnessesin Building an Eval Harness · 4 lessonsai-for-data-analystsai-evalsstandardintermediate
- Module 3Building the Test Datasetin Building an Eval Harness · 3 lessonsai-for-data-analystsai-evalsstandardintermediate
- Module 4Writing Graders and Scoring Rubricsin Building an Eval Harness · 4 lessonsai-for-data-analystsai-evalsstandardintermediate
- Module 5Thresholds, Regressions, and Comparisonsin Building an Eval Harness · 4 lessonsai-for-data-analystsai-evalsstandardintermediate
- Module 6Diagnosing Failures and Operationalizing the Harnessin Building an Eval Harness · 6 lessonsai-for-data-analystsai-evalsstandardintermediate
- Module 3Corrective Retries: Recovering from Validation Failuresin Evaluating LLM Output Quality · 3 lessonsai-for-engineersai-for-data-analystsprompt-engineeringai-evalsworkflowsquickintermediate
- Module 4Measuring What Matters: Evaluation Metricsin Evaluating LLM Output Quality · 4 lessonsai-for-engineersai-for-product-managersai-for-data-analystsprompt-engineeringai-evalsquickintermediate
- Module 2LLM Evaluation (Evals): Building Rigorous Testing Pipelinesin LLM Guardrails, Evals and Agentic Memory · 4 lessonsai-for-engineersai-for-data-analystscontext-ragai-evalsquickintermediate
- Module 4Evaluating AI-Generated Personasin Prompt Patterns for Product Discovery · 3 lessonsai-for-product-managersprompt-engineeringai-evalsresponsible-aiquickintermediate