К содержимому
learnspaceYOUR NEXT CHAPTER
ПРОСТРАНСТВО ОБУЧЕНИЯ
ГлавнаяКаталог курсовМоё обучениеCoursera

Знания без границ

Учитесь у лучших университетов и компаний мира.

Открыть Coursera
Интеграция
Пространство университета
Моё пространствоСтраница курса
↵
ЯЛичный кабинетСтудент
© 2026 LearnSpaceКаждый день — возможность узнать больше.Помощь
Gen AI Dev- Implement Evaluation Systems for Generative AI · LearnSpace
Назад в каталог
courseraАнализ данных

Gen AI Dev- Implement Evaluation Systems for Generative AI

Курс от Amazon Web Services
Продвинутый≈ 1.2 чАнглийский
О курсеНавыкиПрограммаПреподаватели

О курсе

Welcome to the fifth part of this learning plan centered around the role and responsibilities of a generative AI professional developer.In this part, you will learn critical skills for ensuring reliable generative AI outputs. You'll learn to build evaluation frameworks measuring relevance and accuracy, implement testing methodologies like A/B testing and multi-model comparison, and develop user-centered quality assurance processes. The curriculum covers troubleshooting techniques for AI-specific

Навыки, которые вы освоите

Performance MeasurementDevelopment TestingArtificial Intelligence and Machine Learning (AI/ML)Generative AI AgentsMachine LearningCloud ComputingNatural Language ProcessingPrompt EngineeringVerification And ValidationGenerative AIQuality AssuranceModel DeploymentMLOps (Machine Learning Operations)Software DevelopmentAmazon Web ServicesSystem MonitoringSoftware Quality AssuranceUser Acceptance Testing (UAT)Artificial IntelligenceLarge Language Modeling

Программа курса

5 модулей · 57 учебных материалов

01Introduction6 материалов

Part 5 Introduction

IntroductionЧтение

Course Introduction

IntroductionЧтениеEvaluation frameworksЧтениеTraditional and advanced evaluation metricsЧтение

Учитесь у экспертов

AWS Instructor

Преподаватель курса

Gen AI Dev- Implement Evaluation Systems for Generative AI
В каталоге вашей программы

Инвестируйте в себя

Новые знания — в удобное для вас время.

Начать на Coursera

Обучение откроется на Coursera
в новой вкладке

Обучение на Coursera

≈ 1.2 ч

5 модулей

Язык: Английский

Часть программы вашего университета
Building comprehensive assessment frameworksЧтение
Key topicsЧтение
02Generative AI model evaluation techniques16 материалов

Developing assessment frameworks

IntroductionЧтениеKey metrics for generative AI evaluationЧтениеDeveloping a framework based on a business use caseЧтение

Developing assessment systems

IntroductionЧтениеAssessment systems for generative AIЧтениеRAG evaluation componentsЧтениеImplementing RAG evaluationЧтениеLLM-as-a-Judge implementationЧтениеImplementation best practicesЧтение

Developing systematic model evaluation strategies

IntroductionЧтениеAmazon Bedrock model evaluationsЧтениеA/B testing strategiesЧтениеMulti-model evaluationЧтениеAmazon Nova model family evaluationЧтениеCost-performance analysisЧтениеImplementation best practices
03Quality assurance and continuous improvement15 материалов

Developing systematic quality assurance processes

IntroductionЧтениеQuality assurance for generative AIЧтениеContinuous evaluation workflowsЧтениеRegression testing for model outputsЧтениеAutomated quality gates for deploymentЧтениеAI-specific output validationЧтениеAgent-specific quality validationЧтениеImplementation best practicesЧтение

Evaluating and optimizing information retrieval components

IntroductionЧтениеRetrieval quality fundamentalsЧтениеRelevance scoring techniquesЧтениеContext matching verificationЧтениеMeasuring and optimizing retrieval latencyЧтениеMonitoring and continuous improvement for retrieval systemsЧтение
04Performance monitoring, reporting, and deployment validation15 материалов

Developing agent performance frameworks

IntroductionЧтениеAgent performance fundamentalsЧтениеMeasuring task completion ratesЧтениеMulti-step workflow assessment for agent performanceЧтениеTool usage effectiveness evaluationЧтениеStrands Agents evaluation frameworkЧтениеAmazon Bedrock AgentCore evaluationsЧтениеBest practices for agent performance monitoringЧтениеUse case-specific performance frameworksЧтение

Developing reporting systems for stakeholders

IntroductionЧтениеReporting systems fundamentalsЧтениеVisualization tools and dashboard developmentЧтениеAutomated reporting mechanismsЧтениеModel comparison visualizationsЧтениеStakeholder-specific reporting frameworksЧтение
05Conclusion5 материалов

Summary

Graded AssessmentЗаданиеRecap and next stepsЧтениеResourcesЧтениеSurveyЧтение

Contact Us

We want to hear from youЧтение
Чтение
Use-case specific optimization strategiesЧтение