Secure AI: Red-Teaming & Safety Filters
Completed by Daniela Giannini
February 24, 2026
3 hours (approximately)
Daniela Giannini's account is verified. Coursera certifies their successful completion of Secure AI: Red-Teaming & Safety Filters
What you will learn
Design red-teaming scenarios to identify vulnerabilities and attack vectors in large language models using structured adversarial testing.
Implement content-safety filters to detect and mitigate harmful outputs while maintaining model performance and user experience.
Evaluate and enhance LLM resilience by analyzing adversarial inputs and developing defense strategies to strengthen overall AI system security.
Skills you will gain
- Category: AI Personalization
- Category: Continuous Monitoring
- Category: Cyber Security Assessment
- Category: System Implementation
- Category: AI Security
- Category: Security Testing
- Category: Vulnerability Assessments
- Category: Large Language Modeling
- Category: Security Strategy
- Category: Threat Modeling
- Category: Vulnerability Scanning
- Category: Exploitation techniques

