Secure AI: Red-Teaming & Safety Filters
Completed by Daniela Giannini
February 24, 2026
3 hours (approximately)
Daniela Giannini's account is verified. Coursera certifies their successful completion of Secure AI: Red-Teaming & Safety Filters
What you will learn
Design red-teaming scenarios to identify vulnerabilities and attack vectors in large language models using structured adversarial testing.
Implement content-safety filters to detect and mitigate harmful outputs while maintaining model performance and user experience.
Evaluate and enhance LLM resilience by analyzing adversarial inputs and developing defense strategies to strengthen overall AI system security.
Skills you will gain
- Category: AI Security
- Category: Responsible AI
- Category: Security Strategy
- Category: Large Language Modeling
- Category: Security Testing
- Category: Cyber Security Assessment
- Category: AI Personalization
- Category: Security Controls
- Category: Prompt Engineering
- Category: LLM Application
- Category: Continuous Monitoring
- Category: Threat Modeling

