Edureka

Multimodal Agents with Vision Language Models

Zum Labor Day gibt es bei Coursera Plus Rabatte von über 70 $. Sparen Sie 3 Monate lang 40 %.

kurs ist nicht verfügbar in Deutsch (Deutschland)

Wir übersetzen es in weitere Sprachen.
Edureka

Multimodal Agents with Vision Language Models

Edureka

Dozent: Edureka

Bei Coursera PlusMehr erfahren enthalten

Verschaffen Sie sich einen Einblick in ein Thema und lernen Sie die Grundlagen.
Stufe Mittel

Empfohlene Erfahrung

6 Stunden zu vervollständigen
Flexibler Zeitplan
In Ihrem eigenen Lerntempo lernen
Verschaffen Sie sich einen Einblick in ein Thema und lernen Sie die Grundlagen.
Stufe Mittel

Empfohlene Erfahrung

6 Stunden zu vervollständigen
Flexibler Zeitplan
In Ihrem eigenen Lerntempo lernen

Was Sie lernen werden

  • Explain how vision-language models align image and text representations.

  • Build multimodal search and RAG over documents containing charts and tables.

  • Apply planner, executor, and critic patterns to decompose complex tasks.

  • Coordinate multiple agents through defined roles, handoffs, and shared context.

Wichtige Details

Zertifikat zur Vorlage

Zu Ihrem LinkedIn-Profil hinzufügen

Kürzlich aktualisiert!

September 2026

Bewertungen

6 Aufgaben

Unterrichtet in Englisch

Erfahren Sie, wie Mitarbeiter führender Unternehmen gefragte Kompetenzen erwerben.

 Logos von Petrobras, TATA, Danone, Capgemini, P&G und L'Oreal

In diesem Kurs gibt es 3 Module

This module introduces vision-language models, embeddings, and retrieval techniques used to connect visual and textual information. Learners explore multimodal RAG workflows and build systems that retrieve relevant content from images and documents to support more grounded responses.

Das ist alles enthalten

11 Videos2 Lektüren2 Aufgaben

This module focuses on how multimodal agents are structured and how they interact with external tools to complete tasks. Learners explore agent design patterns, reliable tool schemas, and tool-calling workflows to build agents for tasks such as web summarisation and image generation.

Das ist alles enthalten

6 Videos2 Lektüren2 Aufgaben

This module focuses on how multiple specialised agents communicate, coordinate, and share responsibilities within a common workflow. Learners explore handoff patterns, context and memory management, and collaborative agent designs to build multimodal multi-agent systems.

Das ist alles enthalten

6 Videos3 Lektüren2 Aufgaben

Dozent

Edureka
Edureka
241 Kurse218.912 Lernende

von

Edureka

Mehr von Machine Learning entdecken

Warum entscheiden sich Menschen für Coursera für ihre Karriere?

Felipe M.

Lernender seit 2018
„Es ist eine großartige Erfahrung, in meinem eigenen Tempo zu lernen. Ich kann lernen, wenn ich Zeit und Nerven dazu habe.“

Jennifer J.

Lernender seit 2020
„Bei einem spannenden neuen Projekt konnte ich die neuen Kenntnisse und Kompetenzen aus den Kursen direkt bei der Arbeit anwenden.“

Larry W.

Lernender seit 2021
„Wenn mir Kurse zu Themen fehlen, die meine Universität nicht anbietet, ist Coursera mit die beste Alternative.“

Chaitanya A.

„Man lernt nicht nur, um bei der Arbeit besser zu werden. Es geht noch um viel mehr. Bei Coursera kann ich ohne Grenzen lernen.“

Häufig gestellte Fragen