Multimodale Prompts verbinden Text, Bild und weitere Eingabeformen. Über die Gemini-API lassen sich solche Prompts in eigenen Anwendungen einsetzen.

!Kursinhalt

!1. Grundlagen multimodaler Prompts
*Kombination von Text und Bild
*typische Anwendungsfälle
*Grenzen aktueller Modelle

!2. Einsatz der Gemini-API
*Zugang und Authentifizierung
*Aufbau von Anfragen
*Umgang mit Ergebnissen

!3. Projektgestaltung
*Auswahl passender Use Cases
*Zusammenspiel mit weiteren Komponenten
*Qualitäts- und Kostenaspekte

!4. Steuerung im Projekt
*Rollen und Verantwortlichkeiten
*Testen und Iterieren
*Dokumentation

!Berufliche Relevanz

*multimodale Prompts erweitern klassische KI-Anwendungen deutlich
*die Gemini-API bringt diese Möglichkeiten in eigene Systeme
*strukturierte Projektführung verhindert Überdehnung der Fähigkeiten