Multimodale Prompts verbinden Text, Bild und weitere Eingabeformen. Über die Gemini-API lassen sich solche Prompts in eigenen Anwendungen einsetzen.
!Kursinhalt
!1. Grundlagen multimodaler Prompts
*Kombination von Text und Bild
*typische Anwendungsfälle
*Grenzen aktueller Modelle
!2. Einsatz der Gemini-API
*Zugang und Authentifizierung
*Aufbau von Anfragen
*Umgang mit Ergebnissen
!3. Projektgestaltung
*Auswahl passender Use Cases
*Zusammenspiel mit weiteren Komponenten
*Qualitäts- und Kostenaspekte
!4. Steuerung im Projekt
*Rollen und Verantwortlichkeiten
*Testen und Iterieren
*Dokumentation
!Berufliche Relevanz
*multimodale Prompts erweitern klassische KI-Anwendungen deutlich
*die Gemini-API bringt diese Möglichkeiten in eigene Systeme
*strukturierte Projektführung verhindert Überdehnung der Fähigkeiten