#17 Multimodale KI: Wenn der Chatbot auch Bilder und Tabellen liest
Artikel konnten nicht hinzugefügt werden
Leider können wir den Artikel nicht hinzufügen, da Ihr Warenkorb bereits seine Kapazität erreicht hat.
Der Titel konnte nicht zum Warenkorb hinzugefügt werden.
Bitte versuchen Sie es später noch einmal
Der Titel konnte nicht zum Merkzettel hinzugefügt werden.
Bitte versuchen Sie es später noch einmal
„Von Wunschzettel entfernen“ fehlgeschlagen.
Bitte versuchen Sie es später noch einmal
„Podcast folgen“ fehlgeschlagen
„Podcast nicht mehr folgen“ fehlgeschlagen
-
Gesprochen von:
-
Von:
Über diesen Titel
In dieser Folge sprechen wir mit Richard Zimmermann, der sich in seiner Bachelorarbeit genau dieser Herausforderung gestellt hat. Er erklärt, wie man mit dem Ansatz der "Retrieval-Augmented Generation" (RAG) einem Sprachmodell beibringt, auch multimodale Daten zu verstehen und zu nutzen.
Wir tauchen tief in die Technik ein und klären, warum es nicht nur darum geht, der KI Daten zu geben, sondern auch darum, ihr die richtigen Informationen in der richtigen Menge zu präsentieren, um das "Lost in the Middle"-Problem zu vermeiden.
Noch keine Rezensionen vorhanden
