#17 Multimodale KI: Wenn der Chatbot auch Bilder und Tabellen liest
Impossibile aggiungere al carrello
Puoi avere soltanto 50 titoli nel carrello per il checkout.
Riprova più tardi
Riprova più tardi
Rimozione dalla Lista desideri non riuscita.
Riprova più tardi
Non è stato possibile aggiungere il titolo alla Libreria
Per favore riprova
Non è stato possibile seguire il Podcast
Per favore riprova
Esecuzione del comando Non seguire più non riuscita
-
Letto da:
-
Di:
A proposito di questo titolo
In dieser Folge sprechen wir mit Richard Zimmermann, der sich in seiner Bachelorarbeit genau dieser Herausforderung gestellt hat. Er erklärt, wie man mit dem Ansatz der "Retrieval-Augmented Generation" (RAG) einem Sprachmodell beibringt, auch multimodale Daten zu verstehen und zu nutzen.
Wir tauchen tief in die Technik ein und klären, warum es nicht nur darum geht, der KI Daten zu geben, sondern auch darum, ihr die richtigen Informationen in der richtigen Menge zu präsentieren, um das "Lost in the Middle"-Problem zu vermeiden.
Ancora nessuna recensione