Wat is Multimodaal?
Multimodaal betekent dat een AI met meerdere soorten invoer overweg kan: niet alleen tekst, maar ook beeld, geluid of video.
Een puur tekstmodel snapt alleen tekst. Een multimodaal model kan ook een foto bekijken, een grafiek lezen of luisteren naar geluid. Je kunt bijvoorbeeld een foto van een formulier uploaden en vragen wat erop staat. De nieuwste tools zijn vaak multimodaal.
Het maakt AI bruikbaarder in de praktijk: je hoeft niet alles uit te typen, maar kunt ook een afbeelding of opname laten bekijken.
Precies gezegd
Kunnen kijken is niet hetzelfde als goed kijken. Bij een tabel of handschrift op een foto gaat het regelmatig mis.
Veelgemaakte misvatting
Dat het model een afbeelding begrijpt zoals jij. Het herkent patronen in beeld.
Verwante woorden
Leer AI rustig begrijpen
Dit woord is een begin. De leerlijn van inklaretaal legt AI stap voor stap uit in klare taal, afgestemd op jouw vak. De eerste maand is gratis.