AI Technology
Multimodaal
Multimodaal betekent dat een AI-model verschillende soorten input of output kan verwerken, zoals tekst, beelden, audio of documenten. Daardoor kan één AI-assistent bijvoorbeeld een pdf lezen, een afbeelding analyseren en tegelijk een tekstueel antwoord geven.
MULTI · Ook bekend als: multimodale AI, multimodal
Verder dan tekst alleen
Multimodale AI-modellen verwerken niet alleen tekst, maar ook afbeeldingen, audio, video en documenten in één aanvraag. Je kunt een foto van een factuur uploaden en vragen om de totaalbedragen eruit te halen, een screenshot van een spreadsheet insturen en om analyse vragen, of een technisch schema laten uitlezen en omzetten naar een stap-voor-stap handleiding.
Praktische toepassingen voor KMO's
Multimodaliteit opent workflows die vroeger menselijke verwerking vereisten. Een logistiek bedrijf kan foto's van beschadigde goederen automatisch laten beoordelen. Een retailer kan productfoto's laten analyseren op zichtbare gebreken. Een bouwbedrijf kan bouwtekeningen insturen en laten samenvatten in begrijpelijk Nederlands voor de klant.
Modellen met multimodale capaciteiten
GPT-4o, Claude Sonnet en Gemini 1.5 zijn vandaag de meest capabele multimodale modellen voor zakelijk gebruik.
Wat betekent Multimodaal?
Multimodaal betekent dat een AI-model verschillende soorten input of output kan verwerken, zoals tekst, beelden, audio of documenten. Daardoor kan één AI-assistent bijvoorbeeld een pdf lezen, een afbeelding analyseren en tegelijk een tekstueel antwoord geven.