Samenvatting
Tip
Zie het tabblad Tekst en afbeeldingen voor meer informatie.
In deze module hebben we modellen verkend die geschikt zijn voor visie in Microsoft Foundry en hoe we ze kunnen gebruiken om afbeeldingen te analyseren en originele afbeeldingen en video's te genereren.
De module behandelde multimodale modellen, die ondersteuning bieden voor afbeeldingsanalyse. We hebben ook modellen voor het genereren van afbeeldingen besproken, zoals modellen in de GPT-Image familie, voor het maken en bewerken van afbeeldingen van prompts met behulp van Foundry-hulpprogramma's en API's. Ten slotte hebben we videogeneratie geïntroduceerd met Sora-modellen, waarmee tekst-naar-video- en beeld-naar-video-creatie mogelijk is via interactieve speeltuinen en programmatische, asynchrone REST-werkstromen.
Over het algemeen helpen visuele AI-modellen in Microsoft Foundry de kloof tussen visuele gegevens en op taal gebaseerde AI te overbruggen. Ze maken scenario's mogelijk, zoals document- en afbeeldingsanalyse, visuele assistenten, hulpprogramma's voor toegankelijkheid en multimodale AI-agents, waarmee beeldbegrip een natuurlijke uitbreiding van moderne AI-toepassingen wordt.
Raadpleeg de volgende koppelingen voor meer informatie:
- Probeer een snelstartgids voor een afbeeldingsanalyse uit de documentatie.
- Meer informatie over chatmodellen met vision-functionaliteit.
- Meer informatie over Azure OpenAI-modellen voor het genereren van afbeeldingen.
- Meer informatie over het genereren van video's met Sora.