Neem contact met ons op

Cursusaanbod

Inleiding tot de multimodale mogelijkheden van Gemini 3

  • Wat betreft verwerking van tekst, afbeeldingen, audio en video
  • Het kiezen van het juiste model en overzicht van de beschikbare eindpunten
  • Kernconcepten rond multimodale redenering

Werken met tekst en gestructureerde invoer

  • Strategieën voor het opstellen van prompts bij tekstgeneratie
  • Metadata, contextvensters en embeddings
  • Orkestratie van multimodale taken via tekstinvoer

Begrip van beelden en visuele workflows

  • Analyse en interpretatie van afbeeldingen met Gemini 3
  • Het ontwikkelen van hulpmiddelen voor visuele zoekopdrachten en taggen
  • Het maken van interacties tussen afbeeldingen en tekst, en vice versa

Verwerking van audio-invoer

  • Workflows voor spraakherkenning en -transcriptie
  • Detectie en interpretatie van auditieve gebeurtenissen
  • Integreren van audio-invoer met tekst- en beeldinformatie

Video-intelligentie en analyse van scènes

  • Frame-per-frame-analyse en continue redenering over video
  • Het maken van hulpmiddelen voor samenvattingen en het extraheren van belangrijke momenten uit video's
  • Automatisering en verwerking van content op basis van video-informatie

Ontwerp van multimodale applicatie-architecturen

  • Het combineren van verschillende invoertypen binnen één pipeline
  • Overwegingen met betrekking tot latentie, kosten en rekenkracht
  • Best practices voor het ontwikkelen van schaalbare multimodale systemen

Prototype maken van multimodale toepassingen

  • Zelf hands-on aan de slag met het creëren van multimodale prototypes
  • Snel experimenteren met verschillende prompts om iteraties te bewerkstelligen
  • Testen en verfijnen van gebruikerservaringen en interactieve flows

Implementatie van multimodale oplossingen

  • Strategieën voor implementatie en het opzetten van de gewenste omgevingen
  • Bewaking van prestaties in een echte werkomgeving
  • Overwegingen betreffende beveiliging en naleving van regelgeving

Samenvatting en volgende stappen

Vereisten

  • Begrip van moderne AI-concepten
  • Ervaring met Python of JavaScript
  • Kennis van REST-API’s

Doelgroep

  • Ontwerpers
  • Contentcreators
  • Technische productteams
 14 Uren

Aantal deelnemers


Prijs per deelnemer

Getuigenissen (1)

Voorlopige Aankomende Cursussen

Gerelateerde categorieën