Neem contact met ons op
 Duur 14 uren

Cursusaanbod

Overzicht van spraakherkenningstechnologieën

  • Geschiedenis en ontwikkeling van spraakherkenning
  • Akoestische modellen, taalmodellen en decodering
  • Moderne architecturen: RNN's, transformers en Whisper

Audiovoorverwerking en basisprincipes van transcriptie

  • Omgaan met audiobestandsformaten en samplefrequenties
  • Reinigen, knippen en segmenteren van audio
  • Tekst genereren uit audio: real-time versus batchverwerking

Hands-on met Whisper en andere API's

  • Installeren en gebruikmaken van OpenAI Whisper
  • Cloud-API's (Google, Azure) aanroepen voor transcriptie
  • Vergelijking van prestaties, latentie en kosten

Taal, accenten en domeinaanpassing

  • Werken met meerdere talen en accenten
  • Aangepaste woordenlijsten en ruisbestendigheid
  • Omgaan met juridische, medische of technische terminologie

Outputformatering en integratie

  • Toevoegen van tijdstempels, leestekens en sprekerlabels
  • Exporteren naar tekst, SRT of JSON-formaten
  • Transcripties integreren in applicaties of databases

Implementatielabs voor use cases

  • Transcriptie van vergaderingen, interviews of podcasts
  • Stem-naar-tekstcommandosystemen
  • Real-time ondertiteling voor video/audio-streams

Evaluatie, beperkingen en ethiek

  • Nauwkeurigheidsmetingen en modellenchmarking
  • Bias en eerlijkheid in spraakmodellen
  • Overwegingen rond privacy en compliance

Samenvatting en volgende stappen

Vereisten

  • Begrip van algemene AI- en machinelearningconcepten
  • Kennis van audio- of mediabestandsformaten en -tools

Publiek

  • Datawetenschappers en AI-engineers die werken met stemdata
  • Softwareontwikkelaars die applicaties op basis van transcriptie bouwen
  • Organisaties die spraakherkenning verkennen voor automatisering

Aantal deelnemers


Prijs per deelnemer

Voorlopige Aankomende Cursussen

Gerelateerde categorieën