Naar inhoud
Inloggen

/glossary

Termen, helder uitgelegd.

Een werkend glossarium van audio-, AI-, DSP-, toegankelijkheids- en live-audiotermen die in alle labs worden gebruikt. Wordt bijgewerkt zodra een doc een nieuwe term naar boven brengt die er een nodig heeft.

01 76 termen
AAudio
Engineering
De native low-latency audio-API van Android, geïntroduceerd in Android 8.0 en flink volwassen geworden in 12 en later. De aanbevolen route voor realtime audio op moderne Android.
ABX test
SkillLab
Een dubbelblinde luistertest: de proefpersoon krijgt referentie A, referentie B en de onbekende X, en moet vaststellen of X = A of X = B. De gouden standaard om te bewijzen dat er een hoorbaar verschil bestaat.
AGC
VoiceLab
Automatic Gain Control: adaptieve versterking die signaalniveaus constant houdt zonder ingrijpen van een operator. Standaard in conferentie-apps; in podcastpostproductie met beleid ingezet.
Aliasing
Engineering
De valse laagfrequente artefacten die ontstaan wanneer een signaal frequenties bevat boven de helft van de sample rate (de Nyquist-frequentie). Voorkomen door anti-aliasingfilters vóór het samplen en door oversampling in niet-lineaire DSP.
ASHA
HearLab
Audio Streaming for Hearing Aids: het Bluetooth-profiel dat Android gebruikt om low-latency audio rechtstreeks naar compatibele hoortoestellen te streamen.
ASR
VoiceLab
Automatic Speech Recognition: de spraak-naar-tekstlaag. Whisper, Deepgram, AWS Transcribe, Google STT. In 2026 grotendeels een commodity, met een nauwkeurigheid ver in de 90% op schoon materiaal.
Audiogram
HearLab
Een grafiek van de gehoordrempel (dB HL) tegen de frequentie (Hz), per oor. De standaard diagnostische uitkomst van een audiologisch onderzoek. Bepaalt de afstelling van elk modern hoortoestel.
AudioWorklet
MixLab
De browser-API om audioverwerkingscode op een eigen thread te draaien, los van de main thread. De basis voor elke serieuze WebAudio-analyse of -synthese.
Auracast
HearLab
De broadcastmodus van Bluetooth LE Audio. Eén bron streamt audio waarop elk compatibel apparaat in de buurt (inclusief hoortoestellen) kan afstemmen zonder te koppelen. De basis voor luisterhulpsystemen van de volgende generatie.
Bit depth
General
Het aantal bits per sample. 16-bit volstaat voor de meeste consumententoepassingen; 24-bit is de productiestandaard; 32-bit float is het werkformaat binnen DAW's en analysetools.
Brickwall limiter
MixLab
Een look-ahead piek-limiter met een absoluut plafond: stel de drempel in en geen enkel sample komt erbovenuit. De laatste fase van vrijwel elke op luidheid genormaliseerde master.
BS.1770-4
MixLab
De ITU-aanbeveling die definieert hoe je luidheid in audio meet. De basis voor LUFS-metering, EBU R128 en de normalisatiedoelen van streamingplatforms.
Buffer size
Engineering
Het aantal audiosamples dat per callback wordt verwerkt. Kleiner = lagere latency maar meer CPU per seconde; groter = hogere latency maar efficiënter. 128 of 256 samples is de moderne realtime sweet spot.
Codec
General
Een coder-decoderpaar dat audio comprimeert en decomprimeert. Lossy: MP3, AAC, Opus, LC3. Lossless: FLAC, ALAC, WAV/PCM (ongecomprimeerd). De codeckeuze bepaalt de ondergrens van wat elke tool verderop kan bereiken.
Crest factor
MixLab
De verhouding tussen het piek- en het RMS-niveau van een signaal, uitgedrukt in dB. Hogere waarden duiden op meer dynamisch bereik. Zie de crest-factor-doc.
Critical listening
SkillLab
Getraind, gericht luisteren naar specifieke audiokenmerken: frequentiebalans, dynamiek, vervorming, stereobreedte. De vaardigheid die SkillLab systematisch traint.
Cue list
CueLab
Een geordende reeks triggers tijdens een show (audio, licht, video, scènes). De datastructuur onder elke productietool voor live-evenementen. Zie de cuelist-schemadoc van CueLab.
De-esser
VoiceLab
Een frequentieselectieve compressor die de sisklankband van 5–9 kHz aanpakt. Vermindert scherpe "s"- en "t"-klanken in stemopnames zonder de hele hoge tonen dof te maken.
Diarisation
SignalLab
Het segmenteren van spreekbeurten: vaststellen wie wanneer sprak in een audiobestand. Een kernfunctie van de SignalLab-indexer.
Dither
MixLab
Ruis op laag niveau die vóór het verlagen van de bit depth wordt toegevoegd om de kwantisatiefout te randomiseren. Nodig bij het omzetten van 24/32-bit naar 16-bit voor distributie.
Ducking
VoiceLab
Het verlagen van het niveau van het ene signaal zodra een signaal met hogere prioriteit aanwezig is. Het klassieke voorbeeld: muziek die onder de stem in een podcast of radioshow wegduikt.
Dynamic EQ
MixLab
Een EQ-band waarvan de versterking reageert op het niveau. In wezen een enkelbandscompressor met een parametrische frequentieregeling. Minder destructief dan multiband voor chirurgisch precieze klankbalans.
Embedding
SignalLab
Een aangeleerde, dichte vectorweergave van audio (of een stuk audio). De kern van moderne audio-retrieval, gelijkeniszoeken en zero-shot-classificatie. De signaalindexering van AudioLab gebruikt onder de motorkap embeddings.
FFT
MixLab
Fast Fourier Transform: het algoritme dat de kern vormt van elke bewerking in het frequentiedomein in audiosoftware, van spectrumanalysers tot convolutiereverbs.
Formant
VoiceLab
Een resonante frequentieband in het menselijke stemkanaal. Formantpatronen onderscheiden klinkers en verraden de identiteit van een spreker. Toonhoogtecorrectietools behouden of verschuiven ze bewust.
Hann window
MixLab
Een veelgebruikte vensterfunctie die vóór de FFT wordt toegepast om spectrale lekkage te beperken. De standaardkeuze voor de meeste analysegerichte audiocode.
Headroom
MixLab
De dB-marge tussen het luidste sample in een mix en 0 dBFS (of true peak). Streamingmasters mikken doorgaans op –1 dBTP / –14 LUFS; broadcastdoelen zijn behoudender. Zie de methodologiepagina voor de standaardwaarden van AudioLab.
HRTF
HearLab
Head-Related Transfer Function: het frequentiedomeinfilter dat beschrijft hoe een geluid uit een bepaalde richting wordt veranderd door het hoofd, de romp en de oorschelp van de luisteraar. De basis voor binaurale ruimtelijke audio.
Inference
SignalLab
Een getraind model draaien om uitvoer te produceren. Te onderscheiden van training. De fase die snel, voorspelbaar en klein genoeg moet zijn om op het apparaat te passen. Het deel van elk audio-AI-product dat de gebruiker te zien krijgt.
Integrated LUFS
MixLab
Een perceptueel gewogen, in de tijd gegate maat voor luidheid over een volledig audiofragment. Het getal dat streamingplatforms gebruiken om de weergave te normaliseren.
JND
SkillLab
Just Noticeable Difference. De kleinste verandering in een prikkel die een luisteraar betrouwbaar kan waarnemen. Bepaalt de kalibratie van elke audioperceptiedrempel in de oefeningen van SkillLab.
JUCE
Engineering
Een cross-platform C++-audioframework. De weg van de minste weerstand om dezelfde DSP-code uit te brengen op Android, iOS, macOS, Windows en als VST/AU/AAX-plug-ins.
K-weighting
MixLab
De keten van voorfilters (high-shelf op ~1,5 kHz + high-pass op ~38 Hz) die in BS.1770-4 is gedefinieerd. Wordt toegepast vóór de RMS-energiesommatie, zodat de resulterende LUFS-waarde de waargenomen luidheid volgt in plaats van de ruwe signaalenergie.
LC3
HearLab
Low Complexity Communication Codec. De standaardcodec voor Bluetooth LE Audio. Aanzienlijk beter dan SBC en bij lagere bitrates concurrerend met AAC.
LE Audio
HearLab
De Bluetooth-audiospecificatie die in 5.2 werd geïntroduceerd, inclusief de LC3-codec en multi-streamprofielen. Een wezenlijke verbetering voor hoortoestellen en zuinige audio.
Lissajous figure
MixLab
Een grafiek van het ene signaal tegen het andere, die een curve oplevert waarvan de vorm hun faserelatie onthult. De klassieke visualisatie achter elke "phase scope" in pro-audio.
LRA (Loudness Range)
MixLab
Een EBU 3342-maat die het verschil uitdrukt tussen de luidste en de zachtste delen van een audiofragment. Anders dan piek-tot-RMS-dynamiek; ligt dichter bij de waargenomen "hoeveel de muziek ademt".
Mel spectrogram
SignalLab
Een spectrogram op de mel-frequentieschaal, met perceptueel gewogen bins die de menselijke toonhoogteperceptie beter benaderen dan lineaire frequentie. De standaard invoerweergave voor neurale netwerken voor audio.
MFCC
SignalLab
Mel-Frequency Cepstral Coefficients. De klassieke compacte weergave van timbrale inhoud: 13-40 coëfficiënten die de spectrale envelope samenvatten. Zelfs in het deep-learningtijdperk nog bruikbaar als features.
Mid/Side
MixLab
Een stereoweergave waarbij Mid = (L+R)/2 (de gecentreerde inhoud) en Side = (L−R)/2 (het stereoverschil). De basis om de werkelijke stereobreedte te meten.
Mix-minus
CueLab
Een feed naar een gast op afstand met de volledige programma-audio behalve diens eigen stem, om de “in-een-tunnel-praten”-feedbackervaring te voorkomen. Standaard bij routing voor broadcast en podcasts op afstand.
Momentary LUFS
MixLab
Een luidheidsmeting met een schuivend venster van 400 ms. De snelle, reactieve maat, bedoeld om kortstondige luide passages op te vangen. Geijkt op hetzelfde K-weighting-filter als integrated LUFS, maar zonder gating.
Multiband compression
MixLab
Het signaal opsplitsen in 2–6 frequentiebanden en elke band afzonderlijk comprimeren. De standaardtool om één problematische band (dreunende lage tonen, schelle hoge midden) te temmen zonder de hele mix dof te maken.
MUSHRA
SignalLab
MUlti Stimulus test with Hidden Reference and Anchor. De standaardmethodologie voor luistertests om de waargenomen audiokwaliteit te beoordelen bij gemiddelde tot hoge kwaliteitsniveaus.
N-1 feed
CueLab
Een andere naam voor mix-minus. Letterlijk: een mix van alle N bronnen min die ene die naar de betreffende bestemming gaat. Native ingebouwd in degelijke broadcastmengtafels; in software nagebootst met routingmatrices.
Neural vocoder
VoiceLab
Een model dat een tussenliggende audioweergave (meestal een mel-spectrogram) omzet in een golfvorm. WaveNet, HiFi-GAN, BigVGAN. De “laatste loodjes” van elke moderne TTS-pijplijn.
Nyquist frequency
Engineering
De helft van de sample rate: de theoretische bovengrens van de frequenties die in een digitaal signaal kunnen worden weergegeven. 22,05 kHz bij 44,1 kHz; 24 kHz bij 48 kHz. De reden waarom masteringketens vaak op 96 kHz of hoger werken.
Oboe
Engineering
De C++-wrapper van Google rond AAudio (met OpenSL ES als terugval voor oudere apparaten). Het aanbevolen startpunt voor Android-audiocode in 2026.
OfflineAudioContext
MixLab
De WebAudio API-variant voor offline audioverwerking sneller dan realtime. De juiste keuze voor batchanalyse en rendering. Drijft de sample-synthesepijplijn van AudioLab aan.
Onset detection
SignalLab
De begintijden van muzikale gebeurtenissen bepalen: drumslagen, het aanzetten van noten, percussieve transiënten. De basis voor beat tracking, tempo-inschatting en audioanalyse op segmentniveau.
Pearson correlation
MixLab
De statistische maat voor de lineaire correlatie tussen twee signalen, met een waarde van −1 tot +1. Wordt in MixLab gebruikt om de stereocorrelatie tussen het L- en R-kanaal te berekenen.
Phantom power
VoiceLab
+48 V gelijkspanning die via dezelfde XLR-kabel als de audio naar condensatormicrofoons wordt gestuurd. Nodig om het microfooncapsule te laten werken; geleverd door audio-interfaces en mengpanelen.
Phase / polarity
Engineering
Polariteit is binair (signaal omgekeerd of niet). Fase is continu en frequentieafhankelijk. De twee door elkaar halen is de meest voorkomende vocabulairefout in audio-engineering, en de oorzaak van menig kamfilter-mysterie.
Phoneme
VoiceLab
De kleinste eenheid van spraakklank die in een bepaalde taal het ene woord van het andere onderscheidt. Het Engels heeft er ruwweg 44; uitlijning op foneemniveau vormt de basis van elk modern TTS- en ASR-systeem.
Plosive
VoiceLab
Een laagfrequente uitbarsting van "p"- en "b"-medeklinkers die de microfoon raken. Bij opname getemperd met popfilters, en in de postproductie met een hoogdoorlaatfilter of transient-editing.
Pre-show checklist
CueLab
De herbruikbare set controles vóór een uitzending of evenement die vermijdbare fouten onderschept. Hardware-routing-niveaus-stream-back-up, in die volgorde. Zie de pre-showchecklistdoc.
Prosody
VoiceLab
Het ritme, de klemtoon en de intonatie van spraak. Het moeilijkste wat synthetische stemmen goed moeten krijgen, en de meest voorkomende verrader wanneer het misgaat. Bepaalt de verstaanbaarheid en de waargenomen emotie.
Round-trip latency
Engineering
De totale tijd van het opnemen van geluid tot de geluidsuitvoer, door een verwerkingsketen heen. Hét getal voor elke realtime audio-app: onder de 15 ms is de drempel om mee te luisteren tijdens het opnemen.
RT60
VoiceLab
De nagalmtijd die een impuls nodig heeft om 60 dB weg te sterven. De standaardmaat voor ruimteakoestiek. Praktische voice-QA-tools schatten hem impliciet via analyse van het uitsterven van de envelope.
Sample rate
General
Het aantal samples per seconde. 44,1 kHz voor cd; 48 kHz voor broadcast en de meeste moderne producties; 96 kHz / 192 kHz voor hoge-resolutiemastering.
Short-term LUFS
MixLab
Een luidheidsmeting met een schuivend venster van 3 seconden. De tussenlaag tussen momentary (400 ms) en integrated (het hele programma). Voedt de “LRA”-bereikberekening in EBU 3342.
Sibilance
VoiceLab
Hoogfrequente medeklinkerenergie van "s"-, "sj"-, "t"- en "z"-klanken. Geconcentreerd rond 5–9 kHz. Bij overaccentuering een veelvoorkomende bron van luistermoeheid.
Sidechain
MixLab
Een extern stuursignaal dat een dynamiekprocessor (meestal een compressor) aanstuurt. De techniek achter pompende kickdrum-mixes, muziekbedden die onder de stem wegduiken en moderne de-essing.
SNR
General
Signal-to-Noise Ratio. De dB-marge tussen het gewenste signaal en de achtergrondruis. Het ene getal dat verstaanbaarheid, opnamekwaliteit en de prestaties van ML-modellen beter voorspelt dan welk ander getal ook.
Source separation
SignalLab
Een gemixt audiosignaal weer opsplitsen in afzonderlijke stems (zang, drums, bas, overig). Demucs, Spleeter, Open-Unmix. De state of the art levert in 2026 een schone isolatie op bij de meeste popmuziek.
Speaker verification
VoiceLab
Een geclaimde sprekersidentiteit bevestigen aan de hand van een stemmonster. De defensieve tegenhanger van voice cloning. Moderne systemen gebruiken d-vector- of x-vector-embeddings die via cosinusgelijkenis worden vergeleken.
Spectral centroid
MixLab
Het "zwaartepunt" van het spectrum, een gewogen gemiddelde frequentie die ruwweg overeenkomt met de waargenomen helderheid.
Speech-in-noise
HearLab
Een categorie maten en tests (SIN, QuickSIN, HINT) die de spraakverstaanbaarheid meten tegen wisselende ruisvloeren. De voorspeller in de praktijk van het nut van een hoortoestel, meer nog dan zuivere-toonaudiometrie.
Streaks
SkillLab
Markeringen voor oefenregelmaat die in SkillLab worden gebruikt. Ontworpen om een gemiste dag te overleven, zodat je niet in gokkast-achtige voortgangsdynamiek belandt. Zie progressie-ontwerp.
Tag schema
SignalLab
De gecontroleerde woordenlijst om audio-inhoud te beschrijven voor latere terugvinding. Het schema van SignalLab dekt het inhoudstype, helderheid, dynamiek en probleemmarkeringen. Zie de tag-schemadoc.
True peak
MixLab
De werkelijke analoge piek van een gereconstrueerd signaal, die door inter-sample peaks hoger kan uitvallen dan de piek in het sampledomein. Wordt gemeten via oversampling.
TTS (Text-to-Speech)
VoiceLab
Spraakaudio genereren uit tekst. De state of the art in 2026 is neuraal: meestal een pijplijn van een tekst-encoder + akoestisch model + vocoder, vaak gedistilleerd tot één enkel model voor realtime-inferentie.
VAD (Voice Activity Detection)
VoiceLab
Een classificator die frame voor frame een 1 voor spraak en een 0 voor niet-spraak teruggeeft. De eerste fase van vrijwel elke stempijplijn, van conferentie-apps tot podcasteditors tot de VoiceLab QA-demo.
Voice cloning
VoiceLab
Spraak synthetiseren in de stem van een doelspreker op basis van een referentieopname. Moderne modellen volstaan met 3-30 seconden referentieaudio. De basis voor zowel legitieme nasynchronisatie- en toegankelijkheidstools als moderne imitatieaanvallen.
WDRC
HearLab
Wide Dynamic Range Compression: de multiband, niveau-afhankelijke versterkingsverwerking in elk modern hoortoestel. Beeldt het dynamisch bereik van de spreker af op het resterende gehoorbereik van de gebruiker.
WebAudio API
MixLab
De W3C-standaard voor audioverwerking in browsers. Omvat AudioContext, AudioNode, AudioBuffer, AnalyserNode, AudioWorklet en OfflineAudioContext. Het fundament onder elke audiotool die in de browser draait.