/glossary
Les termes, expliqués simplement.
Un glossaire pratique des termes audio, IA, DSP, accessibilité et audio live employés dans l’ensemble des labs. Mis à jour dès qu’un document fait émerger un nouveau terme qui en a besoin.
01 76 termes
- AAudio Engineering
- L'API audio native à faible latence d'Android, introduite dans Android 8.0 et nettement mûrie à partir de la version 12. La voie recommandée pour l'audio temps réel sur les Android modernes.
- ABX test SkillLab
- Un test d'écoute en double aveugle : on présente à la personne la référence A, la référence B et l'inconnu X, et elle doit déterminer si X = A ou X = B. La référence absolue pour prouver l'existence d'une différence audible.
- AGC VoiceLab
- Automatic Gain Control : une amplification adaptative qui maintient des niveaux de signal constants sans intervention d'un opérateur. Standard dans les applis de visioconférence ; à manier avec prudence en postproduction de podcast.
- Aliasing Engineering
- Les artefacts basse fréquence parasites qui apparaissent lorsqu'un signal contient des fréquences supérieures à la moitié de la sample rate (la fréquence de Nyquist). Évités par des filtres anti-repliement avant l'échantillonnage et par le suréchantillonnage en DSP non linéaire.
- ASHA HearLab
- Audio Streaming for Hearing Aids : le profil Bluetooth qu'Android utilise pour diffuser de l'audio à faible latence directement vers les aides auditives compatibles.
- ASR VoiceLab
- Automatic Speech Recognition : la couche de reconnaissance vocale. Whisper, Deepgram, AWS Transcribe, Google STT. En 2026, largement banalisée, avec une précision dans le haut des 90 % sur du matériel propre.
- Audiogram HearLab
- Un graphique du seuil auditif (dB HL) en fonction de la fréquence (Hz), pour chaque oreille. Le résultat diagnostique standard d'un test audiologique. Il guide le réglage de toute aide auditive moderne.
- AudioWorklet MixLab
- L'API du navigateur permettant d'exécuter du code de traitement audio sur un thread dédié, séparé du thread principal. Le socle de toute analyse ou synthèse WebAudio sérieuse.
- Auracast HearLab
- Le mode broadcast de Bluetooth LE Audio. Une seule source diffuse de l'audio que tout appareil compatible à proximité (y compris les aides auditives) peut capter sans appairage. La base des systèmes d'aide à l'écoute de nouvelle génération.
- Bit depth General
- Le nombre de bits par échantillon. Le 16 bits couvre la plupart des usages grand public ; le 24 bits est le standard de production ; le 32 bits flottant est le format de travail au sein des DAW et des outils d'analyse.
- Brickwall limiter MixLab
- Un limiteur de crête à anticipation (look-ahead) doté d'un plafond absolu : réglez le seuil et aucun échantillon ne le franchit. La dernière étape de presque tous les masters normalisés en niveau sonore.
- BS.1770-4 MixLab
- La recommandation de l'UIT qui définit la manière de mesurer le niveau sonore en audio. Le fondement de la mesure en LUFS, de l'EBU R128 et des cibles de normalisation des plateformes de streaming.
- Buffer size Engineering
- Le nombre d'échantillons audio traités à chaque callback. Plus petit = latence plus faible mais plus de CPU par seconde ; plus grand = latence plus élevée mais plus efficace. 128 ou 256 échantillons, c'est le bon compromis moderne en temps réel.
- Codec General
- Un couple codeur-décodeur qui compresse et décompresse l'audio. Avec perte : MP3, AAC, Opus, LC3. Sans perte : FLAC, ALAC, WAV/PCM (non compressé). Le choix du codec fixe le plancher de ce que tout outil en aval peut atteindre.
- Crest factor MixLab
- Le rapport entre le niveau crête et le niveau RMS d'un signal, exprimé en dB. Plus la valeur est élevée, plus la dynamique est grande. Voir le document sur le facteur de crête.
- Critical listening SkillLab
- Une écoute entraînée et ciblée portant sur des attributs audio précis : équilibre fréquentiel, dynamique, distorsion, largeur stéréo. La compétence que SkillLab travaille de façon systématique.
- Cue list CueLab
- Une séquence ordonnée de déclencheurs pendant un spectacle (audio, lumière, vidéo, scènes). La structure de données sous-jacente de tout outil de production d'événements en direct. Voir le document sur le schéma de cuelist de CueLab.
- De-esser VoiceLab
- Un compresseur sélectif en fréquence qui cible la bande de sibilance de 5–9 kHz. Atténue les « s » et « t » agressifs des enregistrements de voix sans ternir l'ensemble des aigus.
- Diarisation SignalLab
- La segmentation des tours de parole : déterminer qui a parlé et quand dans un fichier audio. Une fonctionnalité centrale de l'indexeur SignalLab.
- Dither MixLab
- Un bruit de faible niveau ajouté avant la réduction de la bit depth pour rendre aléatoire l'erreur de quantification. Nécessaire lors de la conversion du 24/32 bits vers le 16 bits en vue de la distribution.
- Ducking VoiceLab
- Le fait de baisser le niveau d'un signal dès qu'un signal plus prioritaire est présent. L'exemple classique : la musique qui s'efface sous la voix dans un podcast ou une émission de radio.
- Dynamic EQ MixLab
- Une bande d'égalisation dont le gain réagit au niveau. Sur le principe, un compresseur monobande doté d'un réglage de fréquence paramétrique. Moins destructeur que le multibande pour un équilibrage tonal chirurgical.
- Embedding SignalLab
- Une représentation vectorielle dense et apprise d'un signal audio (ou d'un fragment audio). Le cœur de la recherche audio moderne, de la recherche par similarité et de la classification zero-shot. L'indexation de signaux d'AudioLab s'appuie sur des embeddings en coulisses.
- FFT MixLab
- Fast Fourier Transform : l'algorithme au cœur de toute opération dans le domaine fréquentiel des logiciels audio, des analyseurs de spectre aux réverbérations à convolution.
- Formant VoiceLab
- Une bande de fréquences résonante du conduit vocal humain. Les motifs de formants distinguent les voyelles et révèlent l'identité du locuteur. Les outils de correction de hauteur les préservent ou les décalent à dessein.
- Hann window MixLab
- Une fonction de fenêtrage courante appliquée avant la FFT pour réduire les fuites spectrales. Le choix de fenêtrage par défaut pour la plupart des codes audio orientés analyse.
- Headroom MixLab
- La marge en dB entre l'échantillon le plus fort d'un mixage et 0 dBFS (ou le true peak). Les masters destinés au streaming visent en général –1 dBTP / –14 LUFS ; les cibles broadcast sont plus prudentes. Voir la page méthodologie pour les valeurs par défaut d'AudioLab.
- HRTF HearLab
- Head-Related Transfer Function : le filtre dans le domaine fréquentiel qui décrit comment un son provenant d'une direction donnée est modifié par la tête, le torse et le pavillon de l'oreille de l'auditeur. La base de l'audio spatial binaural.
- Inference SignalLab
- L'exécution d'un modèle entraîné pour produire des sorties. À distinguer de l'entraînement. La phase qui doit être rapide, prévisible et assez légère pour tenir sur l'appareil. La partie visible par l'utilisateur de tout produit audio à base d'IA.
- Integrated LUFS MixLab
- Une mesure du niveau sonore pondérée perceptivement et gatée dans le temps, calculée sur l'ensemble d'un fichier audio. Le chiffre que les plateformes de streaming utilisent pour normaliser la lecture.
- JND SkillLab
- Just Noticeable Difference. Le plus petit changement d'un stimulus qu'un auditeur peut détecter de façon fiable. Il guide le calibrage de chaque seuil de perception auditive dans les exercices de SkillLab.
- JUCE Engineering
- Un framework audio C++ multiplateforme. La voie la plus simple pour livrer le même code DSP sur Android, iOS, macOS, Windows et sous forme de plug-ins VST/AU/AAX.
- K-weighting MixLab
- La chaîne de préfiltres (high-shelf à ~1,5 kHz + passe-haut à ~38 Hz) définie dans la BS.1770-4. Appliquée avant la sommation de l'énergie RMS afin que la valeur LUFS obtenue suive le niveau sonore perçu plutôt que l'énergie brute du signal.
- LC3 HearLab
- Low Complexity Communication Codec. Le codec par défaut de Bluetooth LE Audio. Nettement meilleur que SBC et compétitif face à AAC à débits réduits.
- LE Audio HearLab
- La spécification audio Bluetooth introduite avec la version 5.2, comprenant le codec LC3 et les profils multi-flux. Une amélioration substantielle pour les appareils auditifs et l'audio à faible consommation.
- Lissajous figure MixLab
- Le tracé d'un signal en fonction d'un autre, produisant une courbe dont la forme révèle leur relation de phase. La visualisation classique derrière chaque « phase scope » en audio professionnel.
- LRA (Loudness Range) MixLab
- Une mesure EBU 3342 exprimant l'écart entre les passages les plus forts et les plus faibles d'un fichier audio. Distincte de la dynamique crête-à-RMS ; plus proche de la perception de « à quel point la musique respire ».
- Mel spectrogram SignalLab
- Un spectrogramme sur l'échelle de fréquences mel, avec des bins pondérés perceptivement qui collent mieux à la perception humaine de la hauteur que la fréquence linéaire. La représentation d'entrée standard pour les réseaux de neurones audio.
- MFCC SignalLab
- Mel-Frequency Cepstral Coefficients. La représentation compacte classique du contenu timbral, soit de 13 à 40 coefficients qui résument l'enveloppe spectrale. Toujours utiles comme features, même à l'ère du deep learning.
- Mid/Side MixLab
- Une représentation stéréo où Mid = (L+R)/2 (le contenu central) et Side = (L−R)/2 (la différence stéréo). La base pour mesurer la véritable largeur stéréo.
- Mix-minus CueLab
- Un retour envoyé à un invité distant contenant l'intégralité de l'audio du programme à l'exception de sa propre voix, afin d'éviter l'effet de retour « parler dans un tunnel ». Standard pour le routage en broadcast et pour les podcasts à distance.
- Momentary LUFS MixLab
- Une mesure de niveau sonore sur une fenêtre glissante de 400 ms. La mesure à réaction rapide, destinée à repérer les passages forts transitoires. Calibrée sur le même filtre K-weighting que l'integrated LUFS, mais sans gating.
- Multiband compression MixLab
- La division du signal en 2 à 6 bandes de fréquences, chacune compressée indépendamment. L'outil standard pour dompter une seule bande problématique (graves boueux, haut-médiums agressifs) sans ternir l'ensemble du mixage.
- MUSHRA SignalLab
- MUlti Stimulus test with Hidden Reference and Anchor. La méthodologie de test d'écoute standard pour évaluer la qualité audio perçue à des niveaux de qualité moyens à élevés.
- N-1 feed CueLab
- Un autre nom du mix-minus. Littéralement : un mélange des N sources moins celle destinée à cette sortie. Intégré nativement aux consoles broadcast dignes de ce nom ; émulé via des matrices de routage dans les logiciels.
- Neural vocoder VoiceLab
- Un modèle qui convertit une représentation audio intermédiaire (généralement un spectrogramme mel) en forme d'onde. WaveNet, HiFi-GAN, BigVGAN. Le « dernier kilomètre » de tout pipeline TTS moderne.
- Nyquist frequency Engineering
- La moitié de la sample rate, soit la borne supérieure théorique des fréquences représentables dans un signal numérique. 22,05 kHz à 44,1 kHz ; 24 kHz à 48 kHz. La raison pour laquelle les chaînes de mastering travaillent souvent à 96 kHz ou plus.
- Oboe Engineering
- Le wrapper C++ de Google autour d'AAudio (avec repli sur OpenSL ES pour les appareils anciens). Le point de départ recommandé pour le code audio Android en 2026.
- OfflineAudioContext MixLab
- La variante de la WebAudio API pour un traitement audio hors ligne, plus rapide que le temps réel. Le bon choix pour l'analyse et le rendu par lots. Elle alimente le pipeline de synthèse d'échantillons d'AudioLab.
- Onset detection SignalLab
- L'identification des instants de début des événements musicaux (frappes de batterie, attaques de notes, transitoires percussifs). Fondamentale pour le beat tracking, l'estimation du tempo et l'analyse audio au niveau du segment.
- Pearson correlation MixLab
- La mesure statistique de la corrélation linéaire entre deux signaux, renvoyant une valeur de −1 à +1. Utilisée dans MixLab pour calculer la corrélation stéréo entre les canaux L et R.
- Phantom power VoiceLab
- Une tension continue de +48 V fournie aux microphones à condensateur via le même câble XLR que celui qui transporte l'audio. Indispensable au fonctionnement de la capsule du micro ; fournie par les interfaces audio et les tables de mixage.
- Phase / polarity Engineering
- La polarité est binaire (signal inversé ou non). La phase est continue et dépend de la fréquence. Les confondre est l'erreur de vocabulaire la plus fréquente en audio, et la cause de bien des mystères de filtrage en peigne.
- Phoneme VoiceLab
- La plus petite unité sonore de la parole qui distingue un mot d'un autre dans une langue donnée. L'anglais en compte environ 44 ; l'alignement au niveau du phonème est au fondement de tout système TTS et ASR moderne.
- Plosive VoiceLab
- Une bouffée basse fréquence produite par les consonnes « p » et « b » qui frappent le micro. Atténuée par les filtres anti-pop à la prise, puis par un filtrage passe-haut ou une édition des transitoires en postproduction.
- Pre-show checklist CueLab
- L'ensemble réutilisable de vérifications avant diffusion ou avant événement qui rattrape les défaillances évitables. Matériel-routage-niveaux-flux-sauvegarde, dans cet ordre. Voir le document sur la checklist pré-show.
- Prosody VoiceLab
- Le rythme, l'accentuation et l'intonation de la parole. Ce que les voix synthétiques ont le plus de mal à réussir, et ce qui les trahit le plus souvent quand elles échouent. Conditionne l'intelligibilité et l'émotion perçue.
- Round-trip latency Engineering
- Le temps total entre la captation du son et sa sortie à travers une chaîne de traitement. Le chiffre phare de toute appli audio temps réel : sous 15 ms est le seuil pour s'écouter pendant l'enregistrement.
- RT60 VoiceLab
- Le temps de réverbération nécessaire pour qu'une impulsion décroisse de 60 dB. La mesure standard de l'acoustique des salles. En pratique, les outils de QA vocale l'estiment implicitement via l'analyse de la décroissance de l'enveloppe.
- Sample rate General
- Le nombre d'échantillons par seconde. 44,1 kHz pour le CD ; 48 kHz pour la diffusion et la plupart des productions modernes ; 96 kHz / 192 kHz pour le mastering haute résolution.
- Short-term LUFS MixLab
- Une mesure de niveau sonore sur une fenêtre glissante de 3 secondes. La couche intermédiaire entre le momentary (400 ms) et l'integrated (programme entier). Elle alimente le calcul de la plage « LRA » dans l'EBU 3342.
- Sibilance VoiceLab
- L'énergie consonantique haute fréquence des sons « s », « ch », « t » et « z ». Concentrée autour de 5–9 kHz. Une cause fréquente de fatigue auditive lorsqu'elle est trop accentuée.
- Sidechain MixLab
- Un signal de commande externe qui déclenche un processeur de dynamique (généralement un compresseur). La technique derrière les mixages de grosse caisse qui pompent, les lits musicaux qui s'effacent sous la voix et le de-essing moderne.
- SNR General
- Signal-to-Noise Ratio. La marge en dB entre le signal utile et le bruit de fond. Le chiffre unique qui prédit l'intelligibilité, la qualité d'enregistrement et les performances d'un modèle de ML mieux que tout autre.
- Source separation SignalLab
- La décomposition d'un signal audio mixé en stems individuels (voix, batterie, basse, autres). Demucs, Spleeter, Open-Unmix. En 2026, l'état de l'art produit une isolation propre sur la plupart des morceaux de pop.
- Speaker verification VoiceLab
- La confirmation d'une identité de locuteur revendiquée à partir d'un échantillon vocal. Le pendant défensif du voice cloning. Les systèmes modernes utilisent des embeddings d-vector ou x-vector comparés par similarité cosinus.
- Spectral centroid MixLab
- Le « centre de gravité » du spectre, soit une fréquence moyenne pondérée qui correspond grosso modo à la brillance perçue.
- Speech-in-noise HearLab
- Une catégorie de mesures et de tests (SIN, QuickSIN, HINT) évaluant l'intelligibilité de la parole face à des bruits de fond variables. Le meilleur prédicteur, en conditions réelles, du bénéfice d'une aide auditive, davantage que l'audiométrie tonale.
- Streaks SkillLab
- Des marqueurs de régularité d'entraînement utilisés dans SkillLab. Conçus pour survivre à un jour manqué afin d'éviter les dynamiques de progression dignes d'une machine à sous. Voir la conception de la progression.
- Tag schema SignalLab
- Le vocabulaire contrôlé utilisé pour décrire le contenu audio en vue de sa récupération ultérieure. Le schéma de SignalLab couvre le type de contenu, la brillance, la dynamique et les indicateurs de problèmes. Voir le document sur le schéma de tags.
- True peak MixLab
- La crête analogique réelle d'un signal reconstruit, qui peut dépasser la crête du domaine échantillonné à cause des pics inter-échantillons. Mesurée par suréchantillonnage.
- TTS (Text-to-Speech) VoiceLab
- La génération d'audio vocal à partir de texte. L'état de l'art en 2026 est neuronal, typiquement un pipeline encodeur de texte + modèle acoustique + vocodeur, souvent distillé en un modèle unique pour l'inférence en temps réel.
- VAD (Voice Activity Detection) VoiceLab
- Un classifieur qui renvoie 1 pour la parole et 0 pour l'absence de parole, trame par trame. La première étape de presque tout pipeline vocal : des applis de visioconférence aux éditeurs de podcast, jusqu'à la démo de QA VoiceLab.
- Voice cloning VoiceLab
- La synthèse de parole dans la voix d'un locuteur cible à partir d'un enregistrement de référence. Les modèles modernes se contentent de 3 à 30 secondes d'audio de référence. La base aussi bien des outils légitimes de doublage/d'accessibilité que des attaques modernes par usurpation d'identité.
- WDRC HearLab
- Wide Dynamic Range Compression : le traitement de gain multibande et dépendant du niveau présent dans toute aide auditive moderne. Il transpose la dynamique du locuteur dans la plage d'audition résiduelle de l'utilisateur.
- WebAudio API MixLab
- Le standard du W3C pour le traitement audio dans les navigateurs. Inclut AudioContext, AudioNode, AudioBuffer, AnalyserNode, AudioWorklet et OfflineAudioContext. Le socle de tout outil audio côté navigateur.