/docs
Docs, die klingen, als hätte sie ein praktizierender Engineer geschrieben.
Praktische Referenzen zu DSP, Audioanalyse, Echtzeit-Audio unter Android, Mustern für Barrierefreiheit, Voice-QA und den Engineering-Entscheidungen hinter jedem Lab.
01 MixLab
- IntroWas integrierte LUFS dir wirklich sagenIntegrierte LUFS sind der Lautheitswert, auf den es ankommt, und der Wert, den die meisten „Loudness”-Tools auf subtile Weise falsch ermitteln.
- PracticalDen Crest-Faktor lesen, ohne sich selbst zu täuschenDer Crest-Faktor ist die am einfachsten zu berechnende Dynamikkennzahl, und die am einfachsten falsch zu lesende.
- DeepMid/Side-Zerlegung in WebAudioSummen- und Differenzsignale sind die richtige Art, über Stereo nachzudenken. Hier ist der WebAudio-API-Code dafür.
02 VoiceLab
- IntroWarum die Füllwortdichte wichtiger ist als die Füllwortanzahl"Ähs" zu zählen ist die falsche Messgröße. Die Dichte verrät, ob sie ein Problem sind.
- PracticalEin pragmatisches Loudness-Ziel für PodcastsDas richtige Loudness-Ziel für Sprach-Podcasts ist nicht dasselbe wie für Musik. Hier sind die Zahlen und das Warum.
- DeepRaumhall ohne RT60 abschätzenDu brauchst keine Impulsantwort, um zu wissen, dass dein Raum zu hallig ist. Hier sind drei pragmatische Messungen.
03 HearLab
- PracticalLive Caption auf Android: was es leistet und was nichtGoogles Live Caption ist die weltweit meistgenutzte Barrierefreiheitsfunktion. So funktioniert sie wirklich und das deckt sie nicht ab.
- DeepHörgeräte-Routing durch das Android Audio FrameworkWie AAudio, ASHA und LE Audio Audio auf modernem Android tatsächlich an Hörgeräte ausliefern.
04 SignalLab
- IntroEin brauchbares Tag-Schema für Audio-ArchiveWas in deine Audio-Metadaten gehört, damit nachgelagerte Tools sie auch wirklich nutzen können.
- PracticalStreaming-Clipping-Erkennung im großen MaßstabWie man Clipping in Audio bereits beim Ingest erkennt, ohne die ganze Datei zu dekodieren.
- DeepSegmentierung von Sprecherwechseln: der pragmatische StackDiarisierung ist ein schwieriges ML-Problem. Die Segmentierung von Sprecherwechseln, die günstige Variante, ist gut genug gelöst, um sie überall einzusetzen.
05 CueLab
- IntroEine wiederverwendbare Pre-Show-ChecklisteDie Checkliste, die in dem Moment trägt, in dem dir dreißig Sekunden vor dem Live-Gang der Kopf leer wird.
- PracticalOBS-Audiorouting ohne ÜberraschungenOBS-Audiorouting ist mächtiger, als die Standard-Oberfläche vermuten lässt. Hier ist das mentale Modell, das es vorhersehbar macht.
- DeepCue-Listen-Daten entwerfen, die eine Umstrukturierung überstehenEine Cue-Liste ist zuerst ein Datenmodell und erst danach eine UI. Behandle sie auch so.
06 SkillLab
- IntroGestufte Audio-Challenges gestaltenBronze / Silber / Gold gibt es aus gutem Grund. Das ist die Struktur, die echten Kompetenzzuwachs erzeugt.
- PracticalFeedback, die ankommt: Muster von echten CoachesGenerisches Feedback ist schlimmer als gar kein Feedback. Hier sind die Muster, die echte Coaches verwenden.
- DeepProgressionsschleifen ohne Spielautomaten-MechanikWie man Menschen zum Wiederkommen bewegt, ohne Dopamin zur Waffe zu machen.