AI Noise Reduction (KI-basierte Geräuschunterdrückung) bezeichnet eine Form der digitalen Audioverarbeitung, bei der Algorithmen der Künstlichen Intelligenz (KI) eingesetzt werden, um Sprache von störenden Hintergrundgeräuschen zu unterscheiden und diese in Echtzeit zu reduzieren.
Im Gegensatz zu einer klassischen Rauschunterdrückung, die meist nur gleichmäßige Störgeräusche (z. B. Lüfterrauschen) filtert, erkennt eine KI auch komplexe und wechselnde Geräuschquellen.
Beim AISpeech MC10 bedeutet das:
Während einer Besprechung analysiert die integrierte Signalverarbeitung kontinuierlich das Audiosignal und unterscheidet zwischen:
- Sprache des aktiven Sprechers
- Tastaturgeräuschen
- Papierrascheln
- Lüftungs- oder Klimaanlagengeräuschen
- Stühlerücken
- Husten oder anderen Nebengeräuschen
- Gesprächen im Hintergrund
Die Sprache wird möglichst unverändert übertragen, während unerwünschte Geräusche deutlich abgeschwächt oder unterdrückt werden.
Vorteile
- höhere Sprachverständlichkeit
- weniger Ablenkung für die Gesprächsteilnehmer
- bessere Audioqualität bei Videokonferenzen
- geringere Hörermüdung
- auch bei wechselnden Umgebungsgeräuschen wirksam
Unterschied zur klassischen Noise Reduction
| Klassische Rauschunterdrückung |
AI Noise Reduction |
| filtert überwiegend konstante Geräusche |
erkennt verschiedene Geräuscharten |
| arbeitet mit festen Filtern |
passt sich dynamisch an |
| begrenzt Wirkung bei wechselnden Geräuschen |
wirksam auch bei komplexen Störgeräuschen |
| keine Unterscheidung zwischen Sprache und Geräuschen |
KI unterscheidet gezielt Sprache von Störschall |