Skriv ut

En optisk MEMS-mikrofon kombinerad med AI-baserad beamforming ska göra det lättare att plocka ut tal ur bullriga miljöer. Norska Sensibel och amerikanska Aizip riktar tekniken bland annat mot smarta glasögon, trådlösa hörlurar och industriella röstapplikationer.

Sensibels mikrofon skiljer sig från konventionella kapacitiva MEMS-mikrofoner genom att membranets rörelser mäts optiskt. När membranet rör sig förändras den optiska vägen, och förändringarna omvandlas till en digital ljudsignal.

Mikrofonen når enligt Sensibel ett signal-brusförhållande på 80 dB och ett dynamiskt omfång på 132 dB. Den maximala ljudtrycksnivån innan överbelastning anges till 146 dB SPL.

Aizip kompletterar mikrofonen med AI som körs lokalt på enheten. Lösningen kombinerar brusreducering, reducering av efterklang och riktad talförstärkning för att isolera en viss persons röst innan signalen skickas vidare till taligenkänningen.

I tester minskade Aizips lösning teckenfelsfrekvensen, CER, med mer än 30 procent. Bolagen specificerar dock inte vilken taligenkänning eller referensnivå som användes i jämförelsen.

Systemet kan dessutom avgöra från vilken riktning och position talet kommer och skilja mellan ljud i när- och fjärrfält. Det kan ge exempelvis smarta glasögon mer information om den akustiska omgivningen och ge AI-modeller ett bättre underlag än enbart den inspelade rösten.