بتازگی محققان مرکز تحقیقاتی Idiap در سوئیس با همکاری گوگل راهحلی برای این مشکل یافتهاند. آنها با طراحی دو شبکه عصبی مبتنی بر هوش مصنوعی و ترکیب کارکردهای آنها با یکدیگر استخراج صدای فرد هدف در یک جمع بزرگ و پرسروصدا را ممکن کردهاند.
از دو شبکه عصبی طراحی شده، یکی وظیفه شناسایی صدای تکتک افراد و دیگری وظیفه استخراج آنها را بر عهده دارد. تلاش برای طراحی این سیستم از ابتدای سال جاری میلادی آغاز شده و آزمایش آن با موفقیت در آزمایشگاه هوش مصنوعی و علوم رایانه دانشگاه امآیتی انجام گرفته است.
در گفتوگو با جامجم آنلاین عنوان شد