IT之家4月13日消息近日,谷歌研究博客发表了一篇文章,介绍了一种通过人工智能分离视频中多种声音的技术。目前这种技术可以精确过滤人声,只留下被过滤的人自己的声音。谷歌的专家团队通过结合机器学习和面部识别来实现准确分离人声的目标。
同时,谷歌上传了几个小视频来展示这项技术的应用场景。谷歌的研究团队解释说,他们通过算法跟踪面部运动,并通过学习YouTube上的10万个高质量讲座和演讲视频,使用卷积神经网络模型来分离声音。



目前,谷歌研究团队表示,未来可能会应用于类似Hangouts或Duo的语音手机。只要打开摄像头,系统就能自动过滤掉背景噪音。其他如自动字幕或自动翻译在未来也可能受益于此。
目前,Google已经在GitHub中托管了这个项目。有兴趣的可以点击这里查看。
想看更多这类内容?去APP store搜一下它家,每天都有小欢乐。


