3133拉斯维加斯
全部
All
当前位置: 首页 > 新闻资讯 > 谷歌用AI从嘈杂环境中提取独立音轨:或存隐私担忧
相关新闻
  • 百度智能小程序“月活破2亿”

    2026-07-23 10:20

    在2019百度联盟生态合作伙伴大会“智能小程序”分论坛上,百度再次披露了智能小程序生态进展:去年7月正式上线至今300多天,百度智能小程序月活已经超过2亿,入驻研发者超过8万家。未来小程序开

  • APP设计没有吸引力?如何提高UI设计的吸引力

    2026-07-20 10:29

    如何提高UI设计的吸引力?APP界面设计的目的是给用户带来舒适的视觉体验,更重要是研究产品和用户之间的互动,拉近彼此之间的距离,从而产生情感共鸣,创造市场价值。一,优秀的界面设计需要具备某些

  • 网站对于企业来讲就是互联网中的一张“名片”

    2026-07-06 15:07

    在10月31日,三大运营商的5G套餐上线。对于网站开发5G赋能的网络技术一直是3133拉斯维加斯所探索研究的。而网站开发对于一个企业来说可以说是最直接面向市场的“互联网名片”。未来5G对各产业、行业

  • 北京网站制作中视频元素如何使用

    2026-06-30 11:45

    在众多北京网站制作中,都运用了视频元素。视频元素有很长的历史了,从Flash格式的动效到视频文件,再到HTML5和其它格式的视频,可以说也是升级了很多版本了。北京网站制作3133拉斯维加斯认为视频元

  • 未来5G的变革,你了解多少?

    2026-06-24 22:25

    网络的普及在丰富我们生活的同时,也悄然改变传统产业生产方式。比如在家体验4G网站制作电影,发展越来越快的网购。但不可否认的是,这种快节奏的工作、学习方式,也让许许多多传统的产业或者实体店举步

谷歌用AI从嘈杂环境中提取独立音轨:或存隐私担忧

返回列表
发布时间:2026-07-22 08:48
北京时间4月16日早间消息,谷歌研究人员开发了一种深度学习系统,可以帮助电脑在嘈杂环境中更好地识别和区分一个人的声音。
集团网站建设案例

本周在谷歌研究博客中发布的文章显示,该公司的一个内部团队试图让人工智能(AI)像人类的大脑一样,可以主动关注一个声源,同时过滤其他声源——像你在聚会上跟朋友对话时的做法。
谷歌的方法使用了一个视听模型,使之可以集中精力区分一段视频中的声音。该公司还发布了多段YouTube视频,演示这项技术的实际效果。
谷歌表示,这项技术可以适用于单音轨视频,而且可以通过算法分离出视频中不同人的音频内容,也可以让用户手动选取视频中的人脸,专门收听此人的声音。
谷歌表示,视觉元素是关键,因为这项技术会关注一个人的嘴唇运动,从而更好地判断某个时点应该关注哪段声音,并为一段较长的视频创造更精确的独立音轨。
谷歌研究人员通过收集10万段YouTube“演讲视频”开发了这个模型,总共提取了大约2000小时的内容,然后将这些音轨混合后,添加上人工背景噪音。
谷歌之后训练该技术通过观察每一格视频中的人脸和视频音轨的频谱图,把混合后的音频进行分割。这套系统可以区分哪个声源在特定时间内属于哪张脸,并为每个人制作一段独立的音轨。
谷歌认为,隐藏式字幕系统会成为该系统的一大应用领域,他们还在设想更广泛的应用方向,而且还在探索更多的机会,希望将其整合到各种谷歌产品中。例如,如果把它加入到Google Home智能音箱中,便可区分出不同用户发出的指令。
不过,这个模型需要配合视频才能更好地发挥作用,所以可能更适合亚马逊Echo Show。谷歌今年早些时候面向Echo Show这样的智能显示器开放了谷歌助手,但该公司本身尚未推出这样的产品。
但这项技术可能也会引发隐私担忧。虽然该技术的实际效果远没有视频演示得那么好,但经过一些细微调整,的确有可能成为强大的监听和监视工具。