EVO视讯
全部
All
当前位置: 首页 > 新闻资讯 > 谷歌用AI从嘈杂环境中提取独立音轨:或存隐私担忧
相关新闻
  • 在网站设计中容易犯错的地方有哪些?

    2026-08-05 06:14

    现在的客户越来越注意网站建设设计与动画效果了,大多数的客户对网站有他自己的审美观,且不论这个审美观的好坏,但是已经是一种自我所属的审美观,就已经不好了,因为这个网站建设设计面对的是你的客户,

  • EVO视讯多年网站建设浅谈工业互联网为“智造”建设赋能

    2026-08-04 13:47

    随着互联网工业的深入发展,工业互联网是企业实施智能化改造的主要实现路径,重庆在建设“智造重镇”过程中,我们要知道应该如何推进工业互联网建设的?EVO视讯网站建设团队今天与大家分享下未来如何发

  • 谷歌用AI从嘈杂环境中提取独立音轨:或存隐私担忧

    2026-07-31 12:51

    北京时间4月16日早间消息,谷歌研究人员开发了一种深度学习系统,可以帮助电脑在嘈杂环境中更好地识别和区分一个人的声音。本周在谷歌研究博客中发布的文章显示,该公司的一个内部团队试图让人工智能(

  • 关于EVO视讯网站开发的那些趣事

    2026-07-17 14:44

    企业网站开发是企业在Internet上展示形象的门户,是企业开展电子交易的基地,是企业网上的'家',设计制作一个优秀的网站是网站开发的企业成功迈向互联网的重要步骤。网络可以带给企业不分地域、

  • 商城网站建设方案

    2026-07-13 12:33

    随着网络的进一步普及和电子商务的高速发展,越来越多的人们开始在网络中寻求方便。网上购物具备了省时、省事、省心、有效等特点,越来越受到人们的欢迎。在网络消费逐渐主流的今天,在线订购已经成为人们

谷歌用AI从嘈杂环境中提取独立音轨:或存隐私担忧

返回列表
发布时间:2026-07-31 12:51
北京时间4月16日早间消息,谷歌研究人员开发了一种深度学习系统,可以帮助电脑在嘈杂环境中更好地识别和区分一个人的声音。
集团网站建设案例

本周在谷歌研究博客中发布的文章显示,该公司的一个内部团队试图让人工智能(AI)像人类的大脑一样,可以主动关注一个声源,同时过滤其他声源——像你在聚会上跟朋友对话时的做法。
谷歌的方法使用了一个视听模型,使之可以集中精力区分一段视频中的声音。该公司还发布了多段YouTube视频,演示这项技术的实际效果。
谷歌表示,这项技术可以适用于单音轨视频,而且可以通过算法分离出视频中不同人的音频内容,也可以让用户手动选取视频中的人脸,专门收听此人的声音。
谷歌表示,视觉元素是关键,因为这项技术会关注一个人的嘴唇运动,从而更好地判断某个时点应该关注哪段声音,并为一段较长的视频创造更精确的独立音轨。
谷歌研究人员通过收集10万段YouTube“演讲视频”开发了这个模型,总共提取了大约2000小时的内容,然后将这些音轨混合后,添加上人工背景噪音。
谷歌之后训练该技术通过观察每一格视频中的人脸和视频音轨的频谱图,把混合后的音频进行分割。这套系统可以区分哪个声源在特定时间内属于哪张脸,并为每个人制作一段独立的音轨。
谷歌认为,隐藏式字幕系统会成为该系统的一大应用领域,他们还在设想更广泛的应用方向,而且还在探索更多的机会,希望将其整合到各种谷歌产品中。例如,如果把它加入到Google Home智能音箱中,便可区分出不同用户发出的指令。
不过,这个模型需要配合视频才能更好地发挥作用,所以可能更适合亚马逊Echo Show。谷歌今年早些时候面向Echo Show这样的智能显示器开放了谷歌助手,但该公司本身尚未推出这样的产品。
但这项技术可能也会引发隐私担忧。虽然该技术的实际效果远没有视频演示得那么好,但经过一些细微调整,的确有可能成为强大的监听和监视工具。