谷歌开源人工智能图像识别模型和 VR 音频工具

栏目: IT资讯 · 发布时间: 6年前

内容简介:谷歌近日宣布开源两个重要项目:一个是谷歌最新的语义图像分割人工智能模型 DeepLab-V3+,另外一个是谷歌的空间音频 SDK——Resonance Audio。 “语义图像分割”指计算机识别照片或者视频中多个物体并用自然语言命...

谷歌近日宣布开源两个重要项目:一个是谷歌最新的语义图像分割人工智能模型 DeepLab-V3+,另外一个是谷歌的空间音频 SDK——Resonance Audio。

谷歌开源人工智能图像识别模型和 VR 音频工具

“语义图像分割”指计算机识别照片或者视频中多个物体并用自然语言命名的过程。例如谷歌自家产品Google Photo不仅能够发现照片中的狗狗图像,还能够正确地将其标注为“狗”。在官方技术博客中,Google指出Pixel2的单镜头人像模式也适用该技术,但是Google表示DeepLab-V3+并未在Pixel2的拍照技术中应用。

Resonance Audio是Google去年发布的空间音频SDK,直到上周三才得以开源,该技术利用位置数据和声音过滤器在VR或AR应用中提供定位准确逼真的环绕立体声效果。Google在博客中指出,Resonance Audio将帮助开发者在移动端或桌面创建体验更棒的VR或AR应用,并且该SDK已经在《星战:绝地武士挑战》这个APP中得到应用。

上述两个 工具 的链接如下:

DeepLab-V3+ 、 Resonance Audio

来自:IT 经理网


【声明】文章转载自:开源中国社区 [http://www.oschina.net]


以上就是本文的全部内容,希望本文的内容对大家的学习或者工作能带来一定的帮助,也希望大家多多支持 码农网

查看所有标签

猜你喜欢:

本站部分资源来源于网络,本站转载出于传递更多信息之目的,版权归原作者或者来源机构所有,如转载稿涉及版权问题,请联系我们

SEO深度解析

SEO深度解析

痞子瑞 / 电子工业出版社 / 2014-3-1 / CNY 99.00

《SEO深度解析》以SEO从业人员普遍存在的疑问、经常讨论的问题、容易被忽视的细节以及常见的错误理论为基础,对SEO行业所包含的各方面内容进行了深入的讨论,使读者更加清晰地了解SEO及操作思路。内容分为两类:一类为作者根据自己真实、丰富的SEO经验对SEO所涉及的各种问题进行详细的讨论,主要包括SEO 基础原理剖析、SEO实操思路方法、常用工具数据剖析、竞争对手分析案例实操、网站数据分析思路指导、......一起来看看 《SEO深度解析》 这本书的介绍吧!

CSS 压缩/解压工具
CSS 压缩/解压工具

在线压缩/解压 CSS 代码

RGB转16进制工具
RGB转16进制工具

RGB HEX 互转工具

随机密码生成器
随机密码生成器

多种字符组合密码