谷歌开源人工智能图像识别模型和 VR 音频工具

栏目: IT资讯 · 发布时间: 7年前

内容简介:谷歌近日宣布开源两个重要项目:一个是谷歌最新的语义图像分割人工智能模型 DeepLab-V3+,另外一个是谷歌的空间音频 SDK——Resonance Audio。 “语义图像分割”指计算机识别照片或者视频中多个物体并用自然语言命...

谷歌近日宣布开源两个重要项目:一个是谷歌最新的语义图像分割人工智能模型 DeepLab-V3+,另外一个是谷歌的空间音频 SDK——Resonance Audio。

谷歌开源人工智能图像识别模型和 VR 音频工具

“语义图像分割”指计算机识别照片或者视频中多个物体并用自然语言命名的过程。例如谷歌自家产品Google Photo不仅能够发现照片中的狗狗图像,还能够正确地将其标注为“狗”。在官方技术博客中,Google指出Pixel2的单镜头人像模式也适用该技术,但是Google表示DeepLab-V3+并未在Pixel2的拍照技术中应用。

Resonance Audio是Google去年发布的空间音频SDK,直到上周三才得以开源,该技术利用位置数据和声音过滤器在VR或AR应用中提供定位准确逼真的环绕立体声效果。Google在博客中指出,Resonance Audio将帮助开发者在移动端或桌面创建体验更棒的VR或AR应用,并且该SDK已经在《星战:绝地武士挑战》这个APP中得到应用。

上述两个 工具 的链接如下:

DeepLab-V3+ 、 Resonance Audio

来自:IT 经理网


【声明】文章转载自:开源中国社区 [http://www.oschina.net]


以上就是本文的全部内容,希望本文的内容对大家的学习或者工作能带来一定的帮助,也希望大家多多支持 码农网

查看所有标签

猜你喜欢:

本站部分资源来源于网络,本站转载出于传递更多信息之目的,版权归原作者或者来源机构所有,如转载稿涉及版权问题,请联系我们

数字战争

数字战争

[英]查尔斯·亚瑟 / 余淼 / 中信出版社 / 2013-6-1 / 49

1998年,数码世界初具雏形。 至此以往,大浪淘沙。随着IT产业的迅猛发展,涌现出了以苹果、谷歌、微软为首的行业巨头。它们为争夺数码世界不同分支的霸主地位而争斗,包括搜索技术、移动音乐、智能手机和平板电脑市场。它们可利用的武器包括硬件、软件以及广告。同时,它们要赌上的则是公司的声望,当然,还有我们的未来。然而,无论在产品创新还是在战略优势上,这些企业彼此竞争、彼此砥砺,推动了行业的良性发展。......一起来看看 《数字战争》 这本书的介绍吧!

JSON 在线解析
JSON 在线解析

在线 JSON 格式化工具

HTML 编码/解码
HTML 编码/解码

HTML 编码/解码

html转js在线工具
html转js在线工具

html转js在线工具