语音软硬结合,百度站上人工智能语音赛道

百度语音  时间:2021-02-24  阅读:()

软硬结合百度站上人工智能语音赛道

2月16日有两条关于百度的消息很有意思一条是收购渡鸦团队一条是把度秘团队升级为度秘事业部两边都向陆奇汇报工作。这种软硬融合的战略选择是极其正确的。

这并不是马后炮我在2016年10月发的《虽然很投入但李彦宏可能正在错过人工智能》里核心观点之一就是百度是国内对人工智能投入力度最大的公司但其不碰硬件的战略很可能导致它最终错过人工智能里对它最关键的部分。虽然大方向正确但如果互联网公司真想学亚马逊就还差了那么一点东西。

语音赛道的AI到底需要解决什么问题

国内绝不缺和E c ho类似的产品但此前的命运都是折戟沉沙这里的关键在于对什么是这类产品上要解决的核心问题认知不清。 自由交流唤醒词速度方言 内容 习惯等每个似乎都可以成为要解决的核心问题但实际上所有这个赛道上玩家最核心的问题是在语义、方言这些刚性约束不突破的条件下打造出速度、精度、 内容相匹配的产品。

智能语音也就是说要解决的并非宽适配问题而是要在面对主流人群真在技术上下功夫把体验做好。语音交互上糊弄的空间极小两句话就能感受出体验咋样。这里面最受关注的是语义的问题 因为人们总是向往自由的交流语义肯定是交互的一个瓶颈但我们可以把语音交互根据语义的技术进展分解为两个阶段

第一阶段是语义并没有核心突破也就是说最理想状态也就达到75分。这时候打造产品的根本出发点是不指望自由语言交流而让语音交互偏命令控制但也打造出极为优秀的用户体验。E cho大的定位就是这样一种产品。这时候产品的核心瓶颈是前端的声学麦克风阵列声学算法这是眼下的问题不解决产品体验不可能好。基于这判断我在2015年末开始使了很大力气为公司寻找公司最终这也是我2016年投资声智科技的核心原因 当时逻辑很简单这个问题显然中科院声学所更擅长解决而声智科技几乎是声学所人员所创办的唯一的一家AI企业。

第二阶段是语义真的取得突破这无疑会更大的扩展语音交互的应用范围一旦这个点得以突破语音交互会变的无处不在但我们必须承认什么时候语义能够彻底解决仍然不确定这是属于未来的事情。

这种时间轴上的错乱是很可怕的那样就会在现有产品上挑战不可能解决的问题 比如不用唤醒词指望E cho这类产品什么都能干等。

总结来看我们可以这样讲如果真想做出E c ho那样的产品声学麦克风阵列算法语音识别语义三层里面眼下的瓶颈是声学未来的瓶颈是语义前者影响现在产品卖不卖的出去后者影响适用范围的大小。但即使只是前者这也是一个足以对标Pad的新品类。

差的那么一点点

真走软硬融合的道路显然的关键要素是 良好的产品定义足够成熟的技术要素系统整合产品的能力其实还有通畅的销售渠道。系统整合一项要求一个公司整合软硬团队否则不同利益诉求会导致软硬团队很难高度配合而在产业初期不同层次间接口标准化很差容易导致产品夭折。产品定义则高度依赖于个人就看当事人的能力对公司而言需要一点运气。

这样一来唯一欠缺的是足够成熟的技术要素。这是非常麻烦的一点对于互联网公司尤其艰难 因为真往这条路

上走欠缺的并非是计算机算法上的认识也还牵扯物理这对于互联网公司是个大大的盲点。

从这个视角正好可以理解苹果和Google的差别苹果是要高度关注物理层面的东西的 比如材料、 电池、屏幕、传感器等Google显然会更关注算法。所以苹果的云端技术始终不好而Google做产品就也总是一般。乔布斯万众瞩目所以大家看到的是他的偏执、癫狂乃至艺术气息但实际上他背后是有一坨人在帮他解决物理上的麻烦事的现在的库克就是其中之一。

这并不只是百度一个公司的问题而是新时代趋势对互联网公司的一种系统型挑战。我在之前的文章中曾经提到过一个行业的兴起事实上是三个大的阶段

第一阶段是Enabling技术的成熟类比的话就是手机上的高通和MTK在语音产业链上声智科技扮演类似的角色。

第二阶段是硬件产品的成熟类比的话就是Apple II或者iPhone 1代在语音产业链上就是Echo。需要注意Echo是起点而不是终点是刚跨过可用线的一款产品。

第三阶段才是新硬件平台上软件应用的成熟比如PC上就是Office手机上就是微信。在语音产业链上这点还没展开。

互联网缩短了第一阶段和第二阶段间的过渡过程相

当于两者在同步发生也正因此才需要软硬融合。但互联网公司独自解决第一个问题能力会偏弱这就是欠缺的那一点点。

硝烟会从今日起

也许是为了提振股价百度十分高调的公布了这件事情。这也很有意思因为百度这样做很可能会引起连锁反应。在这之前大家基本都处于观望状态 当其中一个真的下注后别的人就会开始系统考虑这件事情别人做成了对我会有什么样的影响。

这事一旦开始推敲腾讯、阿里就会认识到这是自己输不起的战争。这点我在之前的文章里提到过但很有必要在百度采取行动的时候再次重述

我们先做个基本的假设那就是Alexa获得了巨大成功Echo、智能音箱、Al exa有关联但其实是不同的东西这点在之前文章中有说这里不再重复渗透到各种设备之中包围了人们的生活人们有50的时间在通过语音和设备打交道并且日活逼近Andro i d。

那这时候一定会衍生这样的需求用户会说 Alexa帮我通知下马化腾 明天我不见他了。这时候就需要有一种通讯的IM来实现这种需求。这时候亚马逊就有两个选择第一它接入一种已有IM 比如Whats app或者Skype。第二种是自己做一个嵌在Alexa里面。亚马逊至少有一半的几

率会选择后者而不是把这种基础设施开放给别人 因为前两种要么属于F acebook要么属于微软。如果在中国是阿里巴巴做成了Al exa那估计百分百不会选择对接微信。

这样一来配合一个语音交互的核心特征颠覆性的事情就出现了语音交互背后隐藏的各种应用具有唯一性。

我们很难想象这种语音交互方式 Alexa帮我用What sapp给马化腾留个消息明天我不见他了。在语音交互中WhatsApp这类应用的标识很可能会被优化掉。如果Alexa还只是百万级、千万级D AU的应用时那这个特性还不关键但如果它是10亿D AU的系统那这个特性的影响就会被无限放大也就说搜索、 IM、电商很可能都只有一家而不是像现在虽然少但还有个1  2 3名。

小结

今天几乎已经没人再怀疑语音交互的成立了有意思的事情是这种变化只发生在过去不到半年的时间里。现在看2017年的热闹很可能在这里发生这是件牵连极广的事情它会牵涉人工智能声学、语音语义公司它会升级智能硬件公司原本的智能硬件其实已经被鄙视了但E cho显然不是什么万物互联赛道而是人工智能赛道。好吧想做的要尽快进来不想做这个行业的可以搬个板凳看热闹了。

Vinahost - 越南VPS主机商月6美元 季付以上赠送时长最多半年

Vinahost,这个主机商还是第一次介绍到,翻看商家的介绍信息,是一家成立于2008年的老牌越南主机商,业务涵盖网站设计、域名、SSL证书、电子邮箱、虚拟主机、越南VPS、云计算、越南服务器出租以及设备托管等,机房主要在越南胡志明市的Viettle和VNPT数据中心,其中VNPT数据中心对于国内是三网直连,速度优。类似很多海外主机商一样,希望拓展自己的业务,必须要降价优惠或者增加机房迎合需求用户...

江苏云服务器 2H2G 20M 79元/月 大宽带159元/月 高性能挂机宝6元/月 香港CN2 GIA、美国200G防御 CN2 GIA 折后18元/月 御速云

介绍:御速云成立于2021年的国人商家,深圳市御速信息技术有限公司旗下品牌,为您提供安全可靠的弹性计算服务,随着业务需求的变化,您可以实时扩展或缩减计算资源,使用弹性云计算可以极大降低您的软硬件采购成本,简化IT运维工作。主要从事VPS、虚拟主机、CDN等云计算产品业务,适合建站、新手上车的值得选择,拥有华东江苏、华东山东等国内优质云产品;香港三网直连(电信CN2GIA联通移动CN2直连);美国高...

justhost:“第4次VPS测评”,8.3元/月,200M带宽,不限流量,KVM虚拟,4个俄罗斯机房应有适合你的

justhost.ru官方来消息说已经对网络进行了比较全面的优化,针对中国电信、联通、移动来说,4个机房总有一个适合中国用户,让站长进行一下测试,这不就有了这篇有关justhost的VPS的第四次测评。本帖主要关注的是网络,对于其他的参数一概不管! 官方网站:https://justhost.ru 最低配VPS:8.3元/月,KVM,512M内存,5G硬盘,200M带宽,不限流量 购买链接:...

百度语音为你推荐
authorware素材跪求用Authorware软件制作一个多媒体作品。 作品要求: 作品中要包含多种素材。(如图像、文字、声音、视照片转手绘照片转手绘用什么APParm开发板新手入门应如何选择 ARM 开发板?不兼容WIN7 64位系统与某些软件不兼容怎么办?网店推广网站可以介绍几个可以做店铺推广的网站吗?数据库损坏数据库坏了,怎么修复?bluestack安卓模拟器bluestacks怎么用?网络广告投放网络广告投放有哪些技巧?系统分析员考系统分析员有什么好处?微信电话本怎么用微信电话本怎么使用呀,我的电话号码是存在手机里面,用这个软件就读取不了电话,我是第一次使用
域名主机 主机测评网 电影服务器 kdata 2017年黑色星期五 国外php空间 发包服务器 本网站在美国维护 40g硬盘 anylink 谁的qq空间最好看 世界测速 佛山高防服务器 香港新世界中心 google台湾 台湾google 网通服务器 稳定空间 江苏徐州移动 97rb 更多