Gboard输入法离线语音识别上线:目前仅限谷歌Pixel手机使用
2019/03/14 15:11AI云资讯11359
昨日,谷歌通过博客悄然宣布实时语音识别技术的突破。使用人工智能技术并利用其Pixel手机的神经处理功能,Gboard用户现在可以进行离线实时语音识别。

图源:谷歌
目前,如果用户在Pixel设备上使用Gboard,要进行语音识别并转化成文本,实时语音处理需要使用Wi-Fi或蜂窝数据连接进行。谷歌宣布,自从它首次引入神经学习来处理人类语音以来,它一直在继续开发软件架构,以便使用其Pixel设备的神经处理功能完全离线工作。
据介绍,谷歌新型递归神经网络传感器(RNN-T)体积已经足够小,可以完全安装在手机上,消除网络延迟和零散连接,这是随时使用该技术的障碍。它可以实时输出逐字输出的字样,就好像有人在说出你说的那样。
谷歌已经能够通过将数据处理要求从2GB(需要无线连接进行离线处理)降低到仅仅80 MB进行处理来实现这一目标。
虽然最初只适用于使用Pixel设备并仅使用美国英语的Gboard用户,但Google希望其开发的研究技术将被用于更多语言和更多设备以及用于其他环境。
相关文章
AI企业
更多>>AI硬件
更多>>- 鸿蒙智慧体验再进阶,HUAWEI WATCH 6系列正式发布
- 机器人参展数量创IFA历史新高,璇玑动力以自研四足机器人赋能全球产业场景
- 努比亚NaviX Ultra定档9月16日,全球首款AI智能体手机即将上市
- BOE(京东方)新一代TSF广色域显示技术斩获德国IFA 2026金奖 重塑OLED柔性显示画质性能新标准
- 元点机器人卖出了1000台具身智能,“8888元+高性能”引发行业热议
- 联合开源!因时机器人携手上海交大、复旦发布HandEdit数据集与评测基准
- 华沿机器人与骅升科技达成战略合作,携手布局具身智能与协作机器人市场
- 元点机器人Bridge斩获IFA年度创新奖,全球首款AI原生人形机器人柏林首秀
AI产业
更多>>AI技术
更多>>- 全球最强开源模型 Kimi K3 发布,参数规模 3 万亿,真的是强!
- 范式变革!东软发布AI原生软件工程白皮书,重构软件产业底层逻辑
- KAT-Coder-Pro V2.5正式发布:从“写代码”迈向“做工程”,Agentic能力全面升级
- 自变量机器人王昊:训练世界模型需付出“时间税”,解决模态对齐是当务之急
- 腾讯发布CodeBuddy Security,用AI Agent实现更高效的代码审计
- Twinkle x昇腾,率先实现Deepseek-V4系列模型高效训练
- 高德发布鸿蒙首个生成式 UI 开源框架 AGenUI,告别传统 UI 开发模式
- 发布即适配| 天数智芯全力支持腾讯混元Hy3 preview 开源落地,共推国内大模型产业普惠









