谷歌的人工智能实时语音识别系统更新,支持在Pixel上离线运行
2019/03/13 17:12AI云资讯11413
近日,谷歌人工智能AI团队宣布,其语音识别器Gboard更新,支持声纹识别。值得注意的是,此次更新后,Gboard支持离线运行,不过目前只能在Pixel手机上实现。

现在Gboard已经实现了直接托管在设备上,由于不再需要通过互联网收发数据,Gboard的语音输入速度应该变得更快,更可靠。谷歌在一篇博客文章中解释说,它希望创建一种“足够紧凑,可以驻留在手机上”的语音识别系统,且不会因为WiFi或移动网络信号不好而无法正常工作。

根据Science Line的说法,语音识别的传统工作原理是将你所说的单词分解成更小的部分,即音素。然后语音识别器将分析音素的顺序、模式和上下文,以生成一个完整是句子。这往往会产生一定的延迟,因为软件需要对您说的内容做出最佳猜测。谷歌的人工智能团队在帖子中表示,他们的模型“在你说话的时候逐个输出字符,并在适当的地方是用空格。” 换句话说,Gboard会识别您说出的单词中的单个字母,而不是识别音素。

目前,Gboard更新仅适用于美式英语和Pixel手机。谷歌的AI团队可能会在未来扩展更新,支持更多的语言和设备。
相关文章
- 谷歌推出全新 Gemini 3.8 Flash 模型:性能再升级,成本或将上涨
- 尚贤科技SX-Creval外贸独立站搭建,海量型号库,获取谷歌精准流量
- 谷歌 AI 核心管理层迎来重大调整,负责人戴密斯·哈萨比斯卸任
- 谷歌 DeepMind 推出新一代 AI 模型,能够操控机器人的全身躯体
- 英伟达与微软牵头成立开放AI安全联盟,OpenAI、谷歌及Anthropic均未加入
- 谷歌携手联发科打造下一代TPUv9芯片,将CPU与计算晶粒合封于一体,助力AI智能体发展
- 谷歌投资A24,共同开发人工智能电影制作工具
- 数据中心耗电远超电网负荷,迫使英伟达与谷歌在2026年第三季度前启动800V直流电架构改造
- 苹果和谷歌新增对Thread 1.4的支持
- 宜选科技出席2026谷歌合作伙伴峰会
- 苹果在新版Siri上作出妥协:依靠英伟达B200 GPU加密技术,防止谷歌窃取用户数据
- 谷歌Beam抢滩多人会议全息赛道,微美全息以AI+5G解锁虚实融合视觉新想象
- Google I/O 2026亮点回顾:晶晨股份携手谷歌共拓端侧AI新生态
- 谷歌搜索的人工智能进化包含更多广告
- 谷歌的未来是一个无所不能的搜索框
- Google I/O 2026:Gemini 将成为谷歌年度开发者大会的主角
AI企业
更多>>AI硬件
更多>>- 努比亚NaviX Ultra定档9月16日,全球首款AI智能体手机即将上市
- BOE(京东方)新一代TSF广色域显示技术斩获德国IFA 2026金奖 重塑OLED柔性显示画质性能新标准
- 元点机器人卖出了1000台具身智能,“8888元+高性能”引发行业热议
- 联合开源!因时机器人携手上海交大、复旦发布HandEdit数据集与评测基准
- 华沿机器人与骅升科技达成战略合作,携手布局具身智能与协作机器人市场
- 元点机器人Bridge斩获IFA年度创新奖,全球首款AI原生人形机器人柏林首秀
- 华硕 ProArt 创梦 27 OLED:以 4K QD-OLED 与专业色彩表现,支持精细化创作
- 芯展速 Gen 6 Retimer 正式上市,副总裁李蓁 ODCC大会演讲官宣 获媒体热议
AI产业
更多>>AI技术
更多>>- 全球最强开源模型 Kimi K3 发布,参数规模 3 万亿,真的是强!
- 范式变革!东软发布AI原生软件工程白皮书,重构软件产业底层逻辑
- KAT-Coder-Pro V2.5正式发布:从“写代码”迈向“做工程”,Agentic能力全面升级
- 自变量机器人王昊:训练世界模型需付出“时间税”,解决模态对齐是当务之急
- 腾讯发布CodeBuddy Security,用AI Agent实现更高效的代码审计
- Twinkle x昇腾,率先实现Deepseek-V4系列模型高效训练
- 高德发布鸿蒙首个生成式 UI 开源框架 AGenUI,告别传统 UI 开发模式
- 发布即适配| 天数智芯全力支持腾讯混元Hy3 preview 开源落地,共推国内大模型产业普惠









