亚马逊研究人员训练AI重写查询以更好地理解口语
2020/03/18 12:11AI云资讯10846
听说过查询重写吗?这是一种用于减轻口语理解(SLU)管道中的错误的技术,例如支持Amazon的Alexa,Google Assistant,Apple的Siri和其他语音助手的管道。许多SLU系统分为两个部分:负责将音频转换为文本的自动语音识别(ASR)系统,以及从结果摘要中提取含义的自然语言理解组件(NLU),而且每个问题都会带来错误(例如,由于背景噪音和说话者口音造成的文字识别错误)会累积并引起会话摩擦。

幸运的是,查询重写已在生产系统中显示出令人鼓舞的结果;它需要记录本并重写,然后再将其发送到下游NLU系统。这可能就是为什么Drexel大学和Amazon的研究人员在预印本纸上研究了一种方法,该方法使用AI用重新构造的查询代替原始查询。
团队的系统使用经过训练的模型来从查询中捕获潜在的句法和语义信息,从而选择最相关的候选项作为查询的重写。给定输入查询,嵌入器模块通过将查询输入预先训练的上下文词模型中来提取表示形式。然后将该表示形式合并为查询级别的数学表示形式(嵌入),此时将使用一种机制来测量两个查询的相似性。数百万索引的原始查询和重写来自从Alexa的历史数据中选择的一组预定义的高精度重写对,而最相关的是由系统按需检索。
研究人员指出:“ SLU系统中的NLU组件为查询提供了半结构化的语义表示,其中可以通过相同的NLU假设将各种文本形式但具有相同语义的查询组合在一起。”“例如,'请您播放想象中的巨龙','打开想象中的巨龙'[和]'播放想象中的巨龙的歌曲'具有相同的语义和相同的NLU假设,但是它们的文字不同。直观地讲,使用噪声较小的NLU假设来扩充查询文本可能会有所帮助。”
为了训练该系统,该团队构建了两个数据集:一个用于预训练话语嵌入,另一个用于微调预训练的模型。预训练集包括1100万个会话,涉及约3000万话语,而微调集(使用现有的重新短语检测模型管道生成)具有220万对话语。
研究人员通过在16,000对带注释的测试集中,将检索到的重写候选的NLU假设与实际的NLU假设进行比较,从而评估了查询重写性能。对于每个给定的查询,他们检索了前20个重写,并且使用重写的NLU假设通过标准信息检索指标来测量系统性能。
该团队报告说,预训练不仅显着减少了对高质量查询检索训练对的需求,而且“显着”提高了性能。他们写道:“尽管我们在本文中专注于QR任务的预训练,但我们认为类似的策略可能会应用于NLU中的其他任务,” [例如]域分类。
相关文章
- 一架亚马逊货机在迈阿密国际机场坠毁
- 出海包裹容易丢?三态速递适配亚马逊FBM 全链路服务,物流可追踪降低履约风险
- 从亚马逊AWD入仓规则调整,看AI智能硬件出海的供应链重构
- 亚马逊拟于2028年推出全球卫星手机网络
- AI 时代的统一多云监控:ManageEngine 卓豪ITOM参加2026年亚马逊云科技中国峰会
- 合合信息一季度财报营收同比增27.53%,联手亚马逊云科技落地多模态文档智能体
- 一句话完成合同审批全流程,合合信息联合亚马逊云科技打造多模态文档智能体
- 中科天机国际版上线,登上亚马逊提供全球高精度气象数据
- 亚马逊数据中心公布2025年水消耗量为946万吨
- 亚马逊发布Proteus智能机器人,自动化升级伴随大规模裁员潮
- 亚马逊250亿加盟豪掷Anthropic,微美全息深耕Agent与AIGC赛道拓版图!
- 亚马逊以115亿美元收购全球星公司,苹果却成为这场交易的赢家
- 卖家精灵火热亮相福州跨交会,展示亚马逊+TikTok双平台解决方案!
- 全球首创双目技术加持,MOVA ViAX登顶亚马逊智能割草机销量榜首
- OpenAI宣布获得亚马逊、英伟达和软银新融资1100亿美元
- 亚马逊广告发布2026年全球营销趋势洞察
AI企业
更多>>AI硬件
更多>>AI产业
更多>>AI技术
更多>>- 全球最强开源模型 Kimi K3 发布,参数规模 3 万亿,真的是强!
- 范式变革!东软发布AI原生软件工程白皮书,重构软件产业底层逻辑
- KAT-Coder-Pro V2.5正式发布:从“写代码”迈向“做工程”,Agentic能力全面升级
- 自变量机器人王昊:训练世界模型需付出“时间税”,解决模态对齐是当务之急
- 腾讯发布CodeBuddy Security,用AI Agent实现更高效的代码审计
- Twinkle x昇腾,率先实现Deepseek-V4系列模型高效训练
- 高德发布鸿蒙首个生成式 UI 开源框架 AGenUI,告别传统 UI 开发模式
- 发布即适配| 天数智芯全力支持腾讯混元Hy3 preview 开源落地,共推国内大模型产业普惠









