Compose 神经网络可以帮你写 Gmail 谷歌 Smart 邮件了 (composition)

文章编号:46614 资讯动态 2024-12-10 谷歌 Smart Compose gmail邮箱

雷锋网 AI 科技评论按 :在 Google I/O 2018 上,除了 Google 助手给餐馆打电话的场景赢得现场观众的喝彩外,在用户写邮件时可预测下一句的 Smart Compose 技术同样也引得众人欢呼。近期,谷歌大脑团队首席软件工程师 Yonghui Wu 在 Google AI Po 出了这篇详细介绍 Smart Compose 原理的博文,雷锋网 AI 科技评论将其内容编译如下。

Google I/O 2018 上,谷歌介绍了 Gmail 中的一项新特性,智能预测拼写功能:Smart Compose,该新特性利用机器学习,交互式地为正在写邮件的用户提供补全句子的预测建议,从而让用户更快地撰写邮件。Smart Compose 基于此前智能回复(Smart Reply)技术开发而来,Smart Compose 提供了全新的方式来帮助用户撰写邮件,无论用户是在回一封来件还是从草稿箱起草一封新邮件。

谷歌 Smart Compose:神经网络可以帮你写 Gmail 邮件了

谷歌在开发 Smart Compose 的过程中,遭遇到了以下这些关键挑战:

找到对的模型

比如 ngram,neural bag-of-words(BoW)和 RNN language 这种典型的语言生成模型,它们是基于前缀词序列来预测下一个词的。然而,在一封邮件中,用户在当前邮件撰写会话中打下的单词会给模型一个信号,模型会利用该信号来预测下一个单词。为了结合更多用户想表达的上下文,谷歌的模型还会利用邮件主题和此前的邮件正文(假设用户正在回复一封刚刚收到的邮件)。

谷歌的方法是包含利用额外语境的一个方法,该方法是将问题转换成一个序列到序列(seq2seq)的机器翻译任务,其中源序列是邮件主题和上封邮件正文(假设存在上封邮件)的串联,用户正在写的邮件是目标序列。尽管该方法在预测质量上表现良好,但它的延迟要比谷歌严苛的延迟标准超出了好几个量级

为了提高预测质量,谷歌将一个 RNN-LM 神经网络与一个 BoW 模型结合起来,结合后的模型在速度上比 seq2seq 模型要快,且只轻微牺牲了预测质量。在该混合算法中,谷歌通过把词嵌套们平均分配在每个区域内,来对邮件主题和此前的邮件内容进行编码。随后谷歌将这些平均分配后的嵌套连接在一起,并在每次执行解码步骤时将它们提供给目标序列 RNN-LM,过程如下面的模型图解。

谷歌 Smart Compose:神经网络可以帮你写 Gmail 邮件了

Smart Compose RNN-LM 模型架构。将邮件主题和此前邮件信息进行编码,采用的方法是将它们的词嵌套平均分配在每一个区域内。随后,平均后的嵌套会在每次执行解码步骤时提供给目标序列 RNN-LM。

加速模型训练和服务

当然,一旦选定了这种建模方法,谷歌就必须调整各种模型超参数和使用超过数十亿的样本来训练这些模型,所有的这些操作都相当费时。为了实现加速,谷歌使用了一个完整 TPUv2 Pod 来执行实验。在这情况下,谷歌能够在一天之内将一个模型训练至收敛状态。

在谷歌训练出速度上更快的混合模型之后,初始版本的 Smart Compose 在一个标准 cpu 上运行时,依旧存在几百毫秒的平均服务延迟,这与 Smart Compose 努力预测语句来帮用户节省时间的特点是不相符的。幸运的是,谷歌可在推断期间使用 TPU 来大大地加速用户体验,通过分流 TPU 之上的大部分计算,谷歌可以将平均延迟改良至几十毫秒,同时也能大大增加单一机器可处理的服务请求数量。

公平性和隐私

由于语言理解模型会反映人类的认知偏倚,这样会导致得到多余的词汇联想和句子完成建议,所以在机器学习内实现公平至关重要。Caliskan et al. 在他们近期的「Semantics derived automatically from language corpora contain human-like biases」论文中指出,模型的词联想深陷于自然语言数据的偏倚数据中,这为打造任何一个语言模型都带来了相当的挑战。在模型训练过程中,谷歌积极地寻找方法来持续降低潜在的偏倚。另外,由于 Smart Compose 是基于数十亿的短语和句子进行训练,这与废品邮件机器学习模型的训练方法一致,谷歌已经进行了广泛的测试来确保,模型只记忆多种用户都使用的常识语句,关于常识语句的调查结果源自这篇论文 The Secret Sharer: Measuring Unintended Neural Network Memorization & Extracting Secrets()。

未来研究

谷歌将持续地研究改良语言生成模型的预测质量,为此谷歌会通过使用最先进的构架(如 Transformer,RNMT+等)和试用最新、最先进的训练技术来实现这一目标。一旦模型的实验结果满足了谷歌的严格延迟约束条件,谷歌就会把这些更加的先进模型部署到自家产品上去。另外,谷歌还在进行结合个人语言模型的研究,该模型的目的是给系统增加一个新特性,让它能够更加准确地模拟每个用户自己的写作风格。

via Google AI Blog,雷锋网 AI 科技评论编译。

原创文章,未经授权禁止转载。详情见 转载须知 。

谷歌 Smart Compose:神经网络可以帮你写 Gmail 邮件了


本文地址: https://www.gpxz.com/article/9cb3fb9121733de98dac.html
全局中部横幅
全局中部横幅
腾讯网

腾讯网从2003年创立至今,已经成为集新闻信息,区域垂直生活服务、社会化媒体资讯和产品为一体的互联网媒体平台。腾讯网下设新闻、科技、财经、娱乐、体育、汽车、时尚等多个频道,充分满足用户对不同类型资讯的需求。同时专注不同领域内容,打造精品栏目,并顺应技术发展趋势,推出网络直播等创新形式,改变了用户获取资讯的方式和习惯。

公务员考试

【华图国家公务员考试网】提供2026国家公务员考试,2026国考公告、2026省考公告、国考报名时间/入口/职位表、2026省公务员考试、公务员笔试面试培训等公务员招考公告/大纲,成绩查询,笔试面试备考辅导资料,公考视频,历年试题及答案下载等公务员考试辅导培训机构。

首页

明嘉靖四十三年,在北京城西南取“安定、安宁”之祥意,建右安门,以护城市的安康。建国初期,彭真市长亲临右安门外,规划始建北京第二传染病医院,其建筑规模与学科设置均为亚洲之首。1989年更名为北京佑安医院。首都医科大学附属北京佑安医院是一家以感染、传染及急、慢性相关性疾病群体为主要服务对象和重点学科,集预防、医疗、保健、康复为一体的大型综合性医学中心。

四川锐孚制冷工程有限公司

业务涉及冰箱、冷冻、空调设备及配件的批发和销售,高低温试验箱、冷库工程、中央空调工程的设计和安装。根据市场竞争的需求,更好的为西部地区广大用户服务业务涉及冰箱、冷冻、空调设备及配件的批发和销售,高低温试验箱、冷库工程、中央空调工程的设计和安装。根据市场竞争的需求,更好的为西部地区广大用户服务.

西门子电动调节阀报价

山东威克多阀门制造有限公司是一家主营西门子温度调节阀、西门子调节流量调节阀、西门子电动二通三通调节阀、温控阀、电动球阀、电动蝶阀、电动调节阀、蒸汽调节阀、西门子电动阀门执行器、电动调节流量调节阀等多种西门子调节阀的电动调节阀生产厂家。我们为您提供电动调节阀原理及作用的科普,电动调节阀型号规格齐全,西门子执行器型号齐全。电动调节阀厂家哪家好?欢迎致电我司咨询15864155248。

男士发型女士发型

美容美发网提供2024年流行发型,包括男士发型,女士发型,长发短发的发型设计,有丰富的发型图片供你参考。

四川富泰盛安建设工程有限公司

四川富泰盛安建设工程有限公司是一家从事建设工程施工,建设工程设计,建筑劳务分包等业务的公司,成立于2023年2月28日,公司坐落遂宁市蓬溪县赤城镇锦阳路164号(玉福苑安置房)12幢1楼5号。   公司主要经营建设工程施工、建设工程设计、建筑劳务分包、住宅室内装饰装修、工程管理服务、建筑材料销售、建筑用钢筋产品销售、农副产品销售、涂料销售(不含危险化学品)、五金产品批发、土石方工程施工等。

重庆市兆巍矿山机电制造有限公司

重庆市兆巍矿山机电制造有限公司专业从事煤矿安全技术研究、产品开发、生产和技术服务的股份制有限公司。公司成立于2000年,位于重庆市九龙坡区,厂区建筑面积10000㎡,其中生产车间约6000㎡,有包括TX68镗床、车床、磨床、铣床、摩擦焊机及C0

常州二建建设有限公司

常州二建建设有限公司成立于1953年,是常州地区具有影响力的骨干施工企业。公司具有施工总承包壹级资质和机电设备安装专业承包壹级以及建筑装修装饰专业承包贰级、钢结构工程专业承包贰级、消防设施工程专业承包贰级、起重设备安装工程专业承包贰级等专业资质。

深圳市骏亿腾科技有限公司

第一PPT模板网提供各类PPT模板免费下载,PPT背景图,PPT素材,PPT背景,免费PPT模板下载,PPT图表,精美PPT下载,PPT课件下载,PPT背景图片免费下载;

品味电商,乐享生活

爱店网作为一家专注于电子商务行业的在线平台,我们致力于为您提供全面、及时、有价值的电商资讯和信息。


全局底部横幅