【ACL2024】阿里云人工智能平台PAI多篇论文入选ACL2024

本文涉及的产品
模型训练 PAI-DLC,5000CU*H 3个月
交互式建模 PAI-DSW,5000CU*H 3个月
模型在线服务 PAI-EAS,A10/V100等 500元 1个月
简介: 近期,阿里云人工智能平台PAI的多篇论文在ACL2024上入选。论文成果是阿里云与阿里集团安全部、华南理工大学金连文教授团队、华东师范大学何晓丰教授团队共同研发。ACL(国际计算语言学年会)是人工智能自然语言处理领域的顶级国际会议,聚焦于自然语言处理技术在各个应用场景的学术研究。该会议曾推动了预训练语言模型、文本挖掘、对话系统、机器翻译等自然语言处理领域的核心创新,在学术和工业界都有巨大的影响力。此次入选标志着阿里云人工智能平台PAI在自然语言处理和多模态算法、算法框架能力方面研究获得了学术界认可。

近期,阿里云人工智能平台PAI的多篇论文在ACL2024上入选。论文成果是阿里云与阿里集团安全部、华南理工大学金连文教授团队、华东师范大学何晓丰教授团队共同研发。ACL(国际计算语言学年会)是人工智能自然语言处理领域的顶级国际会议,聚焦于自然语言处理技术在各个应用场景的学术研究。该会议曾推动了预训练语言模型、文本挖掘、对话系统、机器翻译等自然语言处理领域的核心创新,在学术和工业界都有巨大的影响力。此次入选标志着阿里云人工智能平台PAI在自然语言处理和多模态算法、算法框架能力方面研究获得了学术界认可。


论文简述

PAI-Diffusion中文开源文图生成模型系列及云上推理服务

在过去几年中,Stable Diffusion类文图生成模型在AIGC领域崭露头角。阿里云人工智能PAI团队参考了Stable Diffusion的模型结构,结合中文语言的特点,通过对中文预训练数据的处理和过滤,以及训练过程的优化,提出了PAI-Diffusion系列中文文图生成模型,实现了图像生成质量的大幅提升和风格多样化。在这一工作中,PAI-Diffusion系列一共12个中文模型(包括基础模型、LoRA、ControlNet等)全部开源,与开发者一起共同推动AI生成内容技术的发展,创造出更有创意和影响力的作品。这一工作还包括了两个PAI-Diffusion模型的推理工具。其中,Chinese SD WebUI是Stable Diffusion WebUI的插件,用于零代码的方式生成用户所需的图像;Diffusers-API通过API调用的方式,支持支持中文模型的在线部署。详细工作介绍参见论文技术博客。上述工作也将在ACL 2024会议上进行展示。

image.png

面向Stable Station的交互式多轮Prompt生成模型DiffChat

基于扩散模型的文图生成模型(例如Stable Diffusion)的效果有时会受到输入文本即提示词撰写的影响。当用户对创作的图像有特定需求或者希望执行特定的内容修改时,通常需要进行反复多次的提示词修改,且每次尝试的结果都是不可预期的。 这造成了不可忽略的时间和计算资源的耗费。基于这一问题,我们提出了DiffChat,这是一个文到文的多轮生成模型,可以根据用户的需求指令对原始提示词进行适当的修改,得到新的提示词来使得文到图生成模型能够生成更美观且符合指令的图像。整个过程做到了用户和文图生成模型的迭代交互,最终完成用户的创作需求。

image.png

该方法首先通过提示词美化和提示词工程的方法建立了一个和该任务高度相关的数据集。 然后,在执行有监督微调训练后,为了进一步提升模型性能,该方法提出了一种带有美学、人类偏好和内容完整度反馈的强化学习技术来进一步优化模型。同时,该方法还提出了动作空间动态修正和基于内容完整度的状态价值估计两项技术进行额外改进。实验结果表明,该方法显著优于一些具有竞争力的同类方法。

image.png

长尾知识对检索增强大语言模型的作用

检索增强生成(retrieval-augmented generation,RAG)通过检索与用户查询相关的文档,在提升大型语言模型(large language models,LLM)的知识能力方面表现出优异的性能。然而,RAG只关注通过不加区分地使用检索到的信息增强查询来提高LLM的响应质量,很少关注LLM真正需要什么类型的知识来更准确地回答原始查询。在本文中,我们认为长尾知识对RAG是至关重要的,因为LLM在大规模的预训练的时候已经记住了通用高频的世界知识。在此基础上,提出了一种简单有效的长尾知识检测方法。具体地说,本文提出了一种新的基于统计和语义的生成性期望校准误差(GECE)度量方法来度量知识的“长尾性”。因此,只有当输入查询涉及长尾知识时,我们才检索相关文档并将其注入到大模型中。实验结果表明,与现有的RAG方法相比,该方法在平均推理时间上实现了4倍以上的加速,在下游任务上性能得到了一致的提高。

image.png

具体来说,pred和ref分别表示生成的文本和模型任务的标准结果。M(pred, ref)是模型对应的METEOR score度量结果。平均token概率中的P(ti)表示由LLM产生的第i个token的概率,n是token序列长度。对于分母部分,α是平均词频。我们可以看到,长尾实例的α值较小,因此其倒数将较大。另外,▽ins是当前实例的梯度,E(▽ins)是整个数据集的平均梯度。为了获得梯度,我们仅通过使用数据集微调LLM来运行前向和后向梯度传递。我们可以看到,与数据集的平均得分相比,长尾实例具有更小的梯度▽ins,从而获得更小的点积E(▽ins)·▽ins。

image.png

面向大语言模型的知识编辑算法DAFNet

近年来,大型语言模型(LLM)虽然取得了令人印象深刻的研究成果,但仍存在幻觉现象,即产生虚假信息。模型编辑是修复LLMs中事实错误的任务;然而,以往的工作大多将其视为一次性编辑任务,很少关注LLM产生的不断出现的错误。我们解决了顺序模型编辑(SME)的任务,旨在不断纠正错误。设计了一种动态辅助融合网络(DAFNet),以增强整个序列中事实知识之间的语义交互,防止多知识三元组编辑过程中的灾难性遗忘。

image.png

具体来说,(1) 对于关系三元组内的语义融合,我们在LLMs中将编辑内的注意流聚合为具有标记级粒度的自回归自注意力。我们进一步利用多层对角互编辑注意力流更新整个序列级粒度的加权表示。(2) 考虑到序列编辑需要辅助参数来存储知识,我们构造了一个新的数据集DAFSet,实现了最近性、流行性、长尾性和鲁棒性,增强了序列编辑的通用性。实验结果表明,DAFNet在单轮编辑和顺序编辑中均显著优于强基线。DAFSet的使用还不断提高了其他基于辅助网络的方法在各种场景中的性能。

image.png

产品化服务

上述科研成果也在人工智能平台PAI的各个模块进行了深度的集成和整合,持续为PAI客户提供AI模型训练和推理相关服务。其中,Chinese SD WebUI作为Stable Diffusion WebUI的插件与PAI-EAS无缝兼容,支持5分钟内一键在PAI-EAS拉起中文AIGC应用。Diffusers-API与PAI-EAS进行融合,使客户更加容易在云上部署各类文图生成大模型,用于生产环境的实时调用。此外,PAI-QuickStart集成了超过50个热门大语言模型,及其多种训练和推理方式,使客户更加简单地微调和部署大语言模型。在未来,我们也将在PAI平台上持续提供业界领先的算法和模型能力给广大客户。

论文汇总

论文名字:PAI-Diffusion: Constructing and Serving a Family of Open Chinese Diffusion Models for Text-to-image Synthesis on the Cloud
论文作者:汪诚愚、段忠杰、刘冰雁、邹心怡、陈岑、贾奎、黄俊

论文pdf链接:https://arxiv.org/abs/2309.05534


论文名字:DiffChat: Learning to Chat with Text-to-Image Synthesis Models for Interactive Image Creation
论文作者:汪嘉鹏、汪诚愚、曹庭锋、黄俊、金连文
论文pdf链接:https://arxiv.org/abs/2403.04997


论文名字:On the Role of Long-tail Knowledge in Retrieval Augmented Large Language Models
论文作者:李东阳、严俊冰、张涛林、汪诚愚、何晓丰、黄龙涛、薛晖、黄俊

论文pdf链接:https://arxiv.org/pdf/2406.16367


论文名字:DAFNet: Dynamic Auxiliary Fusion for Sequential Model Editing in Large Language Models
论文作者:张涛林、陈颀周、李东阳、汪诚愚、何晓丰、黄龙涛、薛晖、黄俊

论文pdf链接:https://arxiv.org/abs/2405.20588



阿里云人工智能平台PAI长期招聘研究实习生。团队专注于深度学习算法研究与应用,重点聚焦大语言模型和多模态AIGC大模型的应用算法研究和应用。简历投递和咨询:chengyu.wcy@alibaba-i

相关实践学习
使用PAI-EAS一键部署ChatGLM及LangChain应用
本场景中主要介绍如何使用模型在线服务(PAI-EAS)部署ChatGLM的AI-Web应用以及启动WebUI进行模型推理,并通过LangChain集成自己的业务数据。
机器学习概览及常见算法
机器学习(Machine Learning, ML)是人工智能的核心,专门研究计算机怎样模拟或实现人类的学习行为,以获取新的知识或技能,重新组织已有的知识结构使之不断改善自身的性能,它是使计算机具有智能的根本途径,其应用遍及人工智能的各个领域。 本课程将带你入门机器学习,掌握机器学习的概念和常用的算法。
相关文章
|
27天前
|
机器学习/深度学习 人工智能 弹性计算
阿里云AI服务器价格表_GPU服务器租赁费用_AI人工智能高性能计算推理
阿里云AI服务器提供多样化的选择,包括CPU+GPU、CPU+FPGA等多种配置,适用于人工智能、机器学习和深度学习等计算密集型任务。其中,GPU服务器整合高性能CPU平台,单实例可实现最高5PFLOPS的混合精度计算能力。根据不同GPU类型(如NVIDIA A10、V100、T4等)和应用场景(如AI训练、推理、科学计算等),价格从数百到数千元不等。详情及更多实例规格可见阿里云官方页面。
105 1
|
2月前
|
数据采集 人工智能 自然语言处理
阿里云百炼平台深度体验:智能问答与模型训练的创新之旅
在人工智能的浪潮中,阿里云百炼平台以其强大的大模型开发能力,为企业和个人开发者提供了一站式的解决方案。本文将从知识检索应用搭建、模型训练调优以及流程管理功能三个角度,全面评测阿里云百炼平台的实际使用体验。
211 3
|
29天前
|
机器学习/深度学习 存储 缓存
Java本地高性能缓存实践问题之阿里云机器学习团队开源社区的问题如何解决
Java本地高性能缓存实践问题之阿里云机器学习团队开源社区的问题如何解决
|
1月前
|
机器学习/深度学习 存储 缓存
模型遇见知识图谱问题之参与阿里云机器学习团队的开源社区的问题如何解决
模型遇见知识图谱问题之参与阿里云机器学习团队的开源社区的问题如何解决
|
1月前
|
机器学习/深度学习 数据采集 自然语言处理
【NLP】讯飞英文学术论文分类挑战赛Top10开源多方案–4 机器学习LGB 方案
在讯飞英文学术论文分类挑战赛中使用LightGBM模型进行文本分类的方案,包括数据预处理、特征提取、模型训练及多折交叉验证等步骤,并提供了相关的代码实现。
25 0
|
11天前
|
机器学习/深度学习 人工智能 自然语言处理
探索人工智能:从基础理论到实践应用
【8月更文挑战第39天】在本文中,我们将深入探讨人工智能(AI)的基本概念、发展历程以及其在现实世界中的应用。我们将首先介绍AI的定义和主要分类,然后回顾其发展历史,最后通过一个实际的代码示例来展示AI的应用。无论你是AI领域的初学者还是有一定基础的学习者,这篇文章都将为你提供有价值的信息和启示。
|
2天前
|
机器学习/深度学习 人工智能 自然语言处理
人工智能在教育中的创新应用:个性化学习的未来
【9月更文挑战第18天】人工智能在教育中的创新应用正在深刻改变着我们的教学方式和学习体验。从个性化学习方案的制定到智能化辅导与反馈,从多元化学习资源的推荐到自动化评分与智能考试系统,AI技术正在为教育领域带来前所未有的变革。面对这一变革,我们需要以开放和批判的态度拥抱它,共同探索AI时代教育的无限可能,为每一个学习者创造更美好的未来。
36 12
|
2天前
|
数据采集 人工智能 自然语言处理
探索软件测试中的人工智能应用
在当今快速发展的技术世界中,软件测试作为确保软件质量的关键环节,正经历着前所未有的变革。随着人工智能技术的不断成熟和应用,其在软件测试领域的潜力逐渐显现,为提升测试效率、准确性和自动化水平提供了新的可能性。本文将深入探讨人工智能在软件测试中的应用现状、面临的挑战以及未来的发展趋势,旨在为读者提供一个关于AI如何改变软件测试行业的全面视角。
|
2天前
|
机器学习/深度学习 存储 人工智能
深度学习中的模型压缩技术在人工智能领域,深度学习技术的迅猛发展带来了巨大的计算资源需求。为了解决这一问题,模型压缩技术应运而生。本文将介绍什么是模型压缩、常见的模型压缩方法以及其在实际应用中的意义。
随着深度学习技术的广泛应用,计算资源的需求也大幅增加。为减少资源消耗,提升模型效率,模型压缩技术成为研究热点。本文探讨了模型压缩的定义、主流方法和其重要性。通过量化、剪枝、知识蒸馏和轻量级架构等策略,模型得以在保持性能的同时减小体积,从而适用于资源受限的环境。这些技术不仅降低了计算成本,还推动了深度学习在移动设备和边缘计算等领域的应用,使AI技术更加普及和实用。总之,模型压缩在平衡模型性能与资源消耗之间发挥着关键作用,是未来AI发展的重要方向。

相关产品

  • 人工智能平台 PAI