首页 > 文档 > 学术/知识/论文 > IT/计算机/信息技术 > 计算机软件及计算机应用

基于可控性解释的混合数据增强框架

2024-06-23 1130 2.88M 0

　　先前的预训练语言模型已在众多自然语言理解任务中展现了其卓越的性能.然而,它们常常表现出捷径学习的问题,即学习了非鲁棒性特征与标签之间的虚假关联,导致模型在不同于训练分布的测试场景中的泛化能力不佳.近期,生成式预训练大模型在理解任务中的出色表现引起了广泛的关注,但它们是否受到捷径学习的影响尚未被充分研究.本文以LLaMA系列模型与FLAN-T5模型为代表,首次探究了生成式预训练大模型在多个自然语言理解任务中的捷径学习现象.研究结果表明,近期流行的生成式大模型仍然存在捷径学习的问题.进而,本文提出了针对生成式预训练大模型的捷径学习问题的缓解策略——基于可控性解释的混合数据增强框架.该框架以数据为中心,基于模型生成的可控性解释数据与部分原始提示性数据构造小规模混合数据集,开展模型微调.在三个具有代表性的自然语言理解任务中的大量实验结果表明,使用该框架所构造的数据集训练模型能够有效缓解模型的捷径学习问题,提升模型在分布外测试场景中的鲁棒性与泛化能力,同时不牺牲甚至提升模型在分布内测试场景中的性能.本文代码已公开发布在https://github.com/Mint9996/HEDA.

您还没有登录，请登录后查看详情

捷径学习生成式预训练语言模型自然语言理解

下一篇：分蘖洋葱伴生番茄诱导的根际微生物对根结线虫病的影响
上一篇：无锁并发布谷鸟过滤器

1/26专辑：论文下载

1.5M双S弯排气系统雷达吸波涂层应用的仿真计算

1.24M短距起飞/垂直降落飞机升力系统研究进展

1.84M航空涡扇发动机机械系统架构和技术综述

1.41M基于Noradamantane的高能量密度富氮笼型含能分子设计与性能预估

0.49M一种视/触觉融合的柔性物体抓取力估计方法

1.18M构建与新发展阶段相适应的现代化意识形态

1.16M猕猴桃叶水浸提液对4种植物化感作用及其化学成分分析

0.71M基于完全但不完美信息序贯博弈计量模型的农地流转影响因素

0.83M病原学送检管理的相关信息化建设要求

0.85M基于非线性加权法的航空发动机总体性能优化设计

1.42M鹅不食草药材倍半萜内酯类特征图谱的建立及多成分定量研究

0.83MGaR视角下海洋产业结构升级、科技创新与海洋经济高质量发展

0.51M经济发展阶段、要素条件变化与区域产业演化路径：后发国家视角

1.56M分离纯化对银耳多糖结构及体外降脂活性的影响

0.59M现代化产业体系绩效测度与区域差异研究——基于江苏与相关省市数据样本分析视角

0.59M“一带一路”背景下柬埔寨海岸带管理体系研究

0.89M中国海洋经济高质量发展的时空差异及影响因素研究

1.16M碳酸钙处理工业废硫酸的硫酸钙结晶与过滤性能研究

0.83M非结核分枝杆菌病诊治六十年

7.87M厚朴酚、和厚朴酚对脂多糖诱导小鼠肠道损伤的抗炎作用及机制研究

1.83MALVE的筛查整合及其对坝上长尾鸡生产性能的影响

1.57M高比例植物蛋白对青鱼幼鱼生长、消化、肝功能及血清生化指标的影响

1.82M絮凝技术在毕赤酵母发酵液固液分离中的应用研究

1.72M黔西南州不同饲草品种生产性能及营养品质的综合评价

5.88M射干不同部位总三萜提取工艺优化及其抗氧化活性分析

10.22M英格兰保护区城市设计控制制度对中国历史文化街区保护更新的启示

点赞 0举报收藏 0打赏 0评论 0

虚交所
加关注9
~~虚拟资产交易平台~~

相关文档

	双S弯排气系统雷达吸波涂层应用的仿真计算
	短距起飞/垂直降落飞机升力系统研究进展
	航空涡扇发动机机械系统架构和技术综述
	基于Noradamantane的高能量密度富氮笼型含能分子设计与性能预估
	一种视/触觉融合的柔性物体抓取力估计方法
	构建与新发展阶段相适应的现代化意识形态
	猕猴桃叶水浸提液对4种植物化感作用及其化学成分分析
	基于完全但不完美信息序贯博弈计量模型的农地流转影响因素
	病原学送检管理的相关信息化建设要求
	基于非线性加权法的航空发动机总体性能优化设计

本类推荐

	基于能量理论的通用信息抽取框架
	基于Delphi+AHP+FCE的公立医院智慧药房绩效考核指标体系的构建及评价
	面向知识图谱补全的大模型方法综述
	基于多尺度特征融合与矫正的渐进式深度图超分辨率重建
	RC-PBFT: 一种基于信誉分组的改进PBFT算法
	基于细节增强与多尺度特征融合的水下目标检测
	大语言模型与知识图谱协同增强知识组织理论架构研究
	基于注意力的双学生知识蒸馏异常检测方法
	第一类投毒攻击及其特征分析
	道路环境感知的联合特征学习框架

下载排行