基于强化学习的数据交易四方演化博弈研究——数据安全视角

来源 :中南财经政法大学 | 被引量 : 0次 | 上传用户:ivyjiawx
下载到本地 , 更方便阅读
声明 : 本文档内容版权归属内容提供方 , 如果您对本文有版权争议 , 可与客服联系进行内容授权或下架
论文部分内容阅读
随着大数据时代的到来,数据资源的价值逐渐受到关注与认可,人们对于数据交易的需求也在日益增加。然而,我国目前的数据交易仍面临着诸多问题,其中,数据交易过程中的数据安全问题是重中之重。类似于传统的商品交易,数据交易也是多方参与主体相互促进、相互制约的演化博弈过程。因此,本文从数据安全角度出发,展开对数据交易四方参与主体的演化博弈研究。本文基于数据安全角度,首先,结合数据交易的发展现状和现有研究,将政府、数据交易平台、数据购买者以及数据供应者作为研究对象,分析各个参与主体在数据交易过程中的角色定位与利益诉求;其次,利用演化博弈理论,构建数据交易四方演化博弈模型,对参与主体进行复制动态分析与均衡稳定分析;再次,鉴于系统的复杂性与博弈的动态性,结合系统动力学方法,建立数据交易四方演化博弈SD模型并进行模拟仿真,探究各方初始策略与关键因素对数据交易演化稳定趋势的影响;最后,针对演化博弈SD模型中存在的问题,基于多智能体强化学习理论,构建了基于Q-Learning的演化博弈改进模型,并提出一种负反馈惩罚机制,以改善数据交易中参与主体的演化博弈结果。研究表明:(1)数据交易是涉及政府、数据购买者、数据交易平台以及数据供应者等多方参与主体的复杂系统,数据交易的发展及数据安全的实现是参与主体相互制约、反复博弈的结果;(2)各个参与主体的初始策略选择都不同程度地影响数据交易演化的稳定趋势。在收益固定的情况下,如果某一参与主体以较高的初始概率选择积极策略进行数据交易,那么其他主体通过对自身的策略选择进行调整与优化,在确保自身收益最优的前提下也会选择积极策略,最终数据交易四方演化博弈达到稳定状态。(3)数据交易中的收益、成本、损失、声誉、惩罚是影响四方策略选择的重要因素,增加收益、降低成本、合理设置奖惩力度以及降低额外损失是调动四方主体进行数据交易并保障数据安全积极性的重要举措。(4)在不同的负反馈系数下,基于Q-Learning的演化博弈改进模型可以有效地改善数据交易参与主体的演化路径,从而促进数据交易的良性发展。
其他文献
在信息过载的当前互联网环境下,用户获取有价值信息的信息成本越来越高,为了解决这一问题,推荐系统(Recommendation System,RS)应运而生。推荐系统从用户项目交互信息或静态特征中推断用户偏好,并进一步推荐用户可能感兴趣的项目,以帮助用户做出更有效的决策,有很大的应用价值。而在某些场景中,用户信息是匿名的,推荐系统只能根据用户点击行为序列来学习用户的兴趣表示,该类情况被归为推荐系统的
学位
在大数据环境下,每个行业都高度重视从海量用户数据中挖掘其背后的隐藏信息和价值,然而这些信息存在数据本身的隐蔽性,另外业务人员无法给数据人员清晰地表达自己的意图,导致难以从结构化数据中最大限度的获取到用户的喜好特征。因此直接通过自然语言在数据库查询数据,搭建数据库的自然语言交互平台也受到越来越多企业和研究学者的关注。NL2SQL是自然语言查询数据背后的核心技术,而NL2SQL中自然语言和SQL语言本
学位
随着我国经济社会的不断发展,工业化水平和人民的生活质量不断提高,与此同时工业化给生态环境带来了较大的负面影响。十九大报告指出,当前我国社会的主要矛盾是人民日益增长的美好生活需要与不平衡不充分的发展之间的矛盾。生态文明建设的速度与居民对美好、健康生活的需求增长不相匹配。近年来雾霾天气在我国一些城市中时有发生,随着《大气污染防治行动计划》等治理措施的提出,空气质量有所改善,但是要全面解决空气污染问题,
学位
随着医学的发展,疾病领域越来越细分,医生临床实践的差异化也越来越明显,由于医生临床实践过程中的医疗数据结构和表达的不统一,致使医疗机构、科室之间的信息交换、共享、整合和利用无法达成,影响了精准的疾病防治。因此术语标准化应运而生,不仅解决了信息表达的不一致性问题,而且实现了语义层面上的信息共享。然而,临床医学术语数量巨大以及表达方式多种多样,并且传统的基于人工规则的匹配方式成本高、效率低,亟需一种智
学位
近年投资基金逐渐成为大众化话题,搜集查询基金信息的需求不断增加。人们可通过搜索引擎或基金网站了解基金信息,但有时需要对相关基金信息进行比较,对感兴趣的基金进一步了解其相关信息,比如要了解某基金的基金经理还管理了哪些基金。此类需求涉及问答系统中的多跳问答问题,在知识图谱中表现为问题主实体到答案实体经过的关系路径不止一条。基于知识图谱的问答在处理单跳问题方面已能达到较高精度,目前难点和研究方向集中在复
学位
随着网络的高速发展,用户在网络上的足迹记录越来越多。为了提高用户的体验,满足用户的个性化需求,个性化推荐系统被提出来。传统的推荐系统都是在单域中进行推荐,会面临冷启动与数据稀疏的问题。跨域推荐的提出,实现了可借助其他域中的数据为用户进行推荐,解决了单域推荐系统中存在的冷启动与数据稀疏问题。但随着用户在网络上的交互越来越频繁,越来越广泛,用户在不同域之间的兴趣会产生影响,这时候,跨域推荐不仅仅是作为
学位
随着互联网技术的发展与普及,网络上的信息爆炸式地增长。与日俱增的信息在丰富了网络上信息量的同时,也加大了人们从互联网获取目标信息的难度。智能问答系统作为一种新型的信息服务方式,能够理解自然语言问题并回答,可以更方便、直接地帮用户获取信息。表格具有数据量丰富和结构明确的特点,在网络技术发展的过程中成为了主流的数据载体。为了方便用户从表格中获取信息,表格智能问答——即以表格作为智能问答的答案来源,成为
学位
随着5G时代的到来与数字化社会的快速发展,人们的生活越来越依赖网络。与此同时,方便人们表达自我与网络社交的社交媒体平台也飞速发展。越来越多的用户进入社交媒体平台,留下了丰富的个人动态、个人信息等数据,这些数据都是用户自主产生,具有极大的真实性与可靠性。通过分析用户在社交媒体平台产生的数据,可以做到尽可能全面、准确地描绘用户画像。用户基本属性和用户兴趣是社交媒体用户画像重要的组成部分,对于社交平台运
学位
流行性感冒极易于每年秋冬季在人群中流行传播,严重影响人们的生命安全和生活节奏,流感疫苗可以帮助人体提高免疫力,有效保护人体避免感染流感病毒。目前各国公共卫生机构的一项重要任务就是制定各种流感疫苗接种政策,从而提高流感疫苗在人群中的普及率,保障人民的生命健康安全。由于个人对流感疫苗的了解程度较低或其他原因,有不少人对接种流感疫苗持犹豫或拒绝的态度,这对流感疫苗的接种工作造成了一定的困难。因此需要分析
学位
中国已成为全球第二大经济体,而股票市场则是我国经济十分重要的环节,改革开放进入二十一世纪以来,我国的股票市场不断发展与完善,股票趋势预测的话题备受关注,若能准确地判断股票在未来的波动趋势,这将产生巨大的价值,带来收益的同时也能规避风险。计算机技术的发展,使得使用神经网络技术对股票趋势进行预测成为热门研究领域,如使用长短期记忆神经网络模型、循环神经网络模型、支持向量机模型等,基于股票的历史数据,对股
学位