大数据审计应用实践初探

随着大数据的产生和发展,大数据已成为一种非常重要的战略资源,并在提升产业竞争力、国情分析和社会管理等方面发挥着愈发重要的作用。同样,审计机关在执行审计监督的过程中,运用大数据审计在加快构建集中统一、全面覆盖、权威高效的审计监督体系起到了不可替代的作用。目前,大数据审计工作模式及应用已贯穿审计全过程,提升了审计跨领域、跨层级、跨系统、多思维的数据分析水平,推进了审计全覆盖。加大财务数据与业务数据、单位数据与行业数据以及跨行业、跨领域数据的综合比对和关联分析,可极大提升审计效率,使“大海捞针”变为“重点撒网”,使审计的深度、广度和精度得以实现新的拓展,推动审计工作迈向大数据审计时代。本文从大数据审计内涵及特征入手,重点通过关联分析,对大数据审计的应用做初步探讨。

一、大数据审计内涵及特征

(一)大数据审计的概念

(二)大数据审计的特征

2.技术特征。“审计全覆盖”的要求使得大数据审计的范围大大扩充,审计对象更加复杂多样。与此同时,数据跨行业、跨部门、跨领域,信息系统复杂多样,使得数据采集、预处理、分析挖掘和可视化技术应用更加复杂化、多样化、精益化和动态化。

二、大数据审计的技术方法

(一)关联分析

(二)结构分析

(三)趋势分析

(四)数据挖掘

数据挖掘是指从大量的数据中自动搜索隐藏于其中的信息的技术。审计数据挖掘是指审计人员使用离群点挖掘、孤立点检测、异常点检测、聚类分析和关联规则等方式确定审计问题的一种方法。

三、大数据审计的步骤

(一)数据采集

审计数据采集不仅会影响到对被审计单位的审计结论,还会影响审计项目资源的投入产出,因此审计数据采集是审计项目开展的重要环节。审计数据采集应满足以下原则:一是应能实现审计实施方案的审计目标,二是要在对被审计单位业务流程、信息系统充分了解基础上进行数据采集,三是不仅要采集被审计单位的内部数据,还要选择外部关联数据。在数据采集方式上可以采取联网数据共享与采集、定点采集和定期报送方式实现。

(二)数据储存

由于大数据的容量大、类型多、范围广等特点,造成审计机关采集数据储存方式难。要实现大数据的有效储存,一是做好大数据的顶层设计和统筹规划,二是加快实施“金审三期”工程,完成“审计云”建设,为下一步数据储存提供明确的方向和思路。

(三)数据清洗

数据清洗主要内容是检查、分析数据的质量,修正数据。审计数据清洗的任务是过滤不完整、错误和重复的数据,只有通过清洗与过滤得到干净完备的数据,才能通过分析与挖掘得到可用于支撑审计问题和决策的数据基础。

(四)数据分析

2.分析审计数据模型。主要是指为实现分析模型,需要哪些具体的审计数据,根据已建立的审计分析模型,确定待用的基础表,并且要对具体的数据进行研究,确定各字段、代码和业务数据具体内容代表的含义等。分析的过程中,需要综合数据词典和数据库说明等技术文档对数据的含义,对业务流程的理解等方面的认知情况,对数据产生全面、深入的认识。

3.建立分析性“中间表”。利用被审计单位数据库中的数据来实现审计分析,要对清理、转换后的基础数据按审计目的进行“再加工”,从基础数据中选择出所需要的数据,生成能完成审计分析的数据表。为了实现最终的分析,在数据分析的过程中往往需要构建多个数据表,这就是分析性“中间表”。建立审计分析性“中间表”一般是通过对选定的基本表进行“投影”“联接”等操作来实现。

4.完成审计模型分析。按照分析模型,采用一定的方式、方法,对数据进行具体的分析,得出结果,完成分析。审计的数据分析可分为三个层次:第一个层次为数据分析人员通过sql、oracle等语言来交互式地描述查询要求,对数据库中的记录进行访问和查询,实现查询型分析;第二个层次为数据分析人员先提出自己的假设,然后利用各种工具和方法进行反复递归的检索查询发现问题,实现验证型分析;第三个层次为数据分析人员通过趋势分析和行为分析,挖掘出大数据中可能被忽略的信息,为审计人员作出前瞻性的决策提供帮助,实现挖掘型分析。

(五)疑点核实

目前数据分析结果不能直接作为审计结论,必须要通过查证延伸,才能获取被审计单位的认可。也就是说,数据分析结果只是缩小审计范围,提取出“嫌疑数据”,提高延伸审计的质量,得出审计结论还是要经过审计查证这一过程。

四、大数据实践与探索--关联分析的应用

(一)纵向关联分析应用

1.资金维度数据分析。某省财政部门使用的是财政预算管理信息系统。其中,指标管理系统包含FROMCTRLID和TOCTRLID两个字段,将指标管理系统里的指标流向串联起来;该系统中包含映射表,控制可执行指标、国库集中支付和总预算会计账务系统的对应关系,跟踪资金的最终流向,确定最终收款方;该系统可以将指标、用款计划、支付申请、支付凭证、总预算会计凭证等关联起来,实现资金流向的逐层分析。如可按照项目资金流,先从指标管理系统查询项目资金下达中涉及单位及执行情况,再通过国库集中支付系统查询该项目对应资金的最终收款方,对资金流进行追踪,筛选出同一企业享受多种不同财政补助、相似项目多头申报财政补助、连续多年财政直接支付给相同个人等疑点线索,看是否存在资金沉淀、资金滞留财政及部门当年未实际支出等问题。

2.业务维度数据分析。医院管理信息系统(HIS)主要包括药库、药房、门诊、住院四个管理子系统的电子数据,存储的每一条记录都有明确含义,存在紧密的业务对应关系,因此可利用其业务关系建立审计分析模型,发现问题线索。如在医院财政财务收支审计中,审计人员可通过病人的住院天数计算出实际应按天收取的床位费、护理费、暖气费等项目,再以病人ID号为关键字进行关联,计算应收与实收的医疗费用差额,看医院是否存在多收病人医疗费的现象。

(二)横向关联分析应用

横向关联分析是指通过使用关联数据的关键字段对来自同一部门不同业务系统之间或者不同部门业务系统之间数据关联比对,实现不同数据库的整合展示,发现审计疑点线索。其中关联字段比较常用的有身份证号码、统一社会信用代码、工商登记号等。

1.同一部门不同账务系统数据分析。审计人员可借助外部数据发现关联事项,再顺藤摸瓜进行关联审计,揭示一些现象后面掩盖的真相。如通过比对被审计单位的财务账和工会账等,可发现部分房租收入列入单位工会而未做单位财务收入;部分资金,如接受捐赠、变卖资产等,长期体外循环,单位不列收列支的情况等,诸如这类违纪违法活动,单从单位财务账很难发现端倪。

2.不同部门业务系统间数据分析。不同部门间数据关联比对往往以一个数据为主,其他业务数据起到佐证作用,称为“1+N”数据模式,通常可以包含财务数据和业务数据,也可以包含多个业务数据和行业数据,例如在扶贫资金审计中,因为扶贫资金发放面广、链长、点多、量小,要做到审计监督全覆盖必须创新审计方式方法,强力推进大数据关联分析。其中各类资金发放都有相应的政策法规规定,一些还有比较严格的条件限制,而这些前提条件往往可通过其他部门业务数据间接佐证。利用多部门数据间的关联关系,以贫困人口建档立卡、危房改造、低保户信息为主,身份证号作为关键关联字段,分别与财政供养人员、工商登记、个人所得税、房产、车辆、证券、医保、死亡人员信息等数据关联比对,可发现扶贫对象、危旧房改造对象、低保户认定不精准和扶贫资金安全方面问题线索,大大提升了精准审计力度和工作效率。

3.外部数据关联分析。部分业务数据作为外部数据被广泛应用于各类审计项目中,如工商登记和税务信息等。例如通过将财政供养人员与工商登记信息比对分析,可发现公职人员经商办企业的问题;通过将企业领导干部与个人所得税信息进行比对分析,发现领导干部兼职取酬的问题。

THE END
1.数据挖掘的基本步骤和流程解析:深入洞察与策略实施在数据时代的浪潮中,数据挖掘技术已成为企业洞察市场、优化运营和驱动创新的利器。 它融合了统计学、机器学习、数据库管理和人工智能等领域的先进技术,旨在从海量数据中 提取有价值的信息。 本文将深入探讨数据挖掘的六个基本步骤,并详细解析每个步骤的操作要领、关键技术和实 https://blog.csdn.net/m0_67484548/article/details/142664830
2.数据挖掘七种常用的方法汇总腾讯云开发者社区聚类分群效果可以用向量数据之间的相似度来衡量,向量数据之间的相似度定义为两个向量之间的距离(实时向量数据与聚类中心向量数据),距离越近则相似度越大,即该实时向量数据归为某个聚类。 数据挖掘方法 利用数据挖掘进行数据分析常用的方法主要有分类、回归分析、聚类、关联规则、特征、变化和偏差分析、Web页挖掘等, 它https://cloud.tencent.com/developer/article/1892597
3.高效实施数据挖掘的方法和步骤yuanye1014高效实施数据挖掘的方法和步骤 高效实施数据挖掘的另一条件 —— 优秀的数据挖掘工具 有了优秀方法论的指导,还需要一个高效的数据挖掘工具。目前提供数据挖掘产品的厂商非常多,如著名的产品有SAS Enterprise Miner、SPSS Clementine 8.1(简体中文版)、IBM DB2 Intelligent Mine等,这些产品各有特色。http://blog.chinaunix.net/uid-64814-id-2690182.html
4.数据挖掘的四种基本方法数据挖掘的步骤 解读需求要考虑专家、工作人员的意见;数据可从业务层的数据库中提取、抽样;在计算机分析技术下,可能给出不同模型, 企业需要选择最优模型;数据挖掘只是辅助的决策工具, 如何解读模型也是重要的任务;根据挖掘结果进行商业部署, 如零售商根据客户习惯决定进货量、进货时间、具体选址等。https://www.dongao.com/cma/zy/202406204447292.html
5.数据挖掘方法论具体实施步骤01、数据挖掘方法论具体实施步骤 第一步:业务理解 指从业务角度来理解项目目标和要求,接着把这些理解知识转换成数据挖掘问题的定义和实现目标的最初规划。 第二步:数据理解 指从数据收集开始,然后接着是一系列活动,这些活动的目的是:熟悉数据,甄别数据质量问题、发现对数据的真知灼见、或者探索出令人感兴趣的数据子https://www.jianshu.com/p/03e2b16e3403
6.数据挖掘概念与方法(精选八篇)空间数据挖掘[1 - 3]是指从空间数据库中抽取没有清楚表现出来的隐含的知识和空间关系, 并发现其中有用的特征和模式的理论、方法和技术。它是多种技术和学科交叉的新领域, 综合了机器学习、数据库技术、模式识别、统计、地理信息系统等领域的有关技术。针对空间数据的特点, 空间数据挖掘可发现空间分布规律、空间关联https://www.360wenmi.com/f/cnkey6cf58u0.html
7.数据挖掘如何入门2、建立数据挖掘库; 3、分析数据; 4、准备数据; 5、建立模型; 6、评价模型; 7、实施。数据挖掘是通过分析每个数据,从大量数据中寻找其中的规律的技术。数据挖掘的任务有关联分析、聚类分析、分类分析、异常分析、特异群组分析和演变分析等。 一、挖掘步骤 https://www.linkflowtech.com/news/228
8.数据挖掘的六个步骤有哪些帆软数字化转型知识库三、数据清洗 数据清洗是数据挖掘中不可或缺的一环,因为原始数据往往存在各种问题,如缺失值、重复值、异常值等。处理缺失值可以通过删除含有缺失值的记录、使用均值或中位数填补缺失值,或者采用更复杂的插值方法。去除重复值是为了避免数据冗余导致的分析偏差,这一步骤可以通过识别和删除重复记录来实现。识别和处理异常https://www.fanruan.com/blog/article/594251/
9.数据挖掘的步骤包括什么经过上述步骤后,挖掘出的知识或模式可以应用于实际问题解决或决策支持。这可能涉及预测、分类、关联规则挖掘等任务,帮助企业或个人更好地理解数据和业务。 需要注意的是,数据挖掘是一个迭代的过程,每个步骤都可能需要根据实际情况进行调整和优化。此外,随着技术的发展和数据的不断增长,数据挖掘的方法和技术也在不断演进https://www.pxwy.cn/news-id-81213.html
10.数据分析与挖掘11篇(全文)5. Web数据挖掘技术实现 Web数据挖掘中常用的技术通常可以分为两类:一类是建立一种以机器学习为主的人工智能模型,采用的方法有神经网络、自然法则计算方法和Web特有的路径分析技术等。另一类是是建立在统计模型的基础上,采用的技术有决策树、分类、聚类、关联规则等。 https://www.99xueshu.com/w/ikeyp687ycyz.html
11.7种常用的数据挖掘技术分享开源地理空间基金会中文分会开放数据挖掘中最重要的任务之一是选择正确的数据挖掘技术。数据挖掘技术必须根据业务类型和业务面临的问题进行选择。因此必须使用一种通用的方法来提高使用数据挖掘技术的准确性和成本效益。本文主要讨论7种被认为是商务人士更常使用的数据挖掘技术。 统计数据 聚类 https://www.osgeo.cn/post/14c56
12.数据挖掘的七个步骤理想股票技术论坛数据挖掘的七个步骤包括数据预处理、数据清洗、数据转换、数据建模、模型评估与优化以及数据可视化展示。这些步骤是数据挖掘过程中必不可少的环节,通过对数据的深入挖掘和分析,可以提取出有价值的信息和规律,为决策提供支持。 ,理想股票技术论坛https://www.55188.com/tag-08849372.html
13.市场营销策划的步骤和方法市场营销战略是企业市场营销部门根据战略规划,在综合考虑外部市场机会及内部资源状况等因素的基础上,确定目标市场,选择相应的市场营销策略组合,并予以有效实施和控制的过程 。下面小编为大家整理了市场营销的策划步骤和方法,希望能为大家提供帮助! 市场营销战略策划的步骤和方法 https://www.jy135.com/zhichang/38321.html
14.数据挖掘的基本步骤是什么?数据挖掘的基本步骤包括: 理解业务目标:首先要明确数据挖掘的目的是什么,是为了预测销售额、识别欺诈行为还是其他目标。只有明确了业务目标,才能有针对性地进行数据挖掘分析。 数据理解:收集相关数据,理解数据的含义、格式、质量等特征。这一步通常包括数据收集、数据描述性统计、数据可视化等方法,以便更好地理解数据。 https://www.mbalib.com/ask/question-1ff33c04b2a8f83d1aff9875a50d017f.html
15.想要进入任何一个新领域的时候,步骤和方法是怎样的?接下来我们就通过五大学习步骤,综合掌握进入一个新行业或新领域的学习方法。第 2 节 进入一个新行业或https://www.zhihu.com/question/26725173/answer/1594372380
16.数据挖掘主要步骤图数据挖掘六大基本步骤数据挖掘主要步骤图 数据挖掘六大基本步骤 当拿到一份处理好的数据时,我们首先应该做的是什么呢?是直接上手编写代码构造模型?都说事半功倍,所以在进行数据挖掘之前,我们头脑中一定要是有个完整的路径,这样,我们就能回溯于每个环节去检查整个项目(构造的模型),同样也是帮我们梳理整个项目的环节,可以帮助我们在项目汇报https://blog.51cto.com/u_16099209/7874359
17.数据挖掘的基本概念和工作流程金融IT那些事儿步骤四:建模(modeling) 在建模阶段,要选择建模方法,并通过构建和评估模型对参数进行校准。对于同一个数据挖掘的问题类型,可以选择使用多种建模方法,但对于每一个要使用的技术要分别对待。一些建模方法对数据的形式有具体的要求,因此,在这一阶段,重新回到数据准备阶段执行某些任务有时是非常必要的。 https://www.shangyexinzhi.com/article/4052696.html
18.数据挖掘的流程包含哪些步骤?数据集成:如果数据来自多个源头或多个数据表,需要将它们整合为一个统一的数据集。这涉及到对数据进行连接、合并和转换等操作,以便进行综合分析。 特征选择:在数据挖掘中,特征选择是非常重要的步骤。通过评估和选择最相关的特征,可以提高模型的准确性和效率。常用的特征选择方法包括统计分析、相关性分析、信息增益等。 https://www.cda.cn/view/202981.html