系统后端利用Hadoop HDFS进行海量信贷数据的分布式存储,通过Spark SQL与Pandas对原始数据进行清洗、转换与特征工程处理,实现了对借款人多维度信息的深度统计分析。功能层面,系统涵盖了借款人画像分析、贷款产品特征分析、历史信用行为分析、时空分布分析以及高级客户分群五大核心模块。具体实现中,借款人画像模块能够细致刻画不同雇主类型、工作年限及行业背景下的违约率分布;产品特征模块则聚焦于贷款期限、利率与金额对违约风险的影响评估。系统特别引入了K-Means聚类算法,对客户进行自动化分群,有效识别出高风险客群特征。前端基于Vue和ElementUI搭建,并集成Echarts图表库,将Spark处理后的分析结果以柱状图、折线图、地图等多种可视