本系统基于Python语言开发,采用前后端分离架构,后端核心框架选用Django负责业务逻辑处理与接口服务,大数据处理层则深度集成Apache Spark与Hadoop HDFS,专门用于应对海量医疗数据的分布式存储与高效计算。系统利用Spark SQL对心脏病数据集进行清洗、转换与聚合分析,通过Pandas与NumPy辅助进行特征工程处理,能够精准执行人口统计学特征分析、生理指标相关性计算以及多维度的风险评估。前端界面使用Vue结合ElementUI与Echarts,将Spark计算后的复杂分析结果以动态图表形式直观展示。功能涵盖了从数据源读取、Spark分布式任务调度、多因素风险评分模型构建到最终可视化数据渲染的全过程,旨在通过大数据技术挖掘心脏病潜在风险因素。