个人简介

一名14年经验的资深毕设内行人,语言擅长Java、php、微信小程序、Python、Golang、安卓Android等

开发项目包括大数据、深度学习、网站、小程序、安卓、算法。平常会做一些项目定制化开发、代码讲解、答辩教学、文档编写、也懂一些降重方面的技巧。

感谢大家的关注与支持!

答辩学生:各位老师好,我是××班××同学,题目是“基于 Spark 的美食推荐可视化系统”。系统分管理员和用户两端:管理员端主要做美食数据爬取、订单审核、信息维护和可视化看板;用户端可以注册登录、加购物车、下单评价,并基于协同过滤算法得到个性化美食推荐。技术栈采用 Scrapy 爬数据、HDFS 存数据、Spark 做分析、Vue+ECharts 做可视化,MySQL 做业务库,整体用 SpringBoot+Spark 搭建,目标是为校园师生提供快速、直观、个性化的美食发现体验。下面请各位老师批评指正。


评委老师:为什么要用 Spark,而不用传统 Python 脚本?
答辩学生:因为后期数据量会到几十万条,Spark 内存计算快,还能直接对接 HDFS,后期如果做实时推荐也方便扩展。


评委老师:数据从哪几个网站爬?会不会侵权?
答辩学生:主要爬美团和饿了么公开的商户信息,只取店名、价格、评分这些公开字段,不碰用户隐私,同时加上 ROBOTS 协议判断,每天限量爬,避免对目标站点造成压力。


评委老师:协同过滤需要大量用户行为,你们校园用户量够吗?
答辩学生:前期先用爬到的“销量”字段做基于物品的协同过滤,等校内用户注册上来后再逐步切换成“用户-菜品”矩阵,冷启动阶段用销量兜底。


评委老师:可视化看板准备展示哪些图?
答辩学生:三张图:①价格区间柱状图;②销量 Top10 饼图;③口味雷达图,后期再加时间维度的折线,看一天各时段销量变化。


评委老师:如果 Spark 作业跑挂了,你怎么知道?
答辩学生:在 SpringBoot 里加一个监控线程,每 30 秒检测 Spark 任务状态,失败就发邮件提醒,并自动重跑三次,三次都失败就转人工。


评委老师:数据库怎么备份?
答辩学生:MySQL 每天凌晨 2 点用 mysqldump 全量备份,保存 7 天;HDFS 数据每天做一次快照,保留 3 份,存在不同节点。


评委老师:系统最大并发能扛多少?
答辩学生:目前 4G 内存单机测试,JMeter 压到 200 并发响应 1.2 秒,后续把 Spark 集群加到 3 台,预期 500 并发没问题。


评委老师评价:
××同学准备充分,功能划分清晰,技术选型合理,对冷启动、数据备份、并发压力都有简单可行的对策。下一步重点把用户行为收集模块做扎实,并补充隐私脱敏说明。整体开题可以通过,按计划推进即可。


以上是某同学的毕业设计答辩的过程,如果你现在还没有参加答辩,还是开题阶段,已经选好了题目不知道怎么写开题报告,可以下面找找有没有自己符合自己题目的开题报告内容,列表中的开题报告都是往届真实的开题报告,可发送使用或参考。文末或底部来联xi可免费获取

最后

有时间和有基础的同学,建议自己多花时间找一下资料(开题报告、源码)自己独立完成毕设,需要开题报告内容、源码参考的,可以联xi博主,没有选题的也可以联系我们进行帮你选题、定功能和建议。

更多推荐