历史匿名回执 ·
### 考核标准 10%签到1-2次(实际1次)+90%大作业,签到这块基本属于打卡景点性质,来了拍张照就走,剩下90%全压在那坨大作业上,人生的重量在后八周集中到账好吗。 ### 本学期上课时间 后8周每周二、周四14:00-15:40,也就是前八周你以为这门课不存在,后八周它像体测一样突然出现。 ### 大作业 以小组形式完成一个基于大语言模型的推荐系统(核心算法),翻译成人话就是:让LLM来当红娘,给你推荐下一个该看什么。 + 题目: • 自选or给定,几个方向or限定,例如: • 基于大语言模型提示词的推荐算法(主要使用prompt,相对比较简单)——属于给模型递个小纸条问"你猜我喜欢啥"的难度。 • 基于大语言模型特征增强的推荐算法(LLM作为特征提取器,不微调的情况下增强推荐算法的性能,难度中等)——让LLM当免费打工人特征提取器,一滴微调都不舍得出。 • 大语言模型的微调下的推荐算法(微调LLM实现推荐性能增强)——钞能力/算力流赛道,显卡在燃烧。 + 小组人数:1-5人,弹性大到可以从孤独传说一路组到组队开黑。 + 需提交:(第11周周二前提交)开题PPT(不用pre);(最后一次课前提交)代码、PPT(最后一次课pre),开题那段不用pre大概是这门课为数不多的温柔。 + 官方评分标准: 1. 提交完整的项目文件,可执行的代码。一份报告文档(PPT10页以内) 2. 按难度分为三挡,评分区间不同,这部分权重0.6,选难度这件事本质是一次人生博弈: • 难度较低,均分80,评分范围75-85 • 难度中等,均分85,评分范围80-90 • 难度较大,均分90,评分范围85-95 3. 完成质量,这部分权重0.2 • 代码可执行,结构清晰,注释清楚。100分 • 代码可执行,结构较合理,有必要注释。90分 • 代码有bug不可执行,结构较合理,有注释。60分 • 代码有bug不可执行。0分——这条的压迫感堪比你妈站在你身后看你写代码。 4. 组长提供成员贡献说明,如无则默认同等贡献,这部分权重0.2 5. 综合评估小组人数(人少的组人均贡献更大),以及成员贡献比例,分数50-100,意思是想抱大腿的人会被这套算法当场抓包。 助教提供了一个代码框架,应该是根据NeuMF这篇论文写的,数据集是Movielens 1M,但是代码框架有挺多问题(应该是AI写了没检查),我们组捉了挺久的虫——好家伙,AI生产的代码最后由人类来善后,这就是所谓的人机协作闭环吗。当然也可以不用他给的代码框架,也不用他给的数据集,自己定个题目做,自由度挺高的,门是敞开的,只是都大四了也没什么人在这课上花很多时间,大多数组都是在助教的框架基础上做的,主打一个在坍塌的地基上盖毛坯房。老师除了前两三节课讲课了,后面也没讲课了,只是来了教室,提供答疑,但也没几个学生来教室——教室空旷得像个自习室候补现场,老师坐镇如空气墙,学生在远方自生自灭。