成绩评定
课程总评全部来自实验。评价同时关注每个模块是否真正实现,以及最终系统能否在未见任务上自主交付软件。
| 项目 | 比例 | 评价重点 |
|---|---|---|
| Week 1–6 模块里程碑 | 42% | 每周 7%,检查规定能力、交付物与执行证据 |
| Week 7 公开端到端任务 | 18% | 模块集成、完整交付、公开验收与迭代能力 |
| Week 8 私有端到端任务 | 30% | 未见任务上的功能、鲁棒性、自主性与泛化能力 |
| 可复现性与工程分析 | 10% | 日志、运行说明、设计解释和失败复盘 |
端到端结果采用四类互补证据:
- 在干净、受限环境中安装、构建、启动和健康检查;
- 由教学组维护的独立功能、边界和鲁棒性测试;
- 对仓库结构、测试质量、硬编码和工程风险的结构化审查;
- 助教对主要用户流程和异常结果的定向人工检查。
学生系统自己生成的测试是重要交付物,但不能代替教学组的独立测试。最终私有任务使用截止日前冻结的系统版本,原则上不允许人工修改生成代码。
小组与个人成绩
Section titled “小组与个人成绩”三人小组首先获得共同项目基础分。教学组结合 Git 历史、模块责任记录、关键决策说明和必要的口头核验调整个人成绩。使用 AI 不构成违规,但每名成员都必须能够解释自己负责的设计和最终系统行为。