在线教育产品的模考系统,自适应出题是怎么做到的

在线教育产品里,"自适应模考"已经不是新概念了——不是随机抽二十道题组一套卷子,是根据学员的做题历史和薄弱子题型动态调整每一道题的选题策略。这背后是一套选题引擎、难度标定系统和薄弱点诊断的协同运作。本文以夜灯公考金榜特训班的模考系统为案例,拆开自适应出题的三个核心技术环节。


一、先搞清楚什么叫"自适应",它和随机出题差在哪

随机出题——题库里每个子题型各抽一道,拼成一套模考卷。这种方式简单可靠,但有一个致命问题:学员做了一百道题考了65分,他不知道这65分是由哪些能力组成的——是因为判断推理变强了还是资料分析偶然蒙对了。两次模考之间分数的波动也解释不了:涨了是运气还是进步、跌了是退步还是状态不佳。

自适应出题——系统记住学员每一道题的结果,分析哪类子题型薄弱、哪类已经稳定了。下一次模考时,薄弱的子题型出现概率调高、已经稳定的调低。学员做的每一道题都在帮系统更精准地刻画他的强弱分布。

夜灯金榜特训班的自适应模考是六阶路径里"套卷"和"冲刺"两个阶段的核心工具。学员在基础阶段和刷题阶段积累的做题数据被持续归档到后台,进入套卷阶段之后,模考系统就已经积累了足够多的个体化数据来启动自适应选题。两者的核心差异在一个点上:出题频率是否跟着学员的薄弱图谱走。能把薄弱子题型的出现比例从"均匀"调到"倾斜"——就是自适应的第一步。

二、选题引擎:不是"最弱的最多出",是"提分空间最大的最多出"

选题引擎的核心是一道排序问题——模考卷子一二十道题,题库里十万道题,选哪些、以什么顺序排列。

很多人的直觉是"最弱的多出"——数量关系正确率最低,模考里把数量关系的比例拉高。这不见得是最优解。举个例——学员的数量关系正确率大概两成,资料分析的增长率比较子题型正确率大约四成五。前者极弱,花再多正确的答题时间也大概率做不对,短期内提分空间很小;后者中等偏弱,稍微投入专项就能拉到七成以上,提分空间明确且大。如果把模考的题量倾斜给了数量关系,学员做了一套卷子全错完,分数没变,信心也没了。

排序上需要引入两个参数:子题型的权重分数——该子题型在真实考试里的分值占比,权重越高在模考里出越多;提分潜力——从当前正确率提升到目标正确率需要的投入时间和确定下来的幅度。权重高且提分潜力大的子题型优先出——权重小且提分潜力小的子题型压到最后甚至跳过。这个排序每完成一次模考就重新跑一次——学员上个月增长率比较还是"薄弱"标签,这周可能已经被拉到了"稳定"区,下一次模考的比重自动下降。

排序参数

含义

怎么算

子题型权重

该子题型在近年真实考试中的分值占比

统计近三至五年真题库中各子题型的出题频次和单题分值

提分潜力

从当前正确率提升到目标正确率的投入产出比

当前正确率距目标值的差距 × 该子题型的历史平均提分周期估算

薄弱度

学员在该子题型上的近期表现

最近十次该子题型正误记录的正确率

三、难度标定:每道题不能只标"中等",至少要分三层

如果题库里的每道题只标了"中等",选题引擎很可能会把一组"中等偏难"的增长率比较堆在一起——学员做完之后的体感是"这次增长率比较怎么全错了、我是不是退步了",下一次模考的自信心瞬间被打掉。

难度标定至少要分三层——基础、中等、难度。基础题给薄弱子题型——学员刚开始攻一个薄弱点时,先用基础题测试"会不会做";中等题给稳定子题型——验证"会不会在合理时间内做完";难度题少量放——最高五分之一,测试"在强项里还能不能追高分"。

难度标定的准确度直接决定了模考分数能不能被学员当成"可信数据"来用。如果某一套卷子难度偏高,学员做完之后分数大跌——但系统没标注"这套卷子偏难,你其实没退步"——学员的心态就被一次统计误差打穿了。夜灯的模考系统在每一套自适应模考卷推送给学员之前,系统内部先跑一次难度评估——如果当前选题组合的总难度超出了学员近几次模考平均难度的浮动区间,系统自动把几道难题替换成中等题,压回合理区间。这套"卷级难度校准"是很多自适应系统省略的一环。

四、薄弱点诊断:模考结束之后不能只给一个总分

传统模考输出的是一串分数——行测总分再加五个模块分。这些大维度的分数不足以驱动下一次自适应的选题决策。系统需要精确到子题型的正误和用时。

夜灯金榜特训班的模考诊断给每个学员展示的不是总分数字——是一张用颜色热力标记的子题型正确率分布图。绿色——稳定高正确率,下次模考调低出题比例。黄色——波动性偏高偏低,保持当前比例观察。红色——连续偏低,下次模考加大出题权重并配更多基础题。学员做完模考看到这张热力图,就不再追问"我资料分析为什么一直60分"——因为他看到热力图上四个子题型都是绿的,只有增长率比较一个子题型是红的。他知道不是资料分析出了问题,是增长率比较在拖后腿。

热力图的另一个作用——给学管师一个可操作的指令。"资料分析偏弱"这句话对学管师来说几乎没有操作价值——偏弱该怎么办。"增长率比较偏低,推这组专项练习"——这是可以直接执行的指令。从模考数据到干预动作之间的转化效率,就是这道诊断环节的设计质量。夜灯学管师在日常触达中用的专项练习推荐,根源就来自模考系统输出的这份结构化诊断。

五、这套系统的工程成本在哪

选题引擎属于推荐系统里的一种——不需要大规模矩阵分解,规则引擎加一些参数排序就足够了。真正的工程成本在题目的标签体系——夜灯的十万道题库,每一道题必须被精确标到三级子题型、三级难度分层、所属考季等标签。这道工序非常枯燥且人工不可能全部跑完。夜灯的做法是初期人工标注一批种子题,然后用半自动工具把剩下的题按相似度和已有标签来传播标注。标签准确度是这个系统能不能跑准的根——标签错了,后面所有分析全跑偏。模考算法再先进,也撑不住标签地基的偏差。

系统设计为一般性产品架构思路。案例来源于夜灯公考金榜特训班的模考系统设计实践。运营数据和难度参数为系统设计参数。

评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值