题库信息架构 · 最终方案

外语教学平台题库分类方案

一、为什么改

旧分类是一棵树,却把两件不同的事混在了一起:「考什么能力」(阅读、听力、写作……)和「怎么作答」(单选、填空……)。单选、填空是作答方式,不是能力——所以 AB 级的「语法与结构」题无论放哪里都不对。

新方案的做法:不再用一棵树,而是给每道题打六个坐标,各管一件事,互不打架。

二、一道题 = 六个坐标

一道题 A 技能(主+次) 听/读/写/译/口语/语言知识 B 作答形式 选择 / 封闭构建 / 开放产出 C 材料 篇章/对话/图表/题目提示… E 输入模态 文字/音频/视频/图片 题型(受控词表) 读后续写/七选五/听写… 用户检索主入口 标签(可多选) 考试·卷种/语言点/话题/方向/版本/难度
图 1每道题由六个坐标唯一刻画。红色为新增的关键类目「语言知识」。

最关键的是新增的 A=语言知识(K):语法、词汇类题目(单选、词形变换、选词填空、改错)统一归这里,AB 级「语法与结构」从此有了家。「单选」「填空」不再是一级分类,降级为 B 坐标里的筛选值。

复合题用「主技能+次技能」表达:托福综合口语 = 口语(主)+ 阅读、听力(次);读后续写 = 写作(主)+ 阅读(次)。

三、题库怎么组织

材料 一篇阅读文章 题组 这篇文章的配套题 第 1 题 第 2 题 … 共 5 题 第 5 题 计分点(每个空/小题号)
图 2四级结构:材料 → 题组 → 题原子 → 计分点。话题、难度、字数挂在「材料」上,一次录入,全组共享。

这样「一篇阅读配 5 道题」「一篇语法填空 10 个空」都有了自然的存法;一题内作答形式不同的(如 6 空给词、4 空不给词),按空拆分,各记各的形式。

四、怎么归类:一张表说了算

一道待归类的题 查权威 映射表 命中 → 定坐标 未命中(自编题) 登记 + 自动校验 争议 → 冲突队列 裁决后回写 映射表
图 3归类不靠人现场判断:先查表;表外题目进队列,裁决结果回写表中,同类题下次自动命中。

权威映射表是这套体系的核心:「考试 × 题型 → 六个坐标」,已按现行考纲配好 CET-4/6、CET-SET、TEM-4/8、考研一/二、AB 级、高考(新课标卷/上海卷/北京卷/天津卷)、中考、雅思、托福、PETS、GRE(仅语文部分)的全部题型,每行注明考纲出处。录入人员只查表,不裁决——同一道题,谁录都是同一个结果。

五、典型题归类示例

题目A 技能B 作答形式说明
AB 级 语法与结构·单选语言知识 K单选挂具体语法点标签
CET 选词填空(15 选 10)阅读 + 语言知识有备选填空词库共享式
高考 完形填空(四选一)阅读 + 语言知识单选每空一个独立题号,按呈现粒度判别
专四 听写听力 + 语言知识听写转写全文转写,不是填空
高考 读后续写写作 + 阅读开放写作
雅思 听力地图标注听力有备选填空输入 = 音频 + 图片
托福 学术讨论写作(2023 后)写作开放写作材料 = 讨论帖
AB 级 英译汉句子选择翻译 + 阅读单选方向标签 = 英译中

六、旧题库怎么搬

  1. 能确定的自动搬:规则唯一的(如「判断正误 → 阅读 · 判断」)写脚本一次跑完,可重复执行、可回滚。
  2. 有歧义的先机器预打标、再抽检:按旧分类结合题干特征预判;小批量全量人工复核,大批量按统计口径抽样,不达标重跑。
  3. 解决不了的进人工队列:裁决结果回写映射表,同类题以后自动归类。

切换期间旧分类继续可用,用户手里的旧链接自动跳转到新筛选条件;新界面对 5% → 50% → 100% 用户逐步开放,出问题一键退回。

七、以后出了新题型怎么办

  1. 先拿六个坐标问一遍:考什么、怎么答、什么材料、什么输入、什么题型、属于哪些标签。
  2. 装得下 → 往映射表加一行配置,即刻生效,不改代码。
  3. 装不下(如出现新材料、新作答方式)→ 走增补评审:加一个新字典值,历史题不受影响。
  4. AI 自适应对话等动态题型:按「题型模板」归类,每次运行产生的一次性实例不参与统计。

—— 全文完 ——