内训考题生成Skill
基于知识库原文的标准化考题生成 Skill,支持五种题型、100% 可溯源、自动查重、结构化 JSON 输出、一键导出 Word 试卷。

一、项目简介
考题生成引擎是一款基于知识库原文的标准化考题生成 Skill。它支持单选题、多选题、判断题、填空题、简答题五种题型,每道题都强制带「出处」,做到 100% 可溯源、自动查重、结构化 JSON 输出、一键导出 Word 试卷。
二、需求痛点
解决的是企业内训场景中出题人最头疼的几件事
凭空编题,踩合规红线
人工出题最大的风险是「拍脑袋」——题目脱离制度或者知识库原文,考的不是制度真要求,而是出题人自己的理解。等合规复盘时,根本说不清每道题的依据来自哪一条,容易踩合规风险。
抄来抄去,题库越攒越雷同
历史题和新题考察点重叠、题干换汤不换药、选项结构一模一样。题库越建越像「复制粘贴」,考试区分度直接归零。
格式七零八落,下游系统接不动
Word 手抄、Excel 乱排、答案和解析分两处。想导进在线考试系统?光是清洗格式就得加班一整晚。
换行业就推倒重来
这套题是金融岗用的,换到制造岗就全废。没有可复用的出题方法论,每次都是从零开始。
三、核心功能亮点
五种题型,一套引擎全包
100% 知识溯源,杜绝模型臆造
每道题强制带 origin 出处字段,精确到章节 / 条款。没有原文依据,引擎不命题——从机制上掐断了「AI 编答案」的隐患。
双重查重,题库越用越干净
第一层在提示词里注入历史题,让模型主动规避(覆盖约 90%);第二层由 validate.py 用文本相似度兜底检测,题干相似度超 0.80 直接标红预警。考察点、提问角度、题干表述、选项设置四个维度全面防重叠。
结构化 JSON + Word 双交付
四、底层核心技术能力
六层流水线架构(平台无关)
接入层 → 知识层(RAG 检索)→ 路由层(题型分发)→ 生成层(LLM 并行)→ 校验层(校验查重)→ 输出层(JSON / Word)。这套结构是引擎本体,不绑定任何可视化平台。
参数化提示词工程
5 种题型各有一套提示词模板,统一 4 个占位符(题型 / 数量 / 知识点原文 / 历史题),复制替换即可发给任意 LLM,逐题型调优互不影响。
双重查重引擎
提示词注入 + 代码相似度(difflib.SequenceMatcher)双保险,历史题越多差异化越彻底。
五、适用人群
企业培训与合规岗
金融 / 保险合规制度、安全生产规程、医疗诊疗规范——把红头文件变成可追溯的考核卷,审计时每题都能指出处。
院校与教辅机构
教材、大纲、课程标准一键转随堂测验与模拟卷,老师从手抄题库里解放出来。
政企与事业单位
行政制度、业务规范、入职培训、晋升考试,一套方法论跨科室复用。
互联网与科技团队
技术规范、安全基线、内部流程的技术等级认证与合规
这款开源 Skill 把「出题」这件苦差事变成了填表——你提供知识库,它负责出卷、溯源、查重、导出一条龙。仓库已开源,已发布至workbuddy skillhub:
