MathBank使用指南
v2.3.0GitHub下载软件
MATHBANK HANDBOOK / 03

导入指南

根据文件类型,找到合适的导入方法。

i
先看配图是否重要

当前 PDF 批量导入的配图插入仍有问题。含配图的试卷,优先使用原始 Word 文件。 查看完整说明 →

我的文件,应该怎么导入?

文件类型操作重点关注的模型设置
原始 Word · .docx保留原文件,检查公式转换报告、图片与题目边界试卷智能拆解模型
特殊公式 Word特别检查 MathType、旧式公式和人工核对提示先查转换结果,再看拆题
文字型 PDF先尝试自动/原生提取,核对缺字与公式拆题;必要时也需要识图
扫描版 PDF使用视觉 OCR 路径,先选少量页面识图 + 拆题
单题截图保持清晰完整,识别一题后核对再保存默认公式识图模型
LaTeX · .tex上传单文件,补齐对应插图;自定义宏须检查转换试卷智能拆解模型

识图和拆题,是两件事

1

识图:把图片里的内容读出来

关注字、公式、上下标、表格是否准确。出现识别问题,先检查原图质量和提取方式,再尝试换「默认公式识图模型」。

2

拆题:把内容整理成一道道题

关注题目有没有合并、漏掉或拆断。原始文本完整而题目边界错误时,调整「试卷智能拆解模型」。

PDF 可能先提取原生内容,必要时再走视觉识别,最后进入文本拆题。使用硅基流动时,可先用 Qwen/Qwen3-VL-8B-Instruct 识图,再用 Qwen/Qwen3.8-27B 拆题。想改用 DeepSeek 拆题时,优先用官方平台的 deepseek-flash,并配置官方 Key。只更换「AI 智能解题模型」,不会修复前面的识图与拆题问题。

Word:先从原始文件开始

  1. 在「导入中心」选择 .docx 文件。旧 .doc 请先在 Word 中另存为 .docx
  2. 选好「试卷智能拆解模型」,首次先关闭自动生成解答,点击「开始解析」,等待内容提取与拆题完成。
  3. 完成后查看 Word 提取报告与诊断提示,特别核对 MathType、特殊公式或复杂版式。入门可先选择硅基流动的 Qwen/Qwen3.8-27B 处理小样例。
  4. 逐题检查图片归属、选项顺序与公式,修正后再导入。

Word 可以提取配图,但复杂浮动图、图片选项和特殊公式仍可能需要人工调整。把 PDF 转成 Word,并不等同于拿到原始 Word 文件。

PDF:先试 1–3 页,再按内容分段

30 MB原文件大小上限
80 页单次选中页数上限
1–3 页首次试用建议

80 页是程序允许的上限,不是推荐数量,也不是成功保证。内容会汇总进入拆题流程,公式密集或解析很长时,即使页数合规也可能超时或返回不完整。

  1. 先填页码范围 1-3,或用逗号选择不连续页,如 1-3,5
  2. 按完整试卷或小节分批,跨页的题目应把相关页一起选中。
  3. 排除不需要的封面、目录与长篇解析,检查提取的文字和公式。
  4. 小样例成功后,再适度增加内容;超时或漏题时优先缩小批次。

文件大小限制为 30 × 1024 × 1024 字节。选择页码范围可以减少处理页数,不能绕过原文件大小限制;超过大小限制时,需要先另存较小的 PDF 文件。

当前限制:PDF 配图导入

!
当前 PDF 批量导入的配图插入仍有问题。含配图的试卷,优先使用原始 Word 文件。

文字和公式识别成功,不代表几何图、统计图或图片选项已经随之导入。只有 PDF 时,导入后请逐题核对,在题目编辑器中补充缺失图片。换模型不能解决这一已知限制。

核对时应同时打开原始试卷和题目卡片,重点检查几何题、函数图像、统计图表以及含图片的选项。补齐图片并确认归属后再保存。

希望改善识别和拆题效果

硅基流动的 Qwen-VL 8B 可以常规使用;按作者经验,32B 整体识别效果更好,也可尝试 Qwen/Qwen3.8-27B。希望进一步改善题库处理效果时,可以用 Gemini 3.8 Flash 或 GPT 5.6 Luna 对照同一小样例。先根据出错阶段选择识图或拆题设置,具体见模型建议

导入前,最后核对五件事

  • 题目完整:条件、小问与跨页内容有没有遗漏。
  • 公式正确:正负号、指数、根号、区间开闭有没有变化。
  • 图片归属:每张图是否留在正确题目或选项中。
  • 题型与分类:是否需要手动调整章节、难度与标签。
  • 参考答案:原版答案是否完整;AI 补全内容需要教师复核。

样例也失败时,先查 API 和网络;只有某份资料失败时,先查文件格式、内容质量与长度。

搜索使用指南

输入问题或关键词,查找对应的操作步骤。