导入指南
根据文件类型,找到合适的导入方法。
当前 PDF 批量导入的配图插入仍有问题。含配图的试卷,优先使用原始 Word 文件。 查看完整说明 →
我的文件,应该怎么导入?
| 文件类型 | 操作重点 | 关注的模型设置 |
|---|---|---|
| 原始 Word · .docx | 保留原文件,检查公式转换报告、图片与题目边界 | 试卷智能拆解模型 |
| 特殊公式 Word | 特别检查 MathType、旧式公式和人工核对提示 | 先查转换结果,再看拆题 |
| 文字型 PDF | 先尝试自动/原生提取,核对缺字与公式 | 拆题;必要时也需要识图 |
| 扫描版 PDF | 使用视觉 OCR 路径,先选少量页面 | 识图 + 拆题 |
| 单题截图 | 保持清晰完整,识别一题后核对再保存 | 默认公式识图模型 |
| LaTeX · .tex | 上传单文件,补齐对应插图;自定义宏须检查转换 | 试卷智能拆解模型 |
识图和拆题,是两件事
识图:把图片里的内容读出来
关注字、公式、上下标、表格是否准确。出现识别问题,先检查原图质量和提取方式,再尝试换「默认公式识图模型」。
拆题:把内容整理成一道道题
关注题目有没有合并、漏掉或拆断。原始文本完整而题目边界错误时,调整「试卷智能拆解模型」。
PDF 可能先提取原生内容,必要时再走视觉识别,最后进入文本拆题。使用硅基流动时,可先用 Qwen/Qwen3-VL-8B-Instruct 识图,再用 Qwen/Qwen3.8-27B 拆题。想改用 DeepSeek 拆题时,优先用官方平台的 deepseek-flash,并配置官方 Key。只更换「AI 智能解题模型」,不会修复前面的识图与拆题问题。
Word:先从原始文件开始
- 在「导入中心」选择
.docx文件。旧.doc请先在 Word 中另存为.docx。 - 选好「试卷智能拆解模型」,首次先关闭自动生成解答,点击「开始解析」,等待内容提取与拆题完成。
- 完成后查看 Word 提取报告与诊断提示,特别核对 MathType、特殊公式或复杂版式。入门可先选择硅基流动的
Qwen/Qwen3.8-27B处理小样例。 - 逐题检查图片归属、选项顺序与公式,修正后再导入。
Word 可以提取配图,但复杂浮动图、图片选项和特殊公式仍可能需要人工调整。把 PDF 转成 Word,并不等同于拿到原始 Word 文件。
PDF:先试 1–3 页,再按内容分段
80 页是程序允许的上限,不是推荐数量,也不是成功保证。内容会汇总进入拆题流程,公式密集或解析很长时,即使页数合规也可能超时或返回不完整。
- 先填页码范围
1-3,或用逗号选择不连续页,如1-3,5。 - 按完整试卷或小节分批,跨页的题目应把相关页一起选中。
- 排除不需要的封面、目录与长篇解析,检查提取的文字和公式。
- 小样例成功后,再适度增加内容;超时或漏题时优先缩小批次。
文件大小限制为 30 × 1024 × 1024 字节。选择页码范围可以减少处理页数,不能绕过原文件大小限制;超过大小限制时,需要先另存较小的 PDF 文件。
当前限制:PDF 配图导入
文字和公式识别成功,不代表几何图、统计图或图片选项已经随之导入。只有 PDF 时,导入后请逐题核对,在题目编辑器中补充缺失图片。换模型不能解决这一已知限制。
核对时应同时打开原始试卷和题目卡片,重点检查几何题、函数图像、统计图表以及含图片的选项。补齐图片并确认归属后再保存。
希望改善识别和拆题效果
硅基流动的 Qwen-VL 8B 可以常规使用;按作者经验,32B 整体识别效果更好,也可尝试 Qwen/Qwen3.8-27B。希望进一步改善题库处理效果时,可以用 Gemini 3.8 Flash 或 GPT 5.6 Luna 对照同一小样例。先根据出错阶段选择识图或拆题设置,具体见模型建议。
导入前,最后核对五件事
- 题目完整:条件、小问与跨页内容有没有遗漏。
- 公式正确:正负号、指数、根号、区间开闭有没有变化。
- 图片归属:每张图是否留在正确题目或选项中。
- 题型与分类:是否需要手动调整章节、难度与标签。
- 参考答案:原版答案是否完整;AI 补全内容需要教师复核。
样例也失败时,先查 API 和网络;只有某份资料失败时,先查文件格式、内容质量与长度。