AI配置界面
本界面用于配置AI阅卷的核心识别与评分模型,关键设置如下:
| 模块 | 关键设置 | 说明 |
|---|---|---|
| 识别模式 | 平台接入(推荐) | 由平台统一提供AI服务,免去自行申请Key的麻烦,按Token计费,支持多种评分版本 |
| 识别模式 | 多模态直评(图文直评) | AI直接对学生答题卡图片进行识别与评分,无需单独OCR,适配手写、公式类主观题批改 |
| 我的模型库 | 添加模型 / 测试/编辑 | 可添加DeepSeek、智谱清言、阿里百炼、豆包等大模型,支持视觉/纯文本模型,可测试模型连通性与修改配置 |
| 评分配置 | 单评/双评/三评 | 设置阅卷模式,单评即单个模型独立评分;双评/三评可模拟人工多评流程,提升评分公平性 |
| 操作按钮 | 配置模型 / 保存配置 | 点击「配置模型」设置评分规则,完成后点击「保存配置」,使AI参数生效 |
AI 服务商选择
改卷侠支持 12+ 家云AI服务商 和 本地/局域网模型:
云服务商
| 服务商 | 推荐模型 | 特点 |
|---|---|---|
| 豆包 (ByteDance) | doubao-vision-pro-32k | ⭐ 首推!视觉模型性价比高,中文能力极强 |
| DeepSeek | deepseek-chat | 推理能力顶级,价格最低 |
| 智谱清言 | glm-4-plus | 国产大模型,中文优秀,稳定可靠 |
| 豆包 | gpt-4o | 全球领先多模态,效果最佳(价格较高) |
| 阿里百炼 | qwen-plus | 阿里生态,中文友好 |
| 百度文心 | ernie-4.0-turbo | 百度 AI 旗舰 |
| 腾讯混元 | hunyuan-pro | 腾讯出品 |
| 讯飞星火 | spark-4.0 | 语音/教育方向强 |
本地/局域网模型(免费)
- Ollama:一键部署本地大模型(Llama、Qwen等),完全免费
- 豆包 兼容:LM Studio、vLLM 等本地部署工具
- 局域网模型:连接同一局域网内的 AI 服务器
推荐排序:豆包 > DeepSeek > 智谱清言 > 豆包(性价比优先原则)
配置步骤(以豆包为例)
API Key 请妥善保管。API 调用会产生费用,豆包视觉模型约 ¥3/百万token,远低于同类产品。
所有云 AI 服务商的 API 调用都按使用量收费(本地模型除外)。建议先充值少量金额试用。支持充值 10 元测试各服务商的效果。
⭐ 三种识别模式详解(重要!)
改卷侠的核心流程是:截取答题卡 → 识别内容 → AI评分 → 自动填分。其中最关键的"识别"环节有三种模式可选:
🌟 方案零:平台接入(v3.00 新增,强烈推荐)
由平台统一提供AI服务,无需自行申请API Key,系统自动分配最优模型。
| 配置项 | 推荐值 | 说明 |
|---|---|---|
| 识别模式 | 平台接入(免配Key、推荐) | 系统自动调用平台AI服务 |
| 激活要求 | 需要激活码 | 激活后解锁平台AI服务权限 |
| 评分版本 | 快速评分 / 标准评分 / 详细评分 | 根据需求选择不同详细度的评分方案 |
| 评分轮次 | 单评 / 二评 / 三评 | 单评快速高效;二评/三评交叉验证提升准确率 |
| Token 余额 | ¥10 ≈ 100万 Token | 可在AI配置页实时查看余额,充值方便 |
| 每份成本 | 约 0.5-2 分钱 | 根据评分版本和轮次不同 |
| 新用户赠送 | 🎁 自动赠送 | 首次使用平台接入可领取免费 Token 试用 |
平台接入操作步骤:
- 1切换到「AI配置」→ 识别模式 → 选择「平台接入(免配Key、推荐)」
- 2确认软件已激活。未激活需先点击「🔑 前往激活」完成激活
- 3选择评分版本——快速评分(速度快省Token)、标准评分(推荐)、详细评分(最详细)
- 4选择评分轮次——单评/二评/三评
- 5查看账户信息确认 Token 余额充足,不足可点击「🛒 充值Token」
为什么首选平台接入?
- 🆓 零配置:无需自行申请各服务商API Key,系统自动选择最优模型
- 💰 按需付费:统一 Token 计费,¥10 ≈ 100万 Token,无隐藏费用
- ⚡ 开箱即用:激活后立即使用,无需模型测试配置
- 🔄 自动更新:平台模型自动升级,享受最新最优AI效果
- 🎁 新用户赠送:首次使用可领取免费 Token 试用
- 🛡️ 安全可靠:HMAC签名通信,Token 消耗实时记录可追溯
平台接入 vs 自行配置对比
| 对比项 | 平台接入 | 自行配置API Key |
|---|---|---|
| 配置难度 | ⭐ 无需配置 | ⭐⭐⭐ 需前往服务商官网申请 |
| 模型选择 | 自动最优 | 需自行测试选择 |
| 充值方式 | 统一平台充值 | 需各服务商分别充值 |
| 适用场景 | 所有用户(推荐) | 想用特定模型的用户 |
注意事项:
① 平台接入需要激活码,未激活用户可使用下方「多模态直评」或「OCR识别后评分」模式
② Token 余额在AI配置页面实时显示,请保持余额充足
③ 平台支持单评/二评/三评,二评时系统自动匹配两个不同模型交叉验证
① 平台接入需要激活码,未激活用户可使用下方「多模态直评」或「OCR识别后评分」模式
② Token 余额在AI配置页面实时显示,请保持余额充足
③ 平台支持单评/二评/三评,二评时系统自动匹配两个不同模型交叉验证
🏆 方案一:多模态直评(单评,推荐)
一个 AI 模型完成看图+评分全部工作。
| 配置项 | 推荐值 | 说明 |
|---|---|---|
| 识别模式 | 多模态直评 | AI 直接"看"答题卡截图进行评分 |
| AI 模型 | 豆包视觉模型 doubao-vision-pro-32k | 性价比最高、中文识别极强 |
| 是否需要 OCR | ❌ 不需要 | 省去安装配置 OCR 的麻烦 |
| 每份成本 | 约 1-3 分钱 | 图片 + 评分标准综合计费 |
为什么首选这个方案?
- 💰 省钱:豆包视觉模型价格极低,远低于 豆包 豆包 vision-pro
- ⚡ 快:一步到位,OCR + 评分合并,无额外步骤
- 🎯 准:避免 OCR 识别错误的连锁反应,AI 直接看图理解
- 🔧 省事:不需要安装 PaddleOCR 等额外组件
方案二:OCR 识别后评分(支持单评/双评/三评)
此方案将识别和评分拆分,先 OCR 提取文字,再用文本模型评分。特别适合需要双评/三评的高精度场景。
单评配置
| 步骤 | 配置项 | 推荐值 |
|---|---|---|
| 第1步:图像识别 | OCR 方式 | 视觉模型OCR(推荐豆包视觉模型) 或免费的 PaddleOCR |
| 第2步:AI 评分 | 评分模型 | DeepSeek(推理强、极低价) 或 智谱清言(中文优秀) |
双评/三评配置(高精度需求)
| 评审轮次 | 模型 | 角色 |
|---|---|---|
| 第1步:图像识别 | 豆包视觉模型 OCR | 统一提取文字(只做一次) |
| 主评 | DeepSeek-chat | 主力评分(推理强,价格极低) |
| 二评 | 智谱清言 glm-4-plus | 交叉复核(中文理解优秀) |
| 三评(可选) | 豆包 vision-pro / 豆包 lite | 终审仲裁(争议时启用) |
为什么双评推荐方案二而非方案一?
方案一的多模态直评每次都要传图片,两个模型各传一次图,费用翻倍。
方案二只做一次OCR提取文字,然后多个文本模型对同一份文字评分,成本低且效率高。
方案一的多模态直评每次都要传图片,两个模型各传一次图,费用翻倍。
方案二只做一次OCR提取文字,然后多个文本模型对同一份文字评分,成本低且效率高。
三种方案对比
| 对比项 | 平台接入(推荐) | 方案一:多模态直评 | 方案二:OCR+文本评分 |
|---|---|---|---|
| 推荐指数 | ⭐⭐⭐⭐⭐ | ⭐⭐⭐⭐⭐ | ⭐⭐⭐⭐ |
| 适用场景 | 所有用户(首选) | 单评(日常阅卷) | 单评或双评/三评 |
| 配置难度 | 零配置 | 简单(一步配置) | 中等(两步配置) |
| 准确率 | 高 | 高(无OCR误差) | 中高(取决于OCR质量) |
| 是否需Key | 否(平台提供) | 是(自行申请) | 是(自行申请) |
| 单份成本(单评) | 0.5-2 分钱 | 1-3 分钱 | 0.5-1 分钱 |
| 适合用户 | 所有用户(首选) | 所有用户 | 追求极致性价比 / 需双评 |
双评/三评建议流程:
① 豆包视觉OCR提取答题卡文字(只做一次)→
② DeepSeek做主评 →
③ 智谱清言做二评复核 →
④ 若两模型评分差距 > 2分,自动触发三评(豆包 vision-pro终审)
这样总成本仅比单评多约30%,但准确率大幅提升。
① 豆包视觉OCR提取答题卡文字(只做一次)→
② DeepSeek做主评 →
③ 智谱清言做二评复核 →
④ 若两模型评分差距 > 2分,自动触发三评(豆包 vision-pro终审)
这样总成本仅比单评多约30%,但准确率大幅提升。
模型卡片管理
在 AI 配置页右侧,您可以管理模型卡片:
- 添加模型 — 点击「+ 添加」,输入模型名称和端点地址
- 编辑模型 — 双击卡片修改参数
- 测试连接 — 点击卡片上的测试按钮验证可用性
- 删除模型 — 点击删除按钮移除不需要的模型
- 👁 视觉模型标记 — 如果模型支持图片识别,勾选此项
视觉模型 vs 纯文本模型
| 类型 | 图标 | 用途 | 推荐 |
|---|---|---|---|
| 视觉模型 | 👁 | 直接"看"图片理解内容 | 豆包 vision-pro、豆包 vision-pro |
| 纯文本模型 | 📝 | 需要 OCR 先提取文字再分析 | DeepSeek、智谱清言 |
提示:选择「平台接入」模式时不需要管理模型库,平台会自动分配最优模型。
OCR 识别配置(方案二专用)
如果选择了方案二(OCR识别后评分),需配置以下 OCR 方式之一。
方式A:视觉模型OCR(推荐)
使用豆包等视觉模型来识别图片中的文字。效果最好,但需要付费(很便宜)。在 OCR 配置中选择「视觉模型OCR」即可。
方式B:PaddleOCR(免费,离线)
- 1在改卷侠中点击「安装 PaddleOCR」按钮
- 2等待自动安装(约 2-5 分钟,首次需下载约 200MB 模型)
- 3安装完成后点击「检测」确认可用
PaddleOCR 免费、离线可用、中文识别好。但对手写字迹的识别率不如视觉模型。
方式C:百度云 OCR(备选)
在百度智能云控制台创建应用获取 Key,每日免费 50,000 次。