看典古籍网站疑难解答
本文整理用户日常使用中集中反馈的网站相关的问题进行解答。
古籍查阅相关
在看典古籍网站如何查找古籍?
看典古籍网站中提供了多种查找古籍的方式:
书籍详情页有哪些内容?
进入书籍详情页后,您可以:
- 查看书籍信息:包括书名、作者、年代、分类、页数、字数、来源等基本信息;
- 浏览分卷:查看该古籍的所有分卷,每个分卷显示封面、页数、字数,点击可进入阅读;
- 书内检索:在书籍详情页右侧的检索框中输入关键词,可在本书范围内进行全文搜索,支持简繁同检;
- 查看大纲/高频词:页面中展示该书的大纲结构和词频统计,帮助您快速了解全书内容脉络;
- 相关推荐:页面底部会推荐本书的相关古籍,方便您拓展阅读;
- 下载古籍:部分古籍提供百度网盘、夸克网盘等下载链接,可在详情页获取。
如何阅读古籍?
在 首页、善本大全 中点击书籍卡片,进入书籍详情页,可以查看 分册、分卷 ,点击 开始阅读/继续阅读 进入阅读页。
如上图:
- 左侧显示当前分册的所有分页,滑动可以预览查看分页列表,点击任一页打开该页内容
- 当前页图像 点击/双击 可以全屏显示图像,通过鼠标滚动滚动放大/缩小图像
- 当前页文本 中显示OCR后的文本(未校对、历史版本OCR所识别不代表当前平台OCR能力);
- 选择文字弹出 书内检索/全文检索
- 点击 书内检索 在该书内检索该关键词,点击 全文检索 在所有书中检索该关键词
- 底部功能区 中通过 上一页/下一页 翻页,在跳转框中输入页面,回车/点击跳转 跳转到该页面
- 点击 图像/图文 切换图像阅读模式或图文阅读模式,图像阅读不显示右侧的文本
- 点击 转简/转繁 切换简体或繁体文本
- 点击 书内检索 打开书内检索弹窗
- 在检索框输入检索词,回车/点击检索 在当前书内检索该词,检索结果分条显示,点击每一条的 打开 按钮在新标签页打开该页,点击 复制 按钮复制该页文本。
为什么图文对照阅读文字内容有错误?
目前网站提供的图文对照内容是经过历史版本的看典古籍OCR识别的,没有做过校对,所以会有错误的情况。
怎么找我的阅读记录
您在 登录账号 后,阅读古籍后将记录到历史记录中。
所有的历史记录的查看入口在右上角,点击账号,弹出 历史记录 ,点击进入历史记录查看。
在阅读记录中显示所有阅读记录,阅读过的书籍在书籍卡片上显示 继续阅读
记录卡片上显示 书名、分卷、上次阅读时间、上次阅读页
什么是“收藏古籍”?
您在看看典古籍网站上看到感兴趣的古籍,可以在书籍卡片上点击收藏本书,将这本书记录到您的 收藏记录 中
收藏记录的入口在账号下拉的收藏记录中,在收藏记录中可以管理已收藏的书籍。
网站如何推荐古籍?
在看典古籍网站中,每本书籍详情页底部会展示 相关推荐 书籍,这些推荐基于书籍的分类自动匹配。
您也可以浏览 善本大全 页面中的 精选古籍 和 推荐古籍 板块,发现更多感兴趣的内容。
全文检索
全文检索是什么?怎么使用?
全文检索 是看典古籍提供的全站古籍内容搜索引擎,可以对站内上千万古籍页面中的文字内容进行快速检索。
使用方法:
- 在顶部导航栏点击 全文检索 ,进入检索页面
- 在检索功能区下的检索框中输入您要查找的关键词,回车/点击检索 开始检索
- 选择检索模式: 模糊匹配 (包含相近结果)或 精确匹配 (严格匹配关键词)
- 检索时默认开启 简繁同检 检索时同时检索简体和繁体的关键词
- 在 最近检索 中显示您最近的检索词(保存在浏览器中,换浏览器会丢失)点击历史记录中的关键词即可快速再次搜索,点击"清空"可清除所有历史记录
- 点击 热门检索词 中的关键词,直接检索该词,点击 换一换 刷新热门检索词
检索完成后显示检索结果:
- 匹配文本片段:显示关键词在古籍原文中的上下文,关键词会高亮显示;
- 所属书籍和卷册:标明该段文字出自哪本书、哪一卷;
- 搜索耗时:显示本次检索所用的时间;
- 结果总数:在全站范围内匹配到的结果总条数;
- 涉及书籍统计:展示匹配结果覆盖了多少本不同的古籍。
可以点击 相关度/点击量/书名 切换排序方式
点击每一条的 打开 按钮在新标签页打开该页,点击 复制 按钮复制该页文本,在底部分页功能区操作翻页。
简繁同检是什么意思?
由于古籍文本中同时存在简体和繁体汉字, 简繁同检 功能会自动将您输入的关键词同时以简体和繁体两种形式进行检索,确保不会因为字体差异而遗漏结果。
例如:您输入"诗经",系统会自动同时搜索"诗经"和"詩經",返回所有匹配的结果。此功能为默认开启,无需额外设置。
书内检索
如何在某本书内进行检索?
书内检索有多个入口,在 书籍详情页 中,右侧功能区书内检索按钮、 阅读页 中底部功能区、阅读页 选择文本弹出书内检索按钮,点击按钮打开书内检索弹窗
- 在页面中找到搜索框,输入关键词;
- 选择检索模式(支持简繁同检);
- 点击检索,系统将在本书范围内搜索匹配的内容。
书内检索会展示匹配文本、所属卷册和页码,点击即可跳转到对应页面阅读。与全文检索不同,书内检索仅在当前书籍范围内搜索,更加精准。
书内检索和全文检索有什么区别?
对比项 全文检索 书内检索 搜索范围 全站所有古籍 当前这一本书的所有分册中 适用场景 不确定具体在哪本书中,需要广泛搜索 已确定书籍,需要精确定位书中内容 入口位置 顶部导航栏"全文检索" 书籍详情页内、阅读页内
古籍数字化——PDF识别
PDF识别功能是什么?
PDF识别 是看典古籍提供的古籍数字化服务之一,您可以将古籍PDF文件上传到平台,系统会自动进行OCR文字识别,识别完成后下载多种格式的文字文档。
适用场景:您手头有古籍的PDF扫描文件,想要提取其中的文字内容进行整理、研究或校对。
如何使用PDF识别?
- 登录账号后,点击顶部导航栏的 古籍数字化 进入数字化页面
- 选择页面底部的 PDF识别 标签页
- 设置识别参数
- 点击 开始识别 ,选择您的古籍PDF文件
- 上传完成后,系统将自动开始识别
- 识别完成后,您可以在任务列表中查看和下载识别结果
- 我们提供多种文档格式供下载,点击对应文档进行下载
古籍数字化——多图识别
多图识别功能是什么?
多图识别 是看典古籍提供的古籍数字化服务之一,您可以将古籍图像文件上传到平台,系统会自动进行OCR文字识别,识别完成后下载多种格式的文字文档。
如何使用多图识别?
多图识别功能和PDF识别功能操作方式一致
- 登录账号后,点击顶部导航栏的 古籍数字化 进入数字化页面
- 选择底部的 多图识别 标签页
- 设置识别参数
- 点击 开始识别 ,选择您的古籍PDF文件
- 上传完成后,系统将自动开始识别
- 识别完成后,您可以在任务列表中查看和下载识别结果
- 我们提供多种文档格式供下载,点击对应文档进行下载
正在识别中的任务能不能取消?
可以取消。如果您上传错文档或不想继续识别时,对于尚未开始或正在进行的任务,点击 识别状态 右侧的 取消任务 按钮,取消该任务;已取消的任务不会消耗识别额度,已完成的识别任务不可取消。
如何使用单图识别(图像识别)?
单图识别 功能可以选择一张图像进行识别,识别后显示可编辑的识别结果,方便查看识别效果
识别完成后中间显示图像,右侧显示识别结果,可以进行 合并结果、转简体、竖排显示、复制文字 等操作
OCR识别参数是什么?
在使用看典古籍OCR功能时,您可以调整以下参数以获得更好的识别效果:
文本排版方向:图像上文本行的排版方向,分为 横排、竖排
- 自动识别:识别时算法自动判断该图像中文字排版方向,部分图像自动识别会有错误的情况,需要手动指定排版方向
- 指定竖排/横排模式:手动指定排版方向,可以避免排版方向识别错误的情况
如果存在混排情况,选择大部分文本行的方向,示例图像如下:
识别版本选择:识别版本是指我们提供的OCR算法的不同版本,不同版本有不同的优势和功能差异
- 标准识别版本:第一版识别算法,23年完成上线(后续将下线)
- OCR最新v2版本:最新版识别算法,25年完成上线(推荐)
- 语序优化beta版:针对标准古籍优化,排序准确率更高,24年完成上线(功能有限,后续将下线)
您可以在古籍数字化-图像识别中选择不同版本在您要识别的图像上进行测试,看哪个版本效果好就选择哪个版本
版面识别设置:古籍图像众多,不同图像有不同的排版,需要根据不同排版/不同需求控制识别算法
- 不识别版面:不开启版面识别算法,仅常规识别
- 版面识别-内容全识别:开启版面识别算法,判断图像中是否有多栏,分块识别每个版块内的内容,当前版面识别有两个类别:正文和非正文 两个,非正文是指:版心区域、页眉/页脚、页码等。开启后所有内容均会识别出来
- 版面识别-只识别正文:开启版面识别算法,但是 过滤非正文内容 ,仅识别正文内容
- 欧式家谱:针对欧式类型家谱的识别算法,可以格式化输出内容
示例如下图,图中红色框区域是非正文区域,蓝色框内是正文区域
是否自动插入空格:在横排图像中,通过该参数可以控制是否在行内字之间插入空格,行内文字之间存在间距时插入空格到该位置
- 根据间距自动插入空格:开启
- 不插入空格:不开启
示例如下,
开启后返回:“将进酒 君不见...”,不开启后返回:“将进酒君不见...”
横排句子文字排序方向:在横排图像中,通过该参数可以控制行内文字排序方向
- 从左到右:设置文字从左到右排序,如:“将进酒君不见...不复回。”
- 从右到左:设置文字从右到左排序,如:“。回复不...见不君酒进将”
如以下图像,标题的正确阅读顺序应该是从右到左,建议设置为从右到左
竖排句子文字排序方向:在竖排图像中,通过该参数可以控制行内文字排序方向
- 从上到下:设置文字从上到下排序
- 从下到上:设置文字从下到上排序
识别模式选择:可选文本行级识别和字符级识别
- 文本行检测识别:先识别文本行,再识别文字内容,默认使用行级识别
- 字符检测识别:只识别所有文字内容,不关注文本行,推荐在 单行截图 识别时设置,可以识别行内所有文字
示例如下:
图像尺寸调整:在 PDF转图像、图像识别 时可以指定图像大小,默认2000,该数值越大,图像提取越慢,识别速度也越慢,建议保持默认
- 2000:建议在1000-2000内,过大、过小也会影响到识别效果
识别结果转简体:在识别后将识别结果转为 简体文字
- 保持与图一致:原图是什么文字就怎么识别,不操作识别结果
- 文本转简体:将识别结果转为简体中文
示例如下:
文本简繁转换怎么使用?
网站提供了独立的 文本简繁转换 功能,支持将任意文本在简体和繁体之间转换。打开 简繁转换 页面
在待转换输入框中输入内容,点击 转简体、转繁体、复制转换结果 等按钮进行对应的操作
OCR API
看典古籍OCR API是什么?
OCR API 是看典古籍提供的程序化文字识别接口,允许开发者通过API调用方式将古籍OCR识别功能集成到自己的应用或工作流程中。
适合人群:
- 有批量古籍数字化需求的开发者或研究人员;
- 需要将OCR功能集成到自己软件或网站中的开发者;
- 有自动化处理古籍图片/PDF需求的高级用户。
如何申请OCR API使用权限?
- 登录账号后,进入 古籍数字化 页面,点击 OCR API 标签;
- 新账号没有API Token需要点击 新增Token 按钮创建,提交申请后,系统会生成一个API Token
- API Token创建后显示在 我的API Token 中,可以查看该Token的使用信息,表格说明
- API Token:作为身份验证凭证,点击进行复制,需要注意保密,避免泄露
- 账号:Token搭配的账号(网站登录账号),可以将Token理解为密码,当账号和Token匹配时才可用
- 状态:标记Token的状态,可用/不可用,可用表示可以正常使用
- 统计(已用/共计):该Token的额度信息,已用额度/总额度
- 操作:续加额度(给该Token增加识别额度,可申请额度限制看当日可申请);充值额度(通过付费增加识别额度)
- 每个Token额度申请记录在 API Token记录 中显示,点击右侧的删除按钮可以删除记录
- 每次续加额度,在 当日可申请范围内 的申请都会自动通过,无需等待审核。
API接口有哪些?怎么调用?
OCR API提供以下主要接口(详细调用方法请参阅 API文档 页面):
- 图像识别接口:上传单张图片进行OCR识别;
- Token状态查询接口:查询当前Token的剩余可用次数和状态。
调用时需要在请求中附带您的API Token作为身份验证凭证。详细的接口参数、请求示例和响应格式请查看 API文档 页面(通过古籍数字化页面中的链接进入)。
古籍校对
古籍校对平台是什么?
古籍校对平台(3.0版本) 是看典古籍提供的专业古籍文字校对工具。您可以上传古籍文件,系统会先进行OCR识别,然后在平台上进行人工校对,最后导出校对完成的文件。
校对平台支持两种校对模式:字校模式 和 句校模式 ,这两种模式的详细介绍查看 校对模式对比
如何创建校对任务?
- 登录账号后,点击导航栏中的 古籍校对 进入校对任务页面
- 点击 创建任务 按钮,打开任务创建弹窗
- 上传您要校对的古籍文件(支持PDF和图片)
- 设置校对参数(参见OCR参数),选择校对模式
- 提交任务后,系统先进行OCR识别,识别完成后即可进入校对
任务创建后可以在任务列表中查看进度和状态。
校对平台支持导出哪些格式?
校对完成后,您可以将校对结果导出为以下格式:
- 双层PDF:(字校模式)在原始图像上叠加校对后的文字层,既保留原图又支持文字搜索和复制
- Word文档:文档格式,文本文档写入到Word文件中
- TXT:纯文本格式,方便在其他软件中编辑
- JSON:结构化数据格式,保留文字位置信息,适合程序化处理
句校模式
句校模式是什么?适合什么场景?
核心理念:以"行"为单位进行校对,整行文字显示在文本编辑器中,直接修改即可。效率优先,适合快速通校。
主要功能
- 文本编辑器直接修改:与普通文本编辑器类似,所见即所得。
- 图像对照:左侧显示古籍原图,右侧显示识别的文字,对照查看。
- 框选重新识别:在图像上鼠标左键拖拽框选区域,即时OCR识别框中文字,结果可插入编辑器。
- 合并分行:将选中的多行文字合并为一段,适合处理因排版造成的错误断行。
- 横排/竖排切换:根据古籍排版方向切换编辑器的文字显示模式。
- 查找替换:在当前页文本中查找并替换指定内容。
- 竖排/横排重新识别:按指定排版方向对整页重新OCR识别(会覆盖原有文字)。
- 翻页自动保存:开启后,切换页面时自动保存编辑内容。
适合场景
- 文字质量较好、错误较少的古籍
- 需要快速通读校对的场景
- 只需要导出TXT/Word文本的场景
- 不需要逐字定位坐标的场景
字校模式
字校模式是什么?适合什么场景?
核心理念:以"字"为单位进行校对,每个字都有独立的边界框和坐标信息。追求精度,适合学术出版级别的精细校对。
主要功能
- 标记行:在古籍图像上手动框出每行文字的区域,精确控制OCR识别范围。
- 校对行:逐行显示图像,每个字独立标注,支持点击修改和候选字替换。
- 对照模式:左右分屏,原图与文字叠层对照查看,支持点击原位修改。
- 行/字排序:手动调整行与字的阅读顺序,处理古籍复杂的排版。
- 批量校对:按字形将相同字归为一组,统一查看和修改,大幅提高效率。
- 疑难字处理:标记存疑的字,集中抽取后附带原图截图进行辨认。
- 导出双层PDF:生成图文叠加的双层PDF,上层为原始图像,下层为校对后的文字。
- 导出JSON(含坐标):每个字的位置坐标、置信度等完整数据。
适合场景
- 古籍质量较差、需要精细调整的场景
- 学术出版、需要精校的研究项目
- 需要导出双层PDF或JSON坐标数据的场景
- 文字排版复杂(竖排、不规则排列)的古籍
句校模式和字校模式如何选择?
对比项 句校模式 字校模式 校对粒度 按句子/段落校对 按单个字符逐字校对 适合文本 OCR准确率较高的文本 OCR准确率较低、需要精细校对的文本 校对速度 较快 较慢但更精细 操作方式 类似编辑文档 逐行逐字对照图片校对 适用人群 一般用户、快速校对 专业研究者、严格校对
会员相关
会员模式是什么?不开通会员能用吗?
看典古籍网站的 所有功能均免费开放使用 ,不开通会员不会影响您使用网站的任何功能。
会员模式 推出的原因:由于网站用户量不断增多,古籍识别量持续增加,高昂的算力费用和服务器费用站长个人承担压力增大,为了提供更好的服务推出了会员模式。
会员用户与普通用户的 区别仅在于古籍识别的每日/每月可用额度不同 ,功能上没有差别。
会员有哪些等级?各有什么权益?
网站提供以下会员等级:
会员等级 古籍识别额度 说明 普通用户 基础额度 注册即享,满足个人偶尔使用的需求 月度会员 较高额度 适合有持续古籍数字化需求的用户 年度会员 最高额度 适合有大量古籍数字化需求的研究者或机构 具体的每日/月识别次数额度请登录后在 会员中心 页面查看。
如何开通/续费/升级会员?
- 登录账号后,点击顶部导航栏中的 会员中心
- 在会员中心页面可以看到当前会员状态
- 如果您是 普通用户 ,点击 开通会员 按钮
- 如果您已是会员,点击 续费 延长会员有效期
- 如果您想升级到更高级别,点击 升级会员 按钮
- 选择您需要的会员方案,支付完成付款
- 支付成功后会员立即生效,可以在页面中查看更新后的会员状态和使用额度
如何查看我的会员状态和充值记录?
在 会员中心 页面可以查看:
- 当前会员状态:会员类型、到期时间、剩余天数;
- 充值记录:订单号、充值时间、会员类型、充值金额、有效期、支付方式、状态等详细信息。
古籍识别的额度是怎么计算的?
- 古籍识别额度按 识别页数 计算,每识别一页古籍图片或PDF页面消耗1次额度;
- 额度分为 每日额度 和 每月额度 ,每日额度用完当天将无法继续创建识别任务;
- 额度的重置时间根据会员类型有所不同,普通用户按自然月重置,会员用户按开通日期起算30天周期重置。
充值会员能不能开发票?
开通会员、API充值都可以开发票,消费后联系客服开具电子发票。
工具软件相关
看典古籍提供哪些工具软件?
看典古籍目前提供两款桌面端工具软件,均可免费下载使用:
- 看典古籍OCR客户端:截图识别、图像文件识别、PDF文件识别的桌面工具;
- 易校古籍:全书识别、图文对照校对、截图识别的校对工具。
两款软件的下载入口在导航栏的工具下载页面。
看典古籍OCR客户端是什么?有哪些功能?
看典古籍OCR客户端 是一款专为古籍识别设计的Windows桌面软件,主要功能包括:
- 屏幕截图识别:直接在屏幕上框选古籍文字区域,自动识别并转换为可编辑文本;
- 图像文件识别:选择本地图片文件进行OCR识别;
- PDF文件识别:支持单个PDF文件识别;
- 多文件批量识别:支持多个PDF、多张图像按任务模式依次识别,每个任务可独立设置识别参数;
- 实时识别:截图后即时返回识别结果,无需手动输入;
- 追加模式:识别结果可以追加显示,支持字号调整,方便对比修改;
- 转简体功能:识别结果可以自动转换为简体中文。
客户端与网站的古籍数字化功能同步,支持OCR V2版本算法参数。
易校古籍是什么?有哪些功能?
易校古籍 是一款专为古籍文字校对设计的Windows桌面软件,主要功能包括:
- 全书识别:配合看典古籍OCR接口,快速识别整本书的文字内容,实现全面数字化;
- 图文对照校对:将原始图像与识别文字并排显示,方便逐字校对;
- 标题与分页:支持插入标题和分页标记,导出为Word文档时保留标题格式,方便后续编辑排版;
- 难打字与组合查字:提供自定义难打字功能,支持通过偏旁部首查找汉字,解决罕见字输入难题;
- 截图识别:支持在屏幕任意区域截图进行文字识别,适用于快速处理特定内容;
- 界面简洁:操作简单直观,无需复杂的学习过程即可上手。
工具软件下载安装注意事项
- 软件目前尚不成熟,可能在部分电脑上存在兼容性问题;
- 部分电脑下载时安全软件可能提示风险,属于正常情况,请根据自身情况选择是否使用;
- 软件为Windows版本,其他操作系统暂不支持;
- 如需更多帮助,欢迎加入用户群获取最新版本和技术支持。
账号相关
如何注册和登录?
看典古籍支持以下登录方式:
- 手机号注册登录:使用手机号接收短信验证码完成注册和登录;
- 微信登录:支持微信扫码登录。
登录入口在网站右上角,点击 登录 按钮即可选择登录方式。
如何修改密码?
- 登录后右上角昵称上点击打开 修改信息;
- 选择 修改密码 ;
- 输入原密码和新密码即可完成修改。
如果忘记密码,在修改信息窗口点击 忘记密码 ,通过手机号或邮箱验证后可以重置密码。
如何修改用户名?
登录后进入修改信息窗口,可以直接编辑修改您的昵称/用户名。
网站通知设置怎么管理?
在个人设置中,您可以设置是否接收邮件通知。开启后,当古籍数字化任务完成等事件发生时,系统会向您绑定的邮箱发送通知。
其他常见问题
如何提交反馈和建议?
在网站底部或相关页面中找到 反馈 入口:
- 填写您的反馈内容;
- 提交后我们会收到通知并及时处理。
我们非常重视用户反馈,欢迎您提出任何意见或建议!
看典古籍OCR怎么用?
看典古籍OCR 是一款古籍图像文字识别引擎,您可以在 看典古籍网站 上的 古籍数字化功能、古籍校对功能,上传 古籍图像、古籍PDF 进行识别,识别完成后查看文字内容。
看典古籍上传失败怎么办?
如果您在上传文件时提示上传失败,请可以按照以下流程进行检查:
- 检查设备是否有网络,使用 Ctrl+R 或 Ctrl+F5 刷新网页,然后重新上传
- 观察上传进度的速度,如果上传速度很慢,一般在10分钟未上传完成会提示上传失败,上传超时错误可能是您的设备网速较慢,可以减少上传的图像数量、分割PDF减少文件大小后再上传
- 多次失败后请联系网站客服定位错误问题
看典古籍账号被封了怎么解?
如果您注册多账号批量使用看典古籍提供的数字化功能、批量抓取网站内容,将被封号处理。
您可以联系网站客服表明原因后酌情解封。
看典古籍创建任务要多久?
古籍数字化和古籍校对均需要上传文件到服务器进行识别处理,任务创建流程如下:
- 上传文件(将文件上传到服务器,速度取决于本机网速、服务器网速,看上传进度的速度可以判断上传速度)
- 解析文件(文件上传成功后在服务器进行解析,一般0-1秒一页)
- 逐页识别(在服务器进行识别)
- 打包结果(在服务器打包识别结果)
其中在 上传文件 时需要停留在页面等待创建完成,创建完成后会有提示信息,看到开始解析、识别时可以刷新网页查看实时进度。
看典古籍进不去?
网站打不开一般会有以下原因:
- 本机没有网络
- 网站服务出错了,提示 502,服务器出错、服务器正在维护 等信息,请联系网站客服或在 看典古籍 公众号进行反馈,我们会第一时间处理。


























