如何阅读报告
百分比不是判决。它是一种概率估计,仍需要由人来复核。
相似度报告
报告显示您的论文中有多少文字与找到的来源重合,以及这些片段具体出现在什么位置。
指标
- 原创度(引用不计为相似)
- 有多少文字未与任何来源重合。带“引用不计为相似”的指标把格式规范的引用算作您自己的文字,带“引用计为相似”的指标则不算。
- 逐字重合
- 一字不差的逐字重合。这是最确凿的信号:片段既能在正文中看到,也能在来源中打开查看。
- 改写
- 同一片段被调换词序或替换同义词后的改写——这是人工“提高原创度”留下的典型痕迹。
- 语义转述
- 把观点用自己的话复述。语义转述单独统计,因为转述本身并不构成违规;关键在于旁边有没有注明出处。
- 引用占比
- 正文中位于格式规范的引用之内的文字占比。若占比很高,说明论文是用他人的文字拼起来的,即便所有出处都标注齐全。
- 检测深度
- 来得及检测的句子数量。检测的句子越少,百分比旁边的置信区间就越宽。
已标注重合的正文
在论文全文中,每个找到的片段都以各自的颜色高亮显示,点击即可跳转到对应来源。
- 逐字重合
- 改写
- 语义转述
- 引用
来源
来源按类型分组。仅凭搜索摘要确认的来源会标注为“需人工复核”:页面本身未能打开。
- 互联网
- 学术论文
- 图书
- 规范性文件
- 需人工复核
规避检测的迹象
数值越高,说明文件中规避检测的技术痕迹越多。
AI 迹象报告
该检测评估文本有多像 AI 生成——既逐个片段分析,也看论文整体的文风。
AI 生成概率
结果是一个区间,而不是单一数字。区间窄,说明各项特征相互一致;区间宽,说明文本量少或文风不统一。
逐片段分析
论文会逐个片段拆开分析。值得关注的不是总体百分比,而是究竟哪些段落落入了“高概率”。
- 高概率
- 中等
- 低
改写探针
相似度高是 AI 生成的迹象:对 AI 写的文本,模型几乎不作改动。
误报在所难免:公文式的行文、模板化的方法论章节,以及非母语者写的文本,在模型看来同样平淡无起伏。
逻辑与事实准确性
该检测只查机器能够核实的内容:所列参考文献是否存在、论文是否自相矛盾、计算是否对得上。
- 参考文献
- 逻辑
- 计算
汇总
检出结果按严重程度划分。“严重”指的是并不存在的 DOI,或者对不上的计算;“轻微”指的是文献条目著录格式上的出入。
- 严重
- 中等
- 轻微
参考文献
“未能在目录中确认”并不等于“虚构”:乌克兰的图书、标准和早年的文章,国际目录往往本来就没有收录。这是人工核对该条目的理由,而不是结论。
- 已确认(目录收录或链接有效)
- 未能在目录中确认
- 不做自动检测(图书、标准)
报告不能证明什么
- 原创度指标取决于检测深度:检测的句子越少,置信区间就越宽。
- 我们的百分比与高校系统(Unicheck、StrikePlagiarism)在原理上不可比——数据库不同,方法也不同。
- 标注了出处的正确引用不算作抄袭,并已体现在“原创度(引用不计为相似)”这项指标中。
- AI 迹象的评估是概率性的。公文式的行文风格,以及非母语者撰写的文本,都可能出现误报。
- 仅凭搜索摘要确认的来源(页面未能加载)会标注为“需人工复核”。
本页列出的所有指标,在检测完成后会立即出现在报告中——网页版和 PDF 里都有。