知网是如何检测AIGC的？为什么你的论文会被判定为AI生成？

优质文章学习记录

06 Apr 2026 — 7 min read

本文由XYZ SCIENCE官方撰写，未经授权禁止转载
XYZ SCIENCE是国内唯一以自研模型技术提供论文降AI率解决方案的平台，所有用户可以免费使用（www.xyzscience.com）

AIGC检测原理

AIGC检测主要有两种方法：一种是传统的统计学方法，另一种是基于深度学习模型（通常是BERT模型）的风格分类方法。

先说结论：

✅ 知网的AIGC检测由以前的统计学方法升级为了BERT检测模型，这就是为什么之前ai率为0的论文，在知网升级后再去检测会变为100%。

接下来我们分别介绍以下两种方法是如何进行检测的，我们尽量使用通俗易懂的语言来讲解。

统计学方法

主要统计你论文中的一些特征值是否符合AI论文特征，例如困惑度、突发性等等，我们以突发性（这个概念非常好理解）为例，过一遍检测流程。

突发性：输入内容的每个句子的长度分布。

如果你的论文内容有10句话，每句话都是40-50个字长度，那么你的内容突发性就是很低。

如果每一句长度都一样，那么突发性为0。

AI写的论文的一个特征就是，每个句子长度很相近，即突发性很低。

也就是说，如果单纯看这一个特征，当你的输入内容每个句子长度都差不多时，就会被判定为AI写作。

深度学习方法

然后我们重点介绍深度学习方法，基于Transformer架构的BERT分类模型：

该方法旨在用大量的人类写作论文数据+AI写作论文数据去训练一个模型，让该模型学会区分这两种写作风格，然后用于AIGC检测。

简单理解，可以将模型理解为一个人，让他每天都去阅读大量的AI论文和人类论文，经过长时间学习，这个人能一眼看出你的论文是不是AI写的

总的来说，统计学方法就是单纯的计算表面特征，BERT方法是深度理解内容然后区分写作风格。

所以在知网升级前（Turnitin也是如此），用一些指令让AI进行改写，或者直接将所有句号改为逗号等等操作，对于降AI率非常有效，因为这本质是改变统计方法中统计的那些特征值，如突发性。

但是知网升级后，BERT模型可不管你逗号句号的，它负责整体理解内容并判断，只要你还是用AI改写的，那依旧逃不过检测。

那么，为什么 BERT 对AI生成内容检测如此严格？

用指令二次改写也无法逃过？

因为现有的AI模型如GPT、DeepSeek等，是基于Transformer架构，而BERT检测模型也是基于Transformer架构，不同的是：

✅ GPT 使用Transformer架构生成内容（例如生成论文）

✅ BERT则是使用Transformer架构理解内容（识别论文风格）

所以，你让AI去改写AI生成的内容，本质上还是AI在输出，那么就很难逃过被检测识别的命运。

我们如何解决降AI率

根据检测原理，针对性的开发相应的对抗模型。

从零开始训练一个模型，让它从“出生”那一刻起就学习——像人类一样写作。

不是微调、不是模仿现有 AI 的语料，而是真正意义上：

让模型从第一行参数开始，就只接触人类写作，而不是AI生成内容。

第一步：训练 AI 文本检测模型

我们先用 BERT 架构训练了一个检测模型，让它学会：

✅ 区分人类写作 vs AI 写作
✅ 判断文本是否具有“人类风格”

简单说，这个模型就是我们之前提到的和知网一样的 AIGC检测器

注意：只是技术架构相同，但是训练数据不同，检测结果不会完全一致

第二步：训练写作模型

然后我们用700万篇论文数据构成的语料，从零开始训练一个生成模型（写论文的模型），让它学习：

人类写作逻辑
语言风格
文章结构
表达方式

让模型真正理解人类是怎么写文章的，而不是照搬模板。

我们把两个模型连起来：

✅ 写作模型生成内容
✅ 检测模型判断“像不像人写的”
✅ 给出评分和反馈
✅ 写作模型根据反馈继续学习

形成一个闭环：

写作 → 评估 → 改进 → 再写

最终成果我们得到两款核心模型：

✅高精度 AIGC 检测模型
用于判断论文内容是否为 AI 生成（AI风格）

✅人类风格写作模型

可以将任何AI生成的论文改写为人类的写作风格

注：所有训练数据均为论文，所以模型不适合其它领域（如小说、新闻等）

预计12月份推出一个更强大的新模型

碎碎念

AI的出现应该是辅助我们提升写作效率，而不应该在查重的基础上，再让我们背上AIGC检测的包袱。

论文查重尚可理解，哪里标红都有解释，重复段落是和哪篇文章重复了，那么ai率呢？作何解释？完全的黑箱操作，平台说啥就是啥！

各个平台，如知网、万方、维普等对于同一篇论文的检测结果都不一样

因为AIGC检测结果无法解释，靠写作风格判定

前文我已经介绍，训练一个这样的检测器，没什么技术难度（当然也没什么成本），主要是数据方面，也就是说：

这些所谓的提供AIGC检测服务的平台，基于大量的学生毕业论文（期刊论文）去训练模型，然后再反过来向学生收取高昂的检测费用，形成一个完美的商业闭环。perfect！

对于一个学生来说，动辄几十上百的AIGC检测费用，合适吗？

（如果任何学校或学术机构愿意使用我们的AIGC检测模型作为替代方案，请联系我们，我们可以免费提供模型并辅助部署）

【WebApi】C#创建WebApi学习

1、创建WebApi项目 Prgram.cs代码保留如下 var builder = WebApplication.CreateBuilder(args); // Add services to the container. var app = builder.Build(); // Configure the HTTP request pipeline. app.UseHttpsRedirection(); app.Run(); 2、Minmal APIs最小API使用 Prgram.cs中进行最小API使用 var builder = WebApplication.CreateBuilder(args); // Add services to the container. var app = builder.Build(); // Configure the HTTP request

Selenium环境搭建完全指南：WebDriver版本匹配与生产级配置实践（Day 21-23）

引言：Web自动化的第一块多米诺骨牌如果你曾尝试在深夜配置Selenium环境，大概率经历过这样的场景：满怀信心地写下webdriver.Chrome()，回车执行，浏览器窗口一闪而逝——秒退。紧接着是SSL握手失败的红色堆栈，GitHub Issue的彻夜鏖战，以及第二天早晨同事轻描淡写的一句“哦，你Chrome版本没对齐吧”。环境搭建是Web自动化门槛最低、踩坑密度最高的环节。它不需要复杂的业务逻辑，却对细节有近乎偏执的要求：浏览器版本、驱动版本、系统架构、环境变量、二进制路径——任何一环脱节，整个自动化大厦便无从谈起。 Day 21-23的目标不是让你“跑通一个脚本”，而是建立对Selenium WebDriver底层交互机制的工程级认知。本文将从版本匹配的底层逻辑切入，覆盖跨平台配置、常见陷阱根治方案，并引入2026年主流的最佳实践工具链。读完本文，你将具备诊断并彻底解决环境问题的能力，而不再依赖“重装大法”。一、Selenium WebDriver的本质：不只是“驱动” 1.1 拆解黑箱：WebDriver协议与浏览器内核许多初学者将WebDriver误

从 XMLHttpRequest 到 Fetch API：现代前端网络请求的演进与迁移指南

🧑 博主简介：ZEEKLOG博客专家，历代文学网（PC端可以访问：https://literature.sinhy.com/#/?__c=1000，移动端可关注公众号 “ 心海云图 ” 微信小程序搜索“历代文学”）总架构师，16年工作经验，精通Java编程，高并发设计，分布式系统架构设计，Springboot和微服务，熟悉Linux，ESXI虚拟化以及云原生Docker和K8s，热衷于探索科技的边界，并将理论知识转化为实际应用。保持对新技术的好奇心，乐于分享所学，希望通过我的实践经历和见解，启发他人的创新思维。在这里，我希望能与志同道合的朋友交流探讨，共同进步，一起在技术的世界里不断学习成长。 🤝商务合作：请搜索或扫码关注微信公众号 “ 心海云图 ” 从 XMLHttpRequest 到 Fetch API：现代前端网络请求的演进与迁移指南引言：为什么我们需要新的网络请求方案？在前端开发领域，XMLHttpRequest (XHR) 长期统治着浏览器端的网络请求。然而，随着 Web

下载安装Microsoft Edge Webview2教程

视频教程 Windows 10/11系统 Webview2安装——win10/11 Windows 7系统 Webview2安装——Win7 图文教程官网下载最新版Webview2安装包点击下载安装官网地址：Microsoft Edge WebView2 | Microsoft Edge Developer 1. 进入官网，点击下载按钮 2. 点击左侧常青引导程序下载按钮 3. 在弹出的页面点击接受并下载，右上角下载管理页面在下载完成后有文件弹出 4. 在游览器下载管理页面直接点击打开文件进行软件的安装 5. 软件安装中，安装完成后无需手动点击自动弹出消失。 graph TD A[安装码尚云标签] --> B{判断安装情况} B -->|Yes| C[打开软件进行标签设计] B --&