Turnitin英文的AI率检测是由三个不同模型同时检测的,训练数据既包括AI生成内容,也包括来自不同地区和学科领域的真实学术写作(还包括非英语使用者)。
Turnitin查重:http://ttai.kk.checkyyds.com
一、检测模型
Turnitin的AI检测功能是基于Huggingface公司的一款开源基础模型。其英文AI率检测时,会由AI写作检测模型、AI改写检测模型、AI规避检测模型同时检测,不仅能检测出AI生成内容,还能检测出AI生成后又经过AI改写(Quillbot、Grammarly、Scribbr)或润色修改过后的文本。
二、检测范围
Turnitin的AI率检测覆盖:GPT-3、GPT-3.5、GPT-4(ChatGPT Plus)、GPT-4o、GPT-5、Gemini(Pro)、Gemini 2.5 Flash、LLaMA等其它主流大模型。
Turnitin的AI率检测只会检测长篇散文文本(如论文、学位论文或文章等)段落中的单个句子。无法可靠地检测诗歌、剧本或代码,也无法检测短篇/非传统写作,如项目符号(简短的非句子结构)或带注释的参考文献。所以AI率百分比结果不会一定=标记字数÷文本总字数。
三、检测原理
当论文提交检测时,Turnitin会把文本拆分成约数百字(约5-10个句子)的文本片段。这些片段还会相互重叠排列,以保证检测模型能在上下文中捕捉到每一个句子。
三个模型会同时对每个片段进行评分,计算所有片段的平均分,从而将结果浓缩为每个句子的0到1之间的得分。最后生成一个整体AI率百分比,未标记内容为系统默认的原创内容,青色表示可能由AI生成内容,紫色表示可能由AI生成后又经过AI改写或AI规避工具修改过的内容。
四、易误判内容
只有几百字的短文本检测时,Turnitin只能对段落进行预测,没有机会进行重叠分析。系统就会出现一刀切的情况,无法分辨出哪些是AI生成或哪些是原创。系统可能就会全部标记为AI生成。
对于文本内频繁出现结构变化不大的列表、字面意思上重复的内容、或是只进行了改写而又未发展出新观点的文本,即使是亲手写的,这些内容都很容易被误判为AI生成。







