用 Turnitin 睇 AI 寫作偵測(AI Writing Detection)結果嗰陣,好多同學見到嘅唔係一個乾淨嘅百分比,而係一個星號:*%。第一反應通常係「係咪壞咗?」
唔係。呢個係設計出嚟嘅行為。
AI 偵測點樣運作
同相似度比對完全唔同,AI 偵測唔會去資料庫搵有冇相同文字。佢做嘅係逐句分析文字嘅統計特徵 —— 用字選擇嘅可預測程度、句式變化嘅幅度等等 —— 然後估算每一句由大型語言模型生成嘅機率,最後匯總成一個「預估 AI 生成內容比例」。
重點係:呢個係一個機率估算,唔係證據。系統冇辦法知道你實際上用咗咩工具,佢只係話「呢啲句子嘅統計特徵接近 AI 生成文字」。
出現 *% 嘅幾個原因
1. 文件太短(少於 300 字)
Turnitin 對 AI 偵測設有最少約 300 字嘅長篇散文(prose)要求。字數不足時樣本太細,統計估算冇意義,系統會直接拒絕畀出數字。
要留意「300 字」計嘅係連貫散文 —— 項目符號清單、表格、程式碼、公式同參考文獻通常唔計入內。所以一份 800 字但大部分係 bullet points 嘅報告,一樣可能觸發呢個限制。
2. 估算值低於 20%
根據 Turnitin 官方說明,當預估 AI 比例低於 20% 嘅時候,誤判(false positive)嘅比率會明顯上升。與其畀一個 5% 或者 12% 呢類容易令導師誤會嘅數字,佢哋選擇顯示星號,表示「偵測到少量疑似內容,但信心唔足以報告具體數值」。
所以見到 *%,對你嚟講通常係好消息,唔係壞消息 —— 佢代表系統冇偵測到大量 AI 生成內容。
3. 語言或格式唔支援
AI 偵測嘅語言支援範圍比相似度比對窄好多。如果你份文件唔喺支援語言之列,或者格式令系統抽唔到連貫文字,都會出唔到數字。
誤判風險:邊啲人比較易中
AI 偵測嘅原理係「呢段文字寫得有幾可預測」,而唔係「呢段文字係咪 AI 寫」。所以以下情況嘅真人寫作,統計特徵會同 AI 相似:
- 非母語英文寫作者 —— 用字保守、句式重複、跟足模板,正正係低變化度嘅特徵。
- 高度公式化嘅學術章節 —— 方法學、實驗步驟、標準定義。
- 用咗 AI 潤飾(唔係代寫)嘅文字 —— 就算論點同結構完全係你自己,經 AI 改寫過嘅句子一樣會帶上生成模型嘅特徵。
換句話講,高分唔等於作弊,低分亦唔等於清白。呢個係目前所有 AI 偵測工具嘅共同限制,亦係點解好多院校規定 AI 偵測分數唔可以單獨作為紀律處分嘅證據。
被標記咗可以點做
- 保留寫作過程紀錄。用 Google Docs 或 Word 線上版寫,版本歷史會自動記錄成篇文點樣逐步成形。呢個係目前最有力嘅自證方式。
- 保留草稿、大綱同筆記。手寫筆記影相都算。
- 準備好講解你嘅論點。如果被約談,能夠即場解釋你點解揀呢個框架、點樣得出結論,比任何工具報告都有說服力。
- 用 AI 之前先睇清楚課程規定。唔少課程容許用 AI 做資料搜集或者文法檢查,但禁止生成內容。界線由課程定,唔係由你估。
想睇埋逐句標記?
整體百分比話你知有幾多,但唔會話你知邊幾句被標記。TurnCheckHK 支援申請 AI 高亮標記報告,可以睇到系統實際標示咗邊啲句子,方便你針對性檢視同修改,而唔係盲改成篇。