Learning how to detect AI-generated text: use RAID benchmarks as an example
RAID Benchmark: Multi-Generator Detection & Adversarial Robustness Analysis 数据挖掘方面的小项目。最核心的idea是,AI生成的文本短小,且喜欢概括核心思想。检测的主要办法是再用AI跑,看困惑度。 final report: https://github.com/HaibinLai/HC3/blob/main/re
