机器生成文本往往同时包含统计、频谱和语言使用层面的特征。本项目研究这些信号在不同模型、任务和采样方法下的稳定性。
检测与评测
我们的目标不仅是判断文本是否由模型生成,也希望理解自动指标与人类质量判断之间的关系。
方法
当前方法结合频域分析、统计建模与心理语言学特征,并关注跨域场景中的鲁棒性。
机器生成文本往往同时包含统计、频谱和语言使用层面的特征。本项目研究这些信号在不同模型、任务和采样方法下的稳定性。
我们的目标不仅是判断文本是否由模型生成,也希望理解自动指标与人类质量判断之间的关系。
当前方法结合频域分析、统计建模与心理语言学特征,并关注跨域场景中的鲁棒性。