研究揭示LLM生成虚构“幽灵作者”现象,已污染学术出版体系
arXiv发布的一项研究揭示了大型语言模型在生成虚构专家姓名时会产生高度相关的角色组合(如Claude模型偏好Elena Vasquez和Marcus Chen,Gemini偏好Aris Thorne和Lena Petrova等),这些名字在大量AI生成文档中反复出现。更严重的是,这些“幽灵姓名”已造成实际后果:在CERN运营的Zenodo平台上,研究者发现1655条记录声称来自不存在的期刊,其中991条在一个月内注册并获得真实的DataCite DOI,可以被学术聚合器收录。这些虚假记录会误导学术检索和引文分析。