14.6万条假参考文献:AI正在污染学术知识基础设施
如果论文里引用的文献根本不存在那这篇论文还能算学术成果吗一、一个令人不安的数字2026年7月康奈尔大学的一个研究团队发表了一项分析——他们研究了大约250万篇论文、1.11亿条参考文献后得出了一个令人不安的结论2025年至少有14.6万条不存在的幻觉参考文献进入了学术文献。14.6万。这不是可能有几条而是一个系统性的问题。更值得注意的是这项研究的作者里包括 Paul Ginsparg——arXiv 的创始人。连学术预印本平台的创始人都站出来关注这个问题说明事情已经严重到什么程度了。二、幻觉参考文献是怎么混进来的幻觉参考文献是什么就是 AI 生成的、看起来像模像样但实际上根本不存在的文献引用。它有几个特点作者名字、期刊名、年份、卷期页码格式完全正确标题看起来很相关甚至和论文主题高度契合但你去数据库里搜——根本搜不到这篇文章这些假引用是怎么混进学术文献的路径主要有三条第一条AI 辅助写作时直接生成。很多研究者用 AI 写论文的引言或讨论部分AI 会自动引用一些看起来很相关的文献。作者可能没仔细核对就直接留着了。第二条AI 润色或改写时补充引用。原文本来有真实引用但 AI 改写的时候觉得这里再加一篇引用会更有说服力于是凭空编了一篇。第三条第三方代写或降重服务。这个就不用多说了——灰色产业链里的 AI 代写生成的引用几乎全是假的。不管是哪条路径结果都一样假文献混进了真论文然后通过引用网络继续传播。三、为什么这比你想的更严重你可能会想不就是几条假引用吗有什么大不了的但实际上这个问题的严重性被严重低估了。第一它会产生级联效应学术研究是建立在前人工作基础上的。如果 A 论文引用了一篇假文献B 论文又引用了 A 论文C 论文再引用 B 论文……假信息就会像滚雪球一样越传越广。而且AI 工具在做文献综述的时候会把这些假引用也挖出来继续生成新的假内容。这就形成了一个正反馈循环AI 生成假引用 → 假引用进入文献 → AI 又基于这些文献生成更多假引用。第二同行评审根本查不出来Nature 在2026年4月就这个问题发过警告说得很直白现有的同行评审和编辑流程无法充分过滤虚假参考文献。为什么因为审稿人不可能把每一条引用都去数据库里核对一遍。一篇论文可能有几十上百条引用逐条查的话审稿时间要翻好几倍。而且假引用做得太像了——格式正确、内容相关、作者名字也像那么回事。不特意去搜根本发现不了。第三它动摇了学术的根基学术的根基是什么是可验证性。每一个结论都应该有证据支撑每一个引用都应该指向真实的研究。如果引用可以是假的那论文里说的已有研究表明前人发现大量证据支持——这些话还有多少可信度当读者无法信任论文的参考文献时他们还能信任论文的结论吗四、目前有什么解决方案面对这个问题各方都在行动但目前还没有完美的解决方案。出版方加强检测和披露要求一些期刊已经开始要求作者披露 AI 工具的使用情况包括是否用 AI 生成了参考文献。但披露是一回事核查是另一回事——作者说我没用AI生成引用编辑也没法验证。检测工具还不够可靠市面上已经有一些 AI 生成内容检测工具但它们主要检测正文对参考文献的检测能力很有限。而且参考文献格式高度标准化AI 生成的和人写的在统计学特征上差别不大检测难度更高。数据库方可以做更多像 PubMed、Web of Science、知网这样的文献数据库其实有能力做交叉验证——当一篇论文提交时系统可以自动检查每一条引用是否真实存在。但这涉及到出版流程的改造不是一朝一夕能实现的。五、研究者能做什么在整个行业的解决方案成熟之前研究者自己能做的其实不少第一AI 生成的引用逐条核对。如果你用 AI 写了论文的任何部分特别是涉及引用的部分一定要逐条去数据库里确认。不要嫌麻烦——一条假引用可能毁掉整篇论文的信誉。第二用专业文献管理工具生成引用。不要让 AI 凭空想引用。从 EndNote、Zotero 或文献数据库里直接导出引用格式准确性有保障。第三对 AI 代写和降重服务保持警惕。这些服务生成的内容里假引用的比例非常高。用了这些服务等于把论文的学术信誉交到了别人手里。第四投稿前做一次引用自查。可以用文献管理工具批量导入参考文献看看哪些匹配不上数据库。匹配不上的大概率有问题。六、写在最后14.6万条假参考文献这个数字可能还只是冰山一角。因为这项研究只分析了能检测到的部分还有很多假引用可能藏得更深。AI 给学术研究带来了效率的提升这是毋庸置疑的。但它也带来了新的问题——而幻觉参考文献可能是其中最隐蔽、也最危险的一个。学术研究的大厦是靠一篇篇论文、一条条引用垒起来的。如果地基里混进了假砖整座大厦的稳定性都会受到影响。保护学术文献的真实性不只是期刊和出版社的事也是每一个研究者的事。毕竟我们每个人都是这个体系的一部分——也是它的受益者。 盈科千信 ChatResearch——学术文献检索与引用生成工具。不同于通用大模型凭空生成引用的方式ChatResearch 基于真实文献索引检索相关论文每一条引用都来自实际存在的学术文献支持一键导出标准引用格式GB/T 7714、APA、MLA等。从源头杜绝幻觉参考文献让你的论文引用每一条都经得起核查。了解更多盈科千信ChatResearch

相关新闻

C#对接本地大模型API实战:从LM Studio部署到流式对话开发

C#对接本地大模型API实战:从LM Studio部署到流式对话开发

之前在做本地AI应用开发时,发现很多教程要么只讲调用云端API,要么只讲模型部署,对于如何用C#这种主流后端语言去对接本地运行的模型API,资料总是零零散散。本文将提供一个完整的闭环方案,从启动LM Studio本地服务&…

2026/8/23 12:11:29 阅读更多 →
OpenRouter深度解析:AI模型API统一网关与智能路由实践指南

OpenRouter深度解析:AI模型API统一网关与智能路由实践指南

最近在尝试一些新的 AI 模型 API 时,发现了一个挺有意思的现象:很多开发者,包括我自己在内,都习惯性地把目光锁定在几个“顶流”模型上。比如,想试试最新的推理能力,第一反应就是去 OpenAI 的 Playground&a…

2026/8/23 14:08:03 阅读更多 →
从零开始的敲代码生活--数据结构篇(单向链表)

从零开始的敲代码生活--数据结构篇(单向链表)

一、单向链表基础概念单向链表属于线性链式存储结构结点分为:数据域(存储有效数据) 指针域(保存下一个结点的地址)仅能单向向后遍历,不能回退访问前面结点使用管理结构体保存链表头指针、结点总数量优点&a…

2026/8/23 14:27:19 阅读更多 →

最新新闻

英雄联盟帧数优化与崩溃解决:从硬件到软件的系统性指南

英雄联盟帧数优化与崩溃解决:从硬件到软件的系统性指南

在实际 PC 游戏体验中,帧数(FPS)是衡量流畅度的核心指标。对于《英雄联盟》这类依赖瞬时反应和精准操作的竞技游戏,即使短暂的卡顿、掉帧或突如其来的游戏崩溃,都可能导致关键团战失利,严重影响游戏体验和竞…

2026/8/24 7:47:44 阅读更多 →
机器人灵巧手成本高昂的根源与开发者应对策略

机器人灵巧手成本高昂的根源与开发者应对策略

1. 这篇文章真正要解决的问题最近,关于机器人灵巧手成本高昂的讨论再次成为焦点。曦诺未来(Xnor Future)的CEO在近期访谈中透露,其灵巧手产品在2026年8月前仍将保持较高价格,并指出当前的首要任务是积累“千万小时”级…

2026/8/24 7:47:44 阅读更多 →
AI简历优化工具选择指南:提升应届生求职成功率

AI简历优化工具选择指南:提升应届生求职成功率

1. 应届生求职季的AI工具选择困境又到一年毕业季,看着身边同学陆续收到offer,而自己的简历投递后却石沉大海,这种焦虑我太熟悉了。去年此时,我也面临着同样的困境——每天海投50份简历,回复率却不到5%。直到偶然发现&a…

2026/8/24 7:47:44 阅读更多 →
深入理解 YUV420P10LE:从像素格式到 OpenGL 渲染的完整指南

深入理解 YUV420P10LE:从像素格式到 OpenGL 渲染的完整指南

目录 一、什么是 YUV420P10LE 命名拆解 二、像素与内存布局 1️.分辨率与采样 2️.位深与内存占用 3️.内存布局(Compact Planar) 4️.帧大小计算公式 三、FFmpeg 中的 YUV420P10LE 1️.像素格式枚举 2️.AVFrame 关键字段 3️. 数据指针 四、10bit YUV 的数值范…

2026/8/24 7:47:44 阅读更多 →
岚图追光S 23扬声器音响系统:从硬件堆料到沉浸式声场体验的深度解析

岚图追光S 23扬声器音响系统:从硬件堆料到沉浸式声场体验的深度解析

你第一次坐进一辆车,关上车门,按下启动键,然后……世界消失了。这不是科幻电影里的场景,而是当你真正沉浸在一套顶级车载音响系统里时,最直接的感官体验。外界嘈杂的鸣笛、路面的颠簸、甚至引擎的低吼,都被…

2026/8/24 7:47:44 阅读更多 →
大厂面试准备:技术深度、系统广度与工程思维

大厂面试准备:技术深度、系统广度与工程思维

1. 大厂面试的本质与准备策略互联网大厂的技术面试从来都不是简单的知识问答,而是一场综合能力评估的实战演练。我在担任某大厂面试官的五年间,参与过近300场技术面试,发现90%的候选人都存在"会背题但不会解题"的典型问题。大厂面试…

2026/8/24 7:46:44 阅读更多 →

日新闻

前端内容安全与依赖审计实践

前端内容安全与依赖审计实践

前端内容安全与依赖审计实践 前端安全依赖分层防护。没有任何单一配置能替代输出编码、权限校验和依赖更新。 把不可信内容当作数据 默认使用框架的转义能力;确需渲染 HTML 时,先在服务端或可信的客户端库中进行白名单过滤。避免把用户输入直接赋给 inne…

2026/8/24 1:08:15 阅读更多 →
Windows登录密码存储机制全解析:从哈希算法到安全加固实战

Windows登录密码存储机制全解析:从哈希算法到安全加固实战

1. 项目概述:Windows登录密码的“黑匣子”每次你按下CtrlAltDel,输入密码,然后看到那个熟悉的桌面,这背后发生了一系列复杂而精密的操作。作为一名长期与Windows系统打交道的从业者,我经常被问到:“我的密码…

2026/8/24 1:08:15 阅读更多 →
AI面试系统安全挑战与解决方案

AI面试系统安全挑战与解决方案

1. 项目概述:AI面试系统的安全挑战去年参与某跨国企业AI面试系统部署时,遇到一个典型案例:候选人在视频面试中无意提到竞争对手产品名称,系统竟自动将该信息关联到企业知识库并生成竞品分析报告。这个看似"智能"的功能&…

2026/8/24 1:08:15 阅读更多 →

周新闻

[光学原理与应用-521]:对光的错误理解与纠偏

[光学原理与应用-521]:对光的错误理解与纠偏

首先光是一种能量的载体和形态,宏观上观察到的光是由无数个微观的光量子组成的,每个光子在产生的瞬间,其在真空的空间中以确定不变的速度沿着一个初始的方向一直向前,在微观层面,每个光量子的运动轨迹是以波函数所展现…

2026/8/24 0:06:02 阅读更多 →
SIP通话转接原理与REFER方法实战解析

SIP通话转接原理与REFER方法实战解析

1. 通话转接不是“挂断再拨号”,而是SIP会话的动态重定向你有没有遇到过这样的场景:客服坐席A正在和客户通电话,突然需要把这通对话无缝转给专家坐席B,客户完全感知不到中间的断连——既没听到忙音,也没被要求重新拨号…

2026/8/24 0:20:20 阅读更多 →
Kolla-ansible单节点OpenStack部署实战:从环境准备到排坑指南

Kolla-ansible单节点OpenStack部署实战:从环境准备到排坑指南

1. 为什么选择Kolla-ansible来部署单节点OpenStack?如果你正在寻找一种能把OpenStack从“概念”快速变成“可用的实验环境”的方法,那么Kolla-ansible几乎是当前最主流、最省心的选择。我见过太多人卡在手动编译依赖、配置服务、处理版本冲突的泥潭里&am…

2026/8/24 0:14:11 阅读更多 →

月新闻

免费解锁百度网盘SVIP加速:macOS用户必备的下载提速终极指南

免费解锁百度网盘SVIP加速:macOS用户必备的下载提速终极指南

免费解锁百度网盘SVIP加速:macOS用户必备的下载提速终极指南 【免费下载链接】BaiduNetdiskPlugin-macOS For macOS.百度网盘 破解SVIP、下载速度限制~ 项目地址: https://gitcode.com/gh_mirrors/ba/BaiduNetdiskPlugin-macOS 还在为百度网盘macOS版的龟速下…

2026/8/23 18:47:06 阅读更多 →
终极ncmdump指南:3分钟实现网易云NCM音乐解密与格式转换

终极ncmdump指南:3分钟实现网易云NCM音乐解密与格式转换

终极ncmdump指南:3分钟实现网易云NCM音乐解密与格式转换 【免费下载链接】ncmdump 项目地址: https://gitcode.com/gh_mirrors/ncmd/ncmdump 还在为网易云音乐下载的NCM格式文件无法在其他播放器播放而烦恼吗?ncmdump解密工具帮你轻松解决这个困…

2026/8/23 12:10:44 阅读更多 →
HarmonyOS 应用开发《掌上英语》第81篇: 智能体卡片:为英语学习 App 打造桌面级学习助手

HarmonyOS 应用开发《掌上英语》第81篇: 智能体卡片:为英语学习 App 打造桌面级学习助手

AgentCard 智能体卡片:为英语学习 App 打造桌面级学习助手适用平台:HarmonyOS 7.0 (API 26 Beta)一、引言 HarmonyOS 7.0(API 26 Beta)新增了 AgentCard 智能体卡片能力,这是继 HMAF(鸿蒙智能体框架&#x…

2026/8/22 3:22:48 阅读更多 →