※この記事はアフィリエイト広告を含みます
arXiv论文的三分之一竟然是AI写的!?2026年最新调查揭示的惊人写作现状
发生了什么?新闻概述
- 分析了12,750篇arXiv论文:针对2021年至2026年7月的论文,测量了AI写作的比例。2026年初,约39%的论文被判定为AI创作,而最近一个季度的比例也维持在约32%的高水平。
- 采用先进的检测方法:以2021-22年的“前ChatGPT时代”论文作为基准(假阳性率0.4%),对现代论文进行了全文扫描。相比仅依据摘要进行判定,能够更高精度地捕捉AI的痕迹。
- 领域间的极端差距:计算机科学(CS)领域中约65%的论文被判定为AI写作,而数学领域仅有0.7%。不过,数学领域的低数据并不是因为“没有使用AI”,而是因为“检测器无法适应数学特有的记法”。
为什么这很重要?值得关注的要点
- 通过“全文扫描”揭示真实情况:仅依赖摘要容易导致AI得分偏低,然而对全文进行细致审查,揭示了许多研究者实际上在写作过程中深度整合了AI。
- 假阳性率0.4%的严格标准:在过去仅由人类撰写的论文中,只有0.4%被误检测为AI创作,这样的高得分并非偶然,而是明确的“AI转型”的科学证据。
🦈 鲨鱼的视角(策展人的观点)
学术界的海洋正被AI这一新潮流完全吞噬!值得注意的不是单纯的“AI增多”,而是这一检测方法的严谨性。将2021年的论文作为“对照组”,严格排除了误判的底线,这一点非常酷!
尤其是对数学领域结果的分析很有深度。“数学论文以符号和证明结构为主,文本内容较少,可能导致检测器的困惑”——这意味着,数学家并不是没有使用AI,而是以**“检测器无法追赶的方式”使用AI**。这预示着,随着其他领域AI使用的日益精细,未来可能会愈发“不可检测”!
未来会如何发展?
- 检测与规避的猫鼠游戏:到2026年下半年,将出现更“人性化”或“专门化”的AI写作风格,试图绕过当前检测器的精度。
- 学术界评估标准的变迁:论文的“文字”本身将不再是重点,而是实验数据和新发现等“核心价值”将更受重视,正式进入AI共生的时代。
鲨鱼视角的一句话
论文早已从“人类撰写的作品”完全进化为“AI与人类共同创作的成果”!我也要和AI一起撰写鲨鱼论文!🦈🔥
术语解释
-
arXiv:物理学、数学、计算机科学等领域的未审核论文公开发布的全球最大预印本服务器。
-
假阳性(False-positive):将未由AI创作的文本(人类撰写)错误判定为“由AI创作”的情况。
-
自助法(Bootstrap method):通过有限数据多次重抽样,提高统计推测的精度的方法。本次调查的可信度正是通过该方法得以保障。