新闻详情

新闻详情

首页 / 资讯中心 / 详情

如何阻止 AI 编造参考文献?ARS 防泄漏协议 4 道防线 + 2 个标记机制完整指南

发布时间:2026/9/26 8:18:47来源:尧图网络
如何阻止 AI 编造参考文献?ARS 防泄漏协议 4 道防线 + 2 个标记机制完整指南
如何阻止 AI 编造参考文献ARS 防泄漏协议 4 道防线 2 个标记机制完整指南【免费下载链接】academic-research-skillsAcademic Research Skills for Claude Code: research → write → review → revise → finalize项目地址: https://gitcode.com/GitHub_Trending/ac/academic-research-skills用 AI 写论文最怕是参考文献看着像真的、其实根本不存在。Claude Code 学术技能包 ARSAcademic Research Skills里的防泄漏协议用知识隔离加多重防线让 AI 幻觉引用和虚构实验方法过不了流水线。先把流水线看全防泄漏协议只是写作环节的一道闸门拿到这个项目后先建立一张全景图。ARS 是一条完整流水线五个环节依次推进研究 → 写作 → 评审 → 修订 → 定稿对应四组核心技能deep-research做研究、产出材料、academic-paper写作、academic-paper-reviewer评审、academic-pipeline编排与一致性把关。数据不会凭空安全。一项对 arXiv、bioRxiv、SSRN、PMC 上 250 万篇论文、1.11 亿条参考文献的大规模审计Zhao et al., 2026估计仅 2025 年就有 146,932 条幻觉引用约 14.6 万保守估计ARS 团队自己的一次校验也发现68 条参考文献里有 21 条存在问题31% 错误率而这 21 条全部骗过了 3 轮一致性检查——内部自审挡不住内部幻觉因为验证者和生成者是同一个认知框架。防泄漏协议的位置就卡在写作这一环研究材料简报 综述 参考文献表刚交接到写作代理的那一刻它自动接管约束后续所有动笔行为。核心思想一句话知识隔离写论文时优先使用本次会话提供的材料而不是 AI 的记忆。为什么这是治本的手段幻觉引用和虚构方法有一个共同源头模型在材料不足时默认用训练记忆去填空。协议做的事情就是把这个默认行为翻过来——只写手上有的。注意一个边界它不禁止使用学术写作能力行文规范、论证逻辑、学科惯例照常可以用被锁死的只有事实性内容——声明、引用、数据、方法描述必须来自会话材料。五条红线写作代理的硬约束协议激活时已提供实质性研究材料、处于 full 或 revision 模式写作代理会收到一组优先级规则。翻译成红线红线它拦的是什么一句话人话事实性声明优先取自会话材料隐式知识泄漏模型拿记忆里的过时、不准内容填空你给的数据说了算模型的常识靠边站每个论点必须能追溯到参考文献表或用户数据无源可溯的句子引不到出处这句就不许写材料没覆盖的话题标记为[MATERIAL GAP]悄悄脑补宁可留空不许圆未经你明确授权不得引入参考文献表之外的新文献新增幻觉引用想加新引用先申请Methods 章节只描述材料中记载的流程方法论虚构写出合理但没做过的实验步骤不许发明实验步骤 前四条管写什么第五条专门管怎么描述你做的事——这是最容易被忽视的一条因为编出来的方法看起来最专业。留白机制每一次自由发挥都留痕协议最妙的地方不是禁止而是显式化。当大纲需要的内容在你的材料里找不到时AI 不会默默圆过去而是在稿件里打一个[MATERIAL GAP]标记并在下一个检查点向你报出来。此时只有两条路你补材料——把缺失的资料喂进流水线让缺口用真实材料填上你授权 AI 补——补出来的段落会打上[LLM-SUPPLEMENTED]标签写入稿件元数据后续一致性审查时一目了然。也就是说留白是默认选项发挥是授权选项。AI 每一次动自由发挥的地方都有案可查无处遁形。标记词表在 shared/compliance_checkpoint_protocol.md 中有正式定义。写完还要过四道门纵深防御写作时不造假只是第一层。围绕参考文献真实性整条流水线布了四道门逐层加严。第一道存在性安检——四个学术索引交叉核对从 v3.11 起每一条被引用的文献都会被确定性脚本不是 AI交叉核对四个书目索引Semantic Scholar、OpenAlex、Crossref、arXiv。DOI 或 arXiv ID 被证明查无此物脚本直接判定不存在。这一步纯程序化编造的 DOI 逃不过去查过的结果还会进本地缓存同一篇论文不重复请求。实现见 scripts/verify_passport.py 与 scripts/verification_gate/。第二道一致性门禁——7 种失败模式逐一排除初稿和终稿各要过一道不可跳过的一致性检查Stage 2.5 与 Stage 4.5。检查时一致性审查代理必须逐一排除 7 种已知 AI 研究失败模式——其中 Mode 2 就是引用幻觉Mode 6 是方法论虚构。任何一项被判疑似流水线立即暂停等你确认、回修或带理由覆盖才能继续4.5 处仍未解决的疑似项终稿直接拒绝放行。完整清单见 academic-pipeline/references/ai_research_failure_modes.md。第三道论点-来源对齐——Phase E 五档判定引用存在还不够真实文献也可能被错误引用去支持它没说过的事。Phase E 会抽取文中的数值、因果、趋势、类别断言逐条回到原文比对抽样策略高影响声明标题级结论、数值、因果、方法关键、有争议100% 验证不设上限其余按风险分层抽检随机抽样加保底终检模式对已登记声明 100% 复核五档判定VERIFIED一致/ 轻微偏差MINOR_DISTORTION/ 重大扭曲MAJOR_DISTORTION/ 无法验证UNVERIFIABLE/ 来源受限无法核验UNVERIFIABLE_ACCESS门禁出现任何一条重大扭曲或无法验证一致性报告直接 FAIL。协议细节见 academic-pipeline/references/claim_verification_protocol.md。第四道数据分级——答案不许漏进答题者每个技能都在元数据里声明自己的数据访问级别raw未验证的原始材料默认不可信/redacted脱敏材料/verified_only只消费过闸的验证材料。材料在层级间只能单向晋升答案永远到不了答题者的上下文。设计原理见 shared/ground_truth_isolation_pattern.md。上手三步装好、喂料、盯标记第 1 步安装插件。需已安装 Claude Code在会话里执行两条命令/plugin marketplace add Imbad0202/academic-research-skills /plugin install academic-research-skills第 2 步喂研究材料。协议生效的前提是你提供了实质性材料研究问题简报RQ Brief 综述报告Synthesis Report 带注释的参考文献表实验日志、数据可一并附上论文处于 full 或 revision 模式时自动激活。想单独试也可以先说对这份材料做文献综述。第 3 步盯住两种标记逐一确认。看到[MATERIAL GAP]二选一补材料或授权 AI 补看到[LLM-SUPPLEMENTED]重点复核该段落。所有覆盖性决定都会被记录并进入论文最终的 AI 披露说明——带病放行会留痕。想深挖文件导航关键文件作用academic-paper/references/anti_leakage_protocol.md防泄漏协议全文知识隔离指令 标记处理规则academic-pipeline/references/ai_research_failure_modes.md7 种 AI 研究失败模式清单与检测问句academic-pipeline/references/claim_verification_protocol.mdPhase E 论点-来源对齐验证协议shared/ground_truth_isolation_pattern.mdraw / redacted / verified_only 数据分级设计docs/RISK_REGISTER.md风险 → 控制措施 → 证据状态对照登记academic-paper/SKILL.md写作技能总纲含协议引用与激活条件scripts/verify_passport.py引用存在性校验入口脚本收尾ARS 把AI 不许编从一句口号沉淀成了写作时知识隔离、缺口显式留痕、多索引确定性校验、人工门禁兜底的可执行机制——你论文里的每条引用、每段方法都要经得起对照原始材料的检查。【免费下载链接】academic-research-skillsAcademic Research Skills for Claude Code: research → write → review → revise → finalize项目地址: https://gitcode.com/GitHub_Trending/ac/academic-research-skills创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
网站建设高端定制企业官网
RELATED

相关资讯

更多精彩内容,欢迎继续阅读

较早相关资讯

最新相关资讯

Walmart门店日销量时序预测实战案例解析 2026/9/26 9:04:57

Walmart门店日销量时序预测实战案例解析

这道 Kaggle 赛题围绕 Walmart 门店日销量预测展开,任务形式看似基础,实际已经覆盖零售预测项目中的关键环节。核心难点不在模型名称,而在于怎样把历史销售记录转成稳定可验证的时序回归流程,并在 RMSE 约束下控制高波动日期的预测偏差。 这类题目与真实零售业务高度贴近。…

阅读更多 →
Atlas 300V跑YOLO从入门到调优:昇腾推理卡部署全解析 2026/9/26 9:04:51

Atlas 300V跑YOLO从入门到调优:昇腾推理卡部署全解析

最近好几个做视觉的朋友都在问同一个问题:Atlas到底能不能跑YOLO?搭配热搜里那句"Atlas 300V 24G是运算加速卡吗",我意识到很多人其实连Atlas是啥、整个部署链路怎么搭都不太清楚,就先入为主地拿它跟NVIDIA显卡比了。我…

阅读更多 →
MIPI LP TX低功耗发送模式:D-PHY时序原理与调试实战 2026/9/26 9:04:51

MIPI LP TX低功耗发送模式:D-PHY时序原理与调试实战

MIPI LP TX 这个说法,第一次听到的人多半会愣一下——MIPI 我熟,CSI、DSI、DPHY 这些词天天见,但 LP TX 是什么?是某个新出的协议变种,还是某个芯片厂商的私有叫法?其实都不是。LP 是 Low-Power 的缩写&…

阅读更多 →
LangChain4j不是LangChain的Java版,而是JVM原生LLM应用框架 2026/9/26 9:04:51

LangChain4j不是LangChain的Java版,而是JVM原生LLM应用框架

1. LangChain4j不是LangChain的Java版,而是为Java生态重新设计的LLM应用架构很多人第一次看到LangChain4j,下意识会想:“哦,这是LangChain官方出的Java移植版”,然后直接去翻Python文档、照搬Chain构造逻辑、硬套Promp…

阅读更多 →
【Python 系统入门付费专栏】第 12 讲 文件读写与编码处理:从底层字节到工程级最佳实践,掌握数据持久化核心 2026/9/26 9:04:51

【Python 系统入门付费专栏】第 12 讲 文件读写与编码处理:从底层字节到工程级最佳实践,掌握数据持久化核心

专栏导读:本专栏为 Python 从入门到算法落地系统付费专栏,共 5 大阶段 25 讲。本文为第三阶段第 2 讲,承接上一讲的模块与包体系,深入讲解 Python 文件 IO 与编码处理。文件操作是数据持久化、自动化办公、数据分析的核心基础,本文从文件操作的操作系统本质出发,逐层拆解…

阅读更多 →
DeskcommCRM:把沟通记录变成数据资产的轻量级CRM实践 2026/9/26 9:04:45

DeskcommCRM:把沟通记录变成数据资产的轻量级CRM实践

1. 项目概述:DeskcommCRM 到底解决什么问题做客户管理系统这些年,我见过太多团队在选型上踩坑:有的花大钱上了国际大厂的 CRM,结果销售嫌录入太麻烦,天天只用 Excel 私下记账;有的自己拿共享表格拼凑客户信…

阅读更多 →

今日资讯

本周资讯

本月资讯

看完文章仍有疑问?

联系尧图顾问,获取一对一建站咨询

立即免费咨询 📞 400-888-8888
📞 ✉