新闻详情

新闻详情

首页 / 资讯中心 / 详情

Tracing Facts or just Copies? A critical investigation of the Competitions of Mechanisms in Large...

发布时间:2026/10/4 14:21:36来源:尧图网络
Tracing Facts or just Copies? A critical investigation of the Competitions of Mechanisms in Large...
文章主要内容和创新点主要内容本文是一项关于大型语言模型(LLMs)处理事实与反事实信息竞争机制的可复现性研究,重点探究注意力头在这一过程中的作用。研究旨在复现并整合Ortu等人、Yu等人及McDougall等人的三项近期研究成果,通过机械可解释性工具分析模型习得事实与矛盾上下文信息的竞争关系,具体包括:验证注意力头强度与事实输出比例的关联性;评估关于注意力头抑制机制的两种竞争假设(选择性反事实抑制vs.一般性复制抑制);探究注意力头行为的领域特异性。研究使用GPT-2和Pythia-6.9B模型,基于CounterFact数据集设计实验,通过logit归因、注意力修改、SVD分析等技术发现:促进事实输出的注意力头通过一般性复制抑制(而非选择性反事实抑制)发挥作用,且其行为具有领域依赖性,更大的模型表现出更专业化、对类别更敏感的模式。创新点明确抑制机制类型:首次通过实验证实,支持事实输出的注意力头并非选择性抑制反事实信息,而是通过抑制“归纳效应”(即复制上下文内容的倾向)实现作用,增强这些注意力头甚至会抑制正确事实的复制。揭示领域特异性与模型大小的关联:发现注意力头的作用因知识领域(如地理位置、语言、组织)而异,且更大的模型(如Pythia-6.9B相较于GPT-2)的注意力头表现出更强的领域专业化特征。整合与复现前人研究:通过复现三
网站建设高端定制企业官网
RELATED

相关资讯

更多精彩内容,欢迎继续阅读

较早相关资讯

最新相关资讯

【外设】之大彩串口显示屏 2026/10/4 15:04:22

【外设】之大彩串口显示屏

大彩串口屏初步使用 1 .官网下载 STM32 屏幕 GUI 设计资料 http://www.gz-dc.com/category/typeid/4112 找到 STM32 Keil 工程,移植相关代码因项目而异进行移植,由于项目简单,本人只对用到的指令接口进行修改。 比如:注意事项&…

阅读更多 →
无法下载Windows系统iso文件 2026/10/4 15:02:13

无法下载Windows系统iso文件

当我遇到这个问题的时候,我打开了一个网站: 登录 然后我打算下载的时候: 突然那个官方的连接就可以下载了:

阅读更多 →
【清华代码熊】DeepSeek V4.1 Flash 后训练详解 2026/10/4 14:32:28

【清华代码熊】DeepSeek V4.1 Flash 后训练详解

📌 上期解析了 DeepSeek V4.1 Flash 模型架构改进,本期解析 DeepSeek V4.1 Flash 预训练/后训练技术: 🌟 预训练:45T 文本 多模态混合语料、直接训练 sparse attention(取消 DeepSeek V4 的 dense 冷启动&…

阅读更多 →
Shuffle-R1: Efficient RL framework for Multimodal Large Language Models via Data-centric Dynamic ... 2026/10/4 14:31:41

Shuffle-R1: Efficient RL framework for Multimodal Large Language Models via Data-centric Dynamic ...

文章主要内容和创新点 主要内容 本文聚焦于多模态大语言模型(MLLM)强化学习(RL)训练中的效率问题,提出了一个名为Shuffle-R1的框架。研究发现,当前RL训练存在两个关键缺陷: 优势值坍缩(Advantage Collapsing):批次中大多数优势值集中在零附近,导致有效梯度信号被淹…

阅读更多 →
PRvL: Quantifying the Capabilities and Risks of Large Language Models for PII Redaction 2026/10/4 14:31:34

PRvL: Quantifying the Capabilities and Risks of Large Language Models for PII Redaction

一、文章主要内容总结 本文聚焦于利用大型语言模型(LLMs)实现个人身份信息(PII)脱敏的研究,旨在解决传统脱敏方法(如基于规则的系统、领域特定命名实体识别(NER)模型)泛化能力差、跨格式/跨语境适应性弱的问题。 研究通过全面评估多种LLM架构(包括密集型LLM(D-LLM…

阅读更多 →
LLaVA-RE: Binary Image-Text Relevancy Evaluation with Multimodal Large Language Model 2026/10/4 14:31:34

LLaVA-RE: Binary Image-Text Relevancy Evaluation with Multimodal Large Language Model

文章主要内容和创新点 主要内容 本文聚焦于二进制图像-文本相关性评估任务(判断图像与文本“相关”或“不相关”),针对该任务中文本格式多样、相关性定义随场景变化等挑战,提出了基于多模态大语言模型(MLLM)的解决方案LLaVA-RE。 模型设计:LLaVA-RE基于LLaVA 1.5架构,…

阅读更多 →

今日资讯

本周资讯

本月资讯

看完文章仍有疑问?

联系尧图顾问,获取一对一建站咨询

立即免费咨询 📞 400-888-8888
📞 ✉