首页 / TAG标签 / 大语言模型

标签主题:大语言模型

学术索引

经典斯特鲁普测试揭示大语言模型注意力机制的根本性缺陷:执行控制能力随序

一项发表于《PNAS Nexus》的研究通过经典心理学“斯特鲁普任务”(颜色词与墨色不匹配)系统评估了GPT-5、Claude Opus 4.1和Gemini 2.5等前沿大语言模型(LLM)的执行控制能力。结果显示,虽然模型在短列表(5个词)中表现良好(如GPT-4o准确率达91%),但随着列表长度增加,其准确率急剧下降:GPT-4o在40个词时降至15%,Claude 3.5 Sonnet降至24%。在混合条件(匹配与不匹配词混杂)下,模型对不匹配项的准确率甚至趋近于0%。研究者指出,这种性能崩溃源于...

2026-06-18 188 0

在本地部署大语言模型进行敏感生物数据分析

本文探讨了在本地部署大语言模型(LLM)进行敏感生物数据分析的可行性与应用场景。随着模型小型化、量化技术和生物医学专用模型的发展,本地LLM已成为保护数据隐私的有效方案。文章详细介绍了变异注释智能问答、实验方案生成、科学写作助手等五大应用,并提供了技术实现示例。本地部署不仅避免了数据泄露风险,还提升了研究效率,是生物医学领域AI应用的重要趋势。...

2026-04-25 17 0

《自然·通讯》:通过心理表征引导监督,赋予大模型类人认知泛化能力

本文介绍了一项发表在《自然·通讯》上的研究,提出心理表征引导监督(MRGS)框架,通过模拟人类构建心理表征的过程,强制大语言模型学习概念间的逻辑关系,从而提升其在分布外任务中的认知泛化能力。实验表明,MRGS训练使模型在逻辑推理、因果推断等任务中准确率提升15%-25%,并形成更具层次感的特征映射,为人工智能向认知主体演进提供了新思路。...

2026-04-11 290 -2
    共1页/4条

推荐研究