【阿姆斯特丹博士论文】在语言模型中寻找结构 - 专知VIP

会员服务 ·

13

博士论文 · 阿姆斯特丹（Amsterdam） · 大语言模型 ·

2024 年 11 月 27 日

【阿姆斯特丹博士论文】在语言模型中寻找结构

专知会员服务

专知，提供专业可信的知识分发服务，让认知协作更快更好！

当我们说话、写作或聆听时，我们不断地基于对语言语法的知识进行预测。令人惊讶的是，儿童仅仅在几年内便能掌握这种语法知识，使得他们能够理解并将这种知识推广到从未说过的新结构中。语言模型是强大的工具，它们通过逐步预测句子中的下一个词来构建语言的表示，并且在近年来对社会产生了巨大影响。本文的核心研究问题是，这些模型是否拥有类似于人类的深刻语法结构理解。这个问题位于自然语言处理、语言学和可解释性研究的交叉点。为了回答这个问题，我们将开发新的可解释性技术，以加深我们对大规模语言模型复杂本质的理解。我们将从三个方向来探索这个研究问题。首先，我们通过结构性启动（structural priming）这一心理语言学中的关键范式，探索抽象语言信息的存在，这一范式可以揭示人类语言处理中的语法结构。接下来，我们考察各种语言现象，如形容词顺序和否定极性项目，并将模型对这些现象的理解与其训练数据分布进行关联。最后，我们引入一个受控的测试平台，用于研究语言模型中的层级结构，采用各种逐步增加复杂度的合成语言，并考察特征交互在建模这些结构中的作用。我们的研究结果提供了关于语言模型表示中蕴含的语法知识的详细描述，并为使用计算方法研究基本语言学问题提供了若干方向。

成为VIP会员查看完整内容

25

相关内容

博士论文

博士论文是由攻读博士学位的研究生所撰写的学术论文。它要求作者在博士生导师的指导下，选择自己能够把握和驾驭的潜在的研究方向，开辟新的研究领域。由此可见，这就对作者提出了较高要求，它要求作者必须在本学科的专业领域具备大量的理论知识，并对所学专业的理论知识有相当深入的理解和思考，同时还要具有相当水平的独立科学研究能力，能够为在学科领域提出独创性的见解和有价值的科研成果。因而，较之学士论文、硕士论文，博士论文具有更高的学术价值，对学科的发展具有重要的推动作用。

【普林斯顿博士论文】深度学习方法用于发现高维神经数据中的可解释潜在动态

【普林斯顿博士论文】深度学习方法用于发现高维神经数据中的可解释潜在动态

专知会员服务

28+阅读 · 1月3日

【斯坦福博士论文】从互联网视频中学习感知物理世界

【斯坦福博士论文】从互联网视频中学习感知物理世界

专知会员服务

23+阅读 · 2024年12月30日

【剑桥大学博士论文】深度记忆模型与部分可观察下的高效强化学习

【剑桥大学博士论文】深度记忆模型与部分可观察下的高效强化学习

专知会员服务

33+阅读 · 2024年12月18日

【阿姆斯特丹博士论文】在视觉挑战条件下的多模态学习

【阿姆斯特丹博士论文】在视觉挑战条件下的多模态学习

专知会员服务

27+阅读 · 2024年11月5日

【斯坦福博士论文】生成模型的视觉与行为

【斯坦福博士论文】生成模型的视觉与行为

专知会员服务

33+阅读 · 2024年7月11日

【普林斯顿博士论文】理解数据在模型决策中的作用

【普林斯顿博士论文】理解数据在模型决策中的作用

专知会员服务

40+阅读 · 2024年4月26日

【伯克利博士论文】理解、构建和评估上下文感知条件自然语言生成模型

【伯克利博士论文】理解、构建和评估上下文感知条件自然语言生成模型

专知会员服务

27+阅读 · 2024年4月20日

【大模型最新论文】测量和改进视觉语言模型中的思维链推理

【大模型最新论文】测量和改进视觉语言模型中的思维链推理

专知会员服务

53+阅读 · 2023年9月13日

【伯克利博士论文】学习跨领域的可迁移表示

【伯克利博士论文】学习跨领域的可迁移表示

专知会员服务

47+阅读 · 2022年8月17日

【巴黎理工学院博士论文】持续学习：用重放过程解决深度神经网络中的灾难性遗忘

【巴黎理工学院博士论文】持续学习：用重放过程解决深度神经网络中的灾难性遗忘

专知会员服务

35+阅读 · 2022年5月8日

基于模型的强化学习综述

基于模型的强化学习综述

专知

41+阅读 · 2022年7月13日

【KDD2020】图神经网络生成式预训练

【KDD2020】图神经网络生成式预训练

专知

22+阅读 · 2020年7月3日

【华为诺亚新论文】基于图上下文知识融入的预训练语言模型

【华为诺亚新论文】基于图上下文知识融入的预训练语言模型

专知

23+阅读 · 2019年12月8日

【CIKM2019论文】韩家炜团队HyperMine：富文本异构信息网络探索上位词

【CIKM2019论文】韩家炜团队HyperMine：富文本异构信息网络探索上位词

专知

14+阅读 · 2019年11月9日

【伯克利PNAS最新论文】可解释机器学习的定义、方法和应用

【伯克利PNAS最新论文】可解释机器学习的定义、方法和应用

专知

77+阅读 · 2019年10月20日

论文浅尝 | 采用多层注意力机制的事件检测

论文浅尝 | 采用多层注意力机制的事件检测

开放知识图谱

24+阅读 · 2019年8月24日

【机器学习】深入剖析机器学习中的统计思想

【机器学习】深入剖析机器学习中的统计思想

产业智能官

16+阅读 · 2019年1月24日

【UC伯克利】可解释性机器学习：定义、方法和应用

【UC伯克利】可解释性机器学习：定义、方法和应用

专知

70+阅读 · 2019年1月19日

【论文笔记】对话模型新方法，条件DialogWAE生成多模态回答

【论文笔记】对话模型新方法，条件DialogWAE生成多模态回答

专知

15+阅读 · 2018年6月11日

论文浅尝 | 基于置信度的知识图谱表示学习框架

论文浅尝 | 基于置信度的知识图谱表示学习框架

开放知识图谱

24+阅读 · 2018年2月27日

反问题的数学建模、计算及应用

国家自然科学基金

2+阅读 · 2015年12月31日

社交网络中的流言传播与演化

国家自然科学基金

2+阅读 · 2015年12月31日

基于犹豫模糊语言信息的定性决策理论与方法

国家自然科学基金

2+阅读 · 2015年12月31日

强调与对比影响语篇理解的认知过程及其神经机制

国家自然科学基金

4+阅读 · 2015年12月31日

面向大数据的安全迁移学习方法

国家自然科学基金

28+阅读 · 2015年12月31日

复杂多元数据的半参数统计推断

国家自然科学基金

5+阅读 · 2014年12月31日

生物网络的可计算建模

国家自然科学基金

2+阅读 · 2014年12月31日

面向汉语文本理解的语义计算方法

国家自然科学基金

8+阅读 · 2014年12月31日

多语言大数据环境下的复杂网络行为分析、预测和干预

国家自然科学基金

4+阅读 · 2014年12月31日

基于融合先验知识的机器学习的多传感器融合研究

国家自然科学基金

16+阅读 · 2013年12月31日

Is ChatGPT a Good Recommender? A Preliminary Study

Arxiv

170+阅读 · 2023年4月20日

NeuralField-LDM: Scene Generation with Hierarchical Latent Diffusion Models

Arxiv

40+阅读 · 2023年4月19日

On Efficient Training of Large-Scale Deep Learning Models: A Literature Review

Arxiv

213+阅读 · 2023年4月7日

A Survey on Graph Diffusion Models: Generative AI in Science for Molecule, Protein and Material

Arxiv

81+阅读 · 2023年4月4日

A Survey of Large Language Models

A Survey of Large Language Models

Arxiv

472+阅读 · 2023年3月31日

ChatGPT is a Knowledgeable but Inexperienced Solver: An Investigation of Commonsense Problem in Large Language Models

Arxiv

61+阅读 · 2023年3月29日

Nature Language Reasoning, A Survey

Arxiv

78+阅读 · 2023年3月26日

Knowledge Graphs: Opportunities and Challenges

Arxiv

171+阅读 · 2023年3月24日

Sparks of Artificial General Intelligence: Early experiments with GPT-4

Arxiv

51+阅读 · 2023年3月22日

Data-centric Artificial Intelligence: A Survey

Arxiv

24+阅读 · 2023年3月17日

VIP会员

相关主题

阿姆斯特丹（Amsterdam）

大语言模型

相关VIP内容

【普林斯顿博士论文】深度学习方法用于发现高维神经数据中的可解释潜在动态

【普林斯顿博士论文】深度学习方法用于发现高维神经数据中的可解释潜在动态

专知会员服务

28+阅读 · 1月3日

【斯坦福博士论文】从互联网视频中学习感知物理世界

【斯坦福博士论文】从互联网视频中学习感知物理世界

专知会员服务

23+阅读 · 2024年12月30日

【剑桥大学博士论文】深度记忆模型与部分可观察下的高效强化学习

【剑桥大学博士论文】深度记忆模型与部分可观察下的高效强化学习

专知会员服务

33+阅读 · 2024年12月18日

【阿姆斯特丹博士论文】在视觉挑战条件下的多模态学习

【阿姆斯特丹博士论文】在视觉挑战条件下的多模态学习

专知会员服务

27+阅读 · 2024年11月5日

【斯坦福博士论文】生成模型的视觉与行为

【斯坦福博士论文】生成模型的视觉与行为

专知会员服务

33+阅读 · 2024年7月11日

【普林斯顿博士论文】理解数据在模型决策中的作用

【普林斯顿博士论文】理解数据在模型决策中的作用

专知会员服务

40+阅读 · 2024年4月26日

【伯克利博士论文】理解、构建和评估上下文感知条件自然语言生成模型

【伯克利博士论文】理解、构建和评估上下文感知条件自然语言生成模型

专知会员服务

27+阅读 · 2024年4月20日

【大模型最新论文】测量和改进视觉语言模型中的思维链推理

【大模型最新论文】测量和改进视觉语言模型中的思维链推理

专知会员服务

53+阅读 · 2023年9月13日

【伯克利博士论文】学习跨领域的可迁移表示

【伯克利博士论文】学习跨领域的可迁移表示

专知会员服务

47+阅读 · 2022年8月17日

【巴黎理工学院博士论文】持续学习：用重放过程解决深度神经网络中的灾难性遗忘

【巴黎理工学院博士论文】持续学习：用重放过程解决深度神经网络中的灾难性遗忘

专知会员服务

35+阅读 · 2022年5月8日

热门VIP内容

开通专知VIP会员享更多权益服务

数据驱动死亡：以色列AI战争机器如何锁定目标

【普林斯顿博士论文】通过以人为本的评估推动负责任的人工智能

ICML 2025 | BiAssemble: 双臂机器人几何拼合问题的协同可供性学习

ICML 2025杰出论文出炉：8篇获奖，南大研究者榜上有名

相关资讯

基于模型的强化学习综述

基于模型的强化学习综述

专知

41+阅读 · 2022年7月13日

【KDD2020】图神经网络生成式预训练

【KDD2020】图神经网络生成式预训练

专知

22+阅读 · 2020年7月3日

【华为诺亚新论文】基于图上下文知识融入的预训练语言模型

【华为诺亚新论文】基于图上下文知识融入的预训练语言模型

专知

23+阅读 · 2019年12月8日

【CIKM2019论文】韩家炜团队HyperMine：富文本异构信息网络探索上位词

【CIKM2019论文】韩家炜团队HyperMine：富文本异构信息网络探索上位词

专知

14+阅读 · 2019年11月9日

【伯克利PNAS最新论文】可解释机器学习的定义、方法和应用

【伯克利PNAS最新论文】可解释机器学习的定义、方法和应用

专知

77+阅读 · 2019年10月20日

论文浅尝 | 采用多层注意力机制的事件检测

论文浅尝 | 采用多层注意力机制的事件检测

开放知识图谱

24+阅读 · 2019年8月24日

【机器学习】深入剖析机器学习中的统计思想

【机器学习】深入剖析机器学习中的统计思想

产业智能官

16+阅读 · 2019年1月24日

【UC伯克利】可解释性机器学习：定义、方法和应用

【UC伯克利】可解释性机器学习：定义、方法和应用

专知

70+阅读 · 2019年1月19日

【论文笔记】对话模型新方法，条件DialogWAE生成多模态回答

【论文笔记】对话模型新方法，条件DialogWAE生成多模态回答

专知

15+阅读 · 2018年6月11日

论文浅尝 | 基于置信度的知识图谱表示学习框架

论文浅尝 | 基于置信度的知识图谱表示学习框架

开放知识图谱

24+阅读 · 2018年2月27日

相关基金

反问题的数学建模、计算及应用

国家自然科学基金

2+阅读 · 2015年12月31日

社交网络中的流言传播与演化

国家自然科学基金

2+阅读 · 2015年12月31日

基于犹豫模糊语言信息的定性决策理论与方法

国家自然科学基金

2+阅读 · 2015年12月31日

强调与对比影响语篇理解的认知过程及其神经机制

国家自然科学基金

4+阅读 · 2015年12月31日

面向大数据的安全迁移学习方法

国家自然科学基金

28+阅读 · 2015年12月31日

复杂多元数据的半参数统计推断

国家自然科学基金

5+阅读 · 2014年12月31日

生物网络的可计算建模

国家自然科学基金

2+阅读 · 2014年12月31日

面向汉语文本理解的语义计算方法

国家自然科学基金

8+阅读 · 2014年12月31日

多语言大数据环境下的复杂网络行为分析、预测和干预

国家自然科学基金

4+阅读 · 2014年12月31日

基于融合先验知识的机器学习的多传感器融合研究

国家自然科学基金

16+阅读 · 2013年12月31日

相关论文

Is ChatGPT a Good Recommender? A Preliminary Study

Arxiv

170+阅读 · 2023年4月20日

NeuralField-LDM: Scene Generation with Hierarchical Latent Diffusion Models

Arxiv

40+阅读 · 2023年4月19日

On Efficient Training of Large-Scale Deep Learning Models: A Literature Review

Arxiv

213+阅读 · 2023年4月7日

A Survey on Graph Diffusion Models: Generative AI in Science for Molecule, Protein and Material

Arxiv

81+阅读 · 2023年4月4日

A Survey of Large Language Models

A Survey of Large Language Models

Arxiv

472+阅读 · 2023年3月31日

ChatGPT is a Knowledgeable but Inexperienced Solver: An Investigation of Commonsense Problem in Large Language Models

Arxiv

61+阅读 · 2023年3月29日

Nature Language Reasoning, A Survey

Arxiv

78+阅读 · 2023年3月26日

Knowledge Graphs: Opportunities and Challenges

Arxiv

171+阅读 · 2023年3月24日

Sparks of Artificial General Intelligence: Early experiments with GPT-4

Arxiv

51+阅读 · 2023年3月22日

Data-centric Artificial Intelligence: A Survey

Arxiv

24+阅读 · 2023年3月17日

微信扫码咨询专知VIP会员