【伯克利博士论文】视觉和机器人的可扩展表示，125页pdf - 专知VIP

会员服务 ·

17

博士论文 · 计算机视觉 · 机器人 ·

2023 年 9 月 27 日

【伯克利博士论文】视觉和机器人的可扩展表示，125页pdf

专知会员服务

专知，提供专业可信的知识分发服务，让认知协作更快更好！

人工智能系统近年来已经展现出了显著的进步。然而，扩展性和泛化到实际问题仍然是一个重大问题。在本论文中，我们探讨了构建可扩展计算机视觉人工智能系统的三个关键组成部分，包括模型优化能力、学习目标和大规模数据集，并将这些成果应用于机器人技术。我们的工作从视觉变换器的优化性研究开始，提出了一组新的优化性度量标准和一种替代的片段化设计。接下来，我们引入了一种对比自监督学习目标，减少了自监督学习中的归纳偏见，导致在各种数据集上都有优越的性能。然后，我们展示了自监督视觉预训练在真实世界图像中学习运动控制任务的效果，从像素中学习，超越了有监督的基线，并与标准状态性能相匹配。在此基础上，我们探索了在野外多样化视频中对真实世界机器人任务的自监督视觉预训练，展示了预训练表示在一系列任务和实体中的有效性。此外，我们提出了一种基于因果变换器的仿真到真实学习方法，用于真实世界中全尺寸仿人机器人的行走，这标志着第一个完全基于学习的方法用于真实世界中全尺寸仿人机器人的行走。最后，我们总结了论文并讨论了该领域进一步研究的可能未来方向。

成为VIP会员查看完整内容

33

相关内容

博士论文

博士论文是由攻读博士学位的研究生所撰写的学术论文。它要求作者在博士生导师的指导下，选择自己能够把握和驾驭的潜在的研究方向，开辟新的研究领域。由此可见，这就对作者提出了较高要求，它要求作者必须在本学科的专业领域具备大量的理论知识，并对所学专业的理论知识有相当深入的理解和思考，同时还要具有相当水平的独立科学研究能力，能够为在学科领域提出独创性的见解和有价值的科研成果。因而，较之学士论文、硕士论文，博士论文具有更高的学术价值，对学科的发展具有重要的推动作用。

【牛津大学博士论文】多模态深度学习在计算机视觉及其应用，138页pdf

【牛津大学博士论文】多模态深度学习在计算机视觉及其应用，138页pdf

专知会员服务

64+阅读 · 2023年11月7日

【CMU博士论文】开放环境视频中的多人三维重建，184页pdf

【CMU博士论文】开放环境视频中的多人三维重建，184页pdf

专知会员服务

34+阅读 · 2023年10月11日

【斯坦福博士论文】硬件感知的高效机器学习算法，215页pdf

【斯坦福博士论文】硬件感知的高效机器学习算法，215页pdf

专知会员服务

41+阅读 · 2023年8月16日

【斯坦福博士论文】面向医学图像分析的标签高效机器学习，214页pdf

【斯坦福博士论文】面向医学图像分析的标签高效机器学习，214页pdf

专知会员服务

57+阅读 · 2023年6月9日

【伯克利博士论文】可迁移生成模型，137页pdf

【伯克利博士论文】可迁移生成模型，137页pdf

专知会员服务

55+阅读 · 2023年5月23日

【伯克利博士论文】基于生成模型的图像和长视频合成，114页pdf

【伯克利博士论文】基于生成模型的图像和长视频合成，114页pdf

专知会员服务

49+阅读 · 2023年5月18日

【伯克利博士论文】数据与标签高效表示学习，114页pdf

【伯克利博士论文】数据与标签高效表示学习，114页pdf

专知会员服务

53+阅读 · 2023年2月20日

【牛津大学博士论文】论可解释性和不确定性在确保人工智能应用安全中的作用，217页pdf

【牛津大学博士论文】论可解释性和不确定性在确保人工智能应用安全中的作用，217页pdf

专知会员服务

83+阅读 · 2022年10月13日

【斯坦福博士论文】视觉语言的多模态表示，102页pdf

专知会员服务

73+阅读 · 2021年7月29日

【伯克利博士论文】面向深度图像合成的机器学习，155页pdf

【伯克利博士论文】面向深度图像合成的机器学习，155页pdf

专知会员服务

36+阅读 · 2021年5月26日

【佐治亚理工博士论文】基于策略智能体和有限反馈的序列决策，211页pdf

【佐治亚理工博士论文】基于策略智能体和有限反馈的序列决策，211页pdf

专知

38+阅读 · 2023年4月13日

【斯坦福博士论文】机器人仿真与控制的组合优化，210页pdf

【斯坦福博士论文】机器人仿真与控制的组合优化，210页pdf

专知

9+阅读 · 2023年4月12日

【MIT博士论文】情感理解的计算框架，200页pdf

【MIT博士论文】情感理解的计算框架，200页pdf

专知

0+阅读 · 2023年4月9日

【牛津大学博士论文】深度学习在基于结构的药物发现中的应用，362页pdf

【牛津大学博士论文】深度学习在基于结构的药物发现中的应用，362页pdf

专知

1+阅读 · 2023年4月8日

【斯坦福博士论文】生成模型中深度概率推理的扩展与应用，262页pdf

【斯坦福博士论文】生成模型中深度概率推理的扩展与应用，262页pdf

专知

8+阅读 · 2022年11月30日

【苏黎世联邦理工博士论文】深度强化学习的体系结构，186页pdf

【苏黎世联邦理工博士论文】深度强化学习的体系结构，186页pdf

专知

6+阅读 · 2022年11月29日

【哈佛大学博士论文】构建深度学习的理论基础:一种实证方法，164页pdf

【哈佛大学博士论文】构建深度学习的理论基础:一种实证方法，164页pdf

专知

9+阅读 · 2022年11月28日

【牛津大学博士论文】学习用几何和语义表示场景，149页pdf

【牛津大学博士论文】学习用几何和语义表示场景，149页pdf

专知

1+阅读 · 2022年11月27日

【斯坦福大学博士论文】深度学习医学图像解译，205页pdf

【斯坦福大学博士论文】深度学习医学图像解译，205页pdf

专知

4+阅读 · 2022年11月18日

【斯坦福博士论文】利用先验知识和结构进行数据高效的机器学习，154页pdf

【斯坦福博士论文】利用先验知识和结构进行数据高效的机器学习，154页pdf

专知

28+阅读 · 2022年9月11日

基于视觉特性的目标检测算法研究

国家自然科学基金

4+阅读 · 2015年12月31日

基于自媒体处理中的极坐标下的非线性理论及超分辨率重建方法研究

国家自然科学基金

0+阅读 · 2015年12月31日

视觉信息的局部特征表示及应用研究

国家自然科学基金

2+阅读 · 2015年12月31日

移动增强现实中基于视觉—惯性传感器的混合跟踪方法研究

国家自然科学基金

2+阅读 · 2015年12月31日

保持结构的交互式图像及视频编辑方法研究

国家自然科学基金

2+阅读 · 2015年12月31日

高维不平衡数据的集成学习算法研究

国家自然科学基金

15+阅读 · 2015年12月31日

基于记忆学习与免疫系统的仿生控制研究

国家自然科学基金

7+阅读 · 2015年12月31日

基于集成流形学习的监控视频中人体行为识别研究

国家自然科学基金

3+阅读 · 2014年12月31日

复杂多元数据的半参数统计推断

国家自然科学基金

5+阅读 · 2014年12月31日

基于多智能体强化学习的多机器人系统研究

国家自然科学基金

48+阅读 · 2009年12月31日

Is ChatGPT a Good Recommender? A Preliminary Study

Arxiv

174+阅读 · 2023年4月20日

NeuralField-LDM: Scene Generation with Hierarchical Latent Diffusion Models

Arxiv

42+阅读 · 2023年4月19日

A Comprehensive Survey on Deep Graph Representation Learning

Arxiv

106+阅读 · 2023年4月11日

On Efficient Training of Large-Scale Deep Learning Models: A Literature Review

Arxiv

223+阅读 · 2023年4月7日

A Survey on Graph Diffusion Models: Generative AI in Science for Molecule, Protein and Material

Arxiv

86+阅读 · 2023年4月4日

A Survey of Large Language Models

A Survey of Large Language Models

Arxiv

494+阅读 · 2023年3月31日

Unleashing the Power of Edge-Cloud Generative AI in Mobile Networks: A Survey of AIGC Services

Arxiv

152+阅读 · 2023年3月29日

Nature Language Reasoning, A Survey

Arxiv

81+阅读 · 2023年3月26日

Knowledge Graphs: Opportunities and Challenges

Arxiv

179+阅读 · 2023年3月24日

Sparks of Artificial General Intelligence: Early experiments with GPT-4

Arxiv

51+阅读 · 2023年3月22日

VIP会员

相关主题

计算机视觉

相关VIP内容

【牛津大学博士论文】多模态深度学习在计算机视觉及其应用，138页pdf

【牛津大学博士论文】多模态深度学习在计算机视觉及其应用，138页pdf

专知会员服务

64+阅读 · 2023年11月7日

【CMU博士论文】开放环境视频中的多人三维重建，184页pdf

【CMU博士论文】开放环境视频中的多人三维重建，184页pdf

专知会员服务

34+阅读 · 2023年10月11日

【斯坦福博士论文】硬件感知的高效机器学习算法，215页pdf

【斯坦福博士论文】硬件感知的高效机器学习算法，215页pdf

专知会员服务

41+阅读 · 2023年8月16日

【斯坦福博士论文】面向医学图像分析的标签高效机器学习，214页pdf

【斯坦福博士论文】面向医学图像分析的标签高效机器学习，214页pdf

专知会员服务

57+阅读 · 2023年6月9日

【伯克利博士论文】可迁移生成模型，137页pdf

【伯克利博士论文】可迁移生成模型，137页pdf

专知会员服务

55+阅读 · 2023年5月23日

【伯克利博士论文】基于生成模型的图像和长视频合成，114页pdf

【伯克利博士论文】基于生成模型的图像和长视频合成，114页pdf

专知会员服务

49+阅读 · 2023年5月18日

【伯克利博士论文】数据与标签高效表示学习，114页pdf

【伯克利博士论文】数据与标签高效表示学习，114页pdf

专知会员服务

53+阅读 · 2023年2月20日

【牛津大学博士论文】论可解释性和不确定性在确保人工智能应用安全中的作用，217页pdf

【牛津大学博士论文】论可解释性和不确定性在确保人工智能应用安全中的作用，217页pdf

专知会员服务

83+阅读 · 2022年10月13日

【斯坦福博士论文】视觉语言的多模态表示，102页pdf

专知会员服务

73+阅读 · 2021年7月29日

【伯克利博士论文】面向深度图像合成的机器学习，155页pdf

【伯克利博士论文】面向深度图像合成的机器学习，155页pdf

专知会员服务

36+阅读 · 2021年5月26日

热门VIP内容

开通专知VIP会员享更多权益服务

《俄乌战争中的无人系统：新的战争方式与新兴趋势——来自前线的印象》报告

《海上自主水面船舶远程操作中心：安全可持续运行的多维度分析》

多模态大语言模型下游调优中“保持自我”的重要性

隐身自主无人水下航行器技术如何变革水下作战并重塑海军竞争

相关资讯

【佐治亚理工博士论文】基于策略智能体和有限反馈的序列决策，211页pdf

【佐治亚理工博士论文】基于策略智能体和有限反馈的序列决策，211页pdf

专知

38+阅读 · 2023年4月13日

【斯坦福博士论文】机器人仿真与控制的组合优化，210页pdf

【斯坦福博士论文】机器人仿真与控制的组合优化，210页pdf

专知

9+阅读 · 2023年4月12日

【MIT博士论文】情感理解的计算框架，200页pdf

【MIT博士论文】情感理解的计算框架，200页pdf

专知

0+阅读 · 2023年4月9日

【牛津大学博士论文】深度学习在基于结构的药物发现中的应用，362页pdf

【牛津大学博士论文】深度学习在基于结构的药物发现中的应用，362页pdf

专知

1+阅读 · 2023年4月8日

【斯坦福博士论文】生成模型中深度概率推理的扩展与应用，262页pdf

【斯坦福博士论文】生成模型中深度概率推理的扩展与应用，262页pdf

专知

8+阅读 · 2022年11月30日

【苏黎世联邦理工博士论文】深度强化学习的体系结构，186页pdf

【苏黎世联邦理工博士论文】深度强化学习的体系结构，186页pdf

专知

6+阅读 · 2022年11月29日

【哈佛大学博士论文】构建深度学习的理论基础:一种实证方法，164页pdf

【哈佛大学博士论文】构建深度学习的理论基础:一种实证方法，164页pdf

专知

9+阅读 · 2022年11月28日

【牛津大学博士论文】学习用几何和语义表示场景，149页pdf

【牛津大学博士论文】学习用几何和语义表示场景，149页pdf

专知

1+阅读 · 2022年11月27日

【斯坦福大学博士论文】深度学习医学图像解译，205页pdf

【斯坦福大学博士论文】深度学习医学图像解译，205页pdf

专知

4+阅读 · 2022年11月18日

【斯坦福博士论文】利用先验知识和结构进行数据高效的机器学习，154页pdf

【斯坦福博士论文】利用先验知识和结构进行数据高效的机器学习，154页pdf

专知

28+阅读 · 2022年9月11日

相关基金

基于视觉特性的目标检测算法研究

国家自然科学基金

4+阅读 · 2015年12月31日

基于自媒体处理中的极坐标下的非线性理论及超分辨率重建方法研究

国家自然科学基金

0+阅读 · 2015年12月31日

视觉信息的局部特征表示及应用研究

国家自然科学基金

2+阅读 · 2015年12月31日

移动增强现实中基于视觉—惯性传感器的混合跟踪方法研究

国家自然科学基金

2+阅读 · 2015年12月31日

保持结构的交互式图像及视频编辑方法研究

国家自然科学基金

2+阅读 · 2015年12月31日

高维不平衡数据的集成学习算法研究

国家自然科学基金

15+阅读 · 2015年12月31日

基于记忆学习与免疫系统的仿生控制研究

国家自然科学基金

7+阅读 · 2015年12月31日

基于集成流形学习的监控视频中人体行为识别研究

国家自然科学基金

3+阅读 · 2014年12月31日

复杂多元数据的半参数统计推断

国家自然科学基金

5+阅读 · 2014年12月31日

基于多智能体强化学习的多机器人系统研究

国家自然科学基金

48+阅读 · 2009年12月31日

相关论文

Is ChatGPT a Good Recommender? A Preliminary Study

Arxiv

174+阅读 · 2023年4月20日

NeuralField-LDM: Scene Generation with Hierarchical Latent Diffusion Models

Arxiv

42+阅读 · 2023年4月19日

A Comprehensive Survey on Deep Graph Representation Learning

Arxiv

106+阅读 · 2023年4月11日

On Efficient Training of Large-Scale Deep Learning Models: A Literature Review

Arxiv

223+阅读 · 2023年4月7日

A Survey on Graph Diffusion Models: Generative AI in Science for Molecule, Protein and Material

Arxiv

86+阅读 · 2023年4月4日

A Survey of Large Language Models

A Survey of Large Language Models

Arxiv

494+阅读 · 2023年3月31日

Unleashing the Power of Edge-Cloud Generative AI in Mobile Networks: A Survey of AIGC Services

Arxiv

152+阅读 · 2023年3月29日

Nature Language Reasoning, A Survey

Arxiv

81+阅读 · 2023年3月26日

Knowledge Graphs: Opportunities and Challenges

Arxiv

179+阅读 · 2023年3月24日

Sparks of Artificial General Intelligence: Early experiments with GPT-4

Arxiv

51+阅读 · 2023年3月22日

微信扫码咨询专知VIP会员