为什么 JSON 不适合作为配置语言?

2018 年 8 月 6 日 开源中国

#扫描上方二维码报名成都源创会#



许多项目用 JSON 作为配置文件。也许最著名的例子就是 npm 和 yarn 使用的 package.json,还有许多其他项目也用 JSON,如 CloudFormation(最初仅支持 JSON,现在还支持 YAML)和 composer(PHP)。


但是,有几个原因表明 JSON 其实非常不适合作为配置语言。不要误会,我很喜欢 JSON。它非常灵活,而且机器和人类读起来都很容易,是个非常好的数据交换和存储的格式。但作为配置语言,它有许多缺点。


为什么 JSON 成了流行的配置语言?


JSON 被用于配置文件有好几个原因。最大的原因就是很容易实现。许多语言的标准库都支持 JSON,标准库不支持 JSON 的语言也会有非常易用的 JSON 包。其次就是开发者和用户都已经很熟悉 JSON 了,不需要再为产品学一种新的配置格式。更不用说 JSON 的各种相关工具,包括语法高亮、自动格式化、验证工具等等。


这些都是很好的理由。可惜这种格式真的不适合作为配置文件。


JSON 的问题


没有注释


配置语言的一个绝对必要的功能就是注释。注释非常有用,它能标识出配置项的可能的值,以及选择某个值的原因,还有最重要的一点就是临时注释掉某部分配置以方便测试和调试。而作为数据交换格式的 JSON 完全没有使用注释的必要。


当然也有方法解决这个问题。最常见的方法就是在对象中使用特殊的键作为注释,如"//"或"__comment"。但是,这种语法并不是很易读,而且如果要想在同一个对象中使用多个注释,就得给每个注释使用唯一的键。David Crockford(JSON的发明人)建议使用预处理器去掉注释。如果你的应用程序要求 JSON 作为配置文件,那么我建议使用这种方法,特别是如果有某种构建过程的话。当然,这会给编辑配置带来一些额外的工作,因此如果你正在创建的应用程序需要解析配置文件的话,不要依赖用户去做这项工作。


一些 JSON 库允许使用注释。例如,Ruby 的 JSON 模块,以及 Java 的 Jackson 库加上启用 JsonParser.Feature.ALLOW_COMMENTS 功能,就能支持在 JSON 中使用 JavaScript 风格的注释。然而这并不是标准,许多编辑器也不能正常支持 JSON 文件中的注释,使得编辑配置文件比较困难。


过分严格


JSON 的标准非常严格。严格的目的是为了方便 JSON 解析器的实现,但我认为,它也影响了易读性,而且或多或少地使得人类书写 JSON 更困难。


低信噪比


与许多其他配置语言相比,JSON 的噪声很大。许多标点符号尽管使得机器很容易实现,但完全不能帮助人类阅读。具体来说,对于配置文件而言,对象中的键几乎必然是标识符,因此键的引号是完全不必要的。


而且 JSON 要求在整个文档外面使用大括号,这样做的目的是使之(几乎)成为 JavaScript 的子集,并且在发送多个 JSON 对象时易于分隔各个对象。但作为配置文件,最外层的大括号是完全无用的。键值对之间的逗号大部分情况下也没有用。通常,每一行就是一个键值对,所以完全可以把换行符作为分隔符。


说起逗号,JSON 还不支持末尾逗号。如果要求每个键值对都以逗号结尾,那么至少应该接受末尾逗号吧,因为末尾逗号使得在末尾添加新项目很容易,而且能更容易地比较不同版本的差异。


过长的字符串


JSON 作为配置文件的另一个问题是它不支持多行字符串。如果要在字符串中使用换行,就得转义成“\n”,而且更糟糕的是,如果想在文件中写一个跨行的字符串,那是完全没办法的。若是配置文件里没有特别长的字符串的话还好。但如果配置文件里包含长字符串,比如某个项目的描述,或者 GPG 秘钥,你肯定不希望把所有行都放在同一行里并用“\n”连接起来。


数字


此外,JSON对于数字的定义在某些场合下很有问题。根据JSON标准,数字是任意精度的有限浮点数,以十进制表示。大多数情况下这没什么问题。但如果你需要十六进制表示,或者需要无穷大、NaN等值,那么TOML或YAML能更好地处理这些输入。


{

  "name": "example",

  "description": "A really long description that needs multiple lines.\nThis is a sample project to illustrate why JSON is not a good configuration format. This description is pretty long, but it doesn't have any way to go onto multiple lines.",

  "version": "0.0.1",

  "main": "index.js",

  "//": "This is as close to a comment as you are going to get",

  "keywords": ["example", "config"],

  "scripts": {

    "test": "./test.sh",

    "do_stuff": "./do_stuff.sh"

  },

  "bugs": {

    "url": "https://example.com/bugs"

  },

  "contributors": [{

    "name": "John Doe",

    "email": "johndoe@example.com"

  }, {

    "name": "Ivy Lane",

    "url": "https://example.com/ivylane"

  }],

  "dependencies": {

    "dep1": "^1.0.0",

    "dep2": "3.40",

    "dep3": "6.7"

  }

}


那应该用什么?


配置语言的选择取决于应用程序。每种语言都有自己的长处和短处。下面这些语言都可以考虑。这些都是专用于配置文件的语言,都比原本用于数据的 JSON 要好。


TOML


TOML 作为配置语言日渐流行。它的使用者包括Cargo(Rust的编译工具)、pip(Python包管理器)和dep(golang 依赖管理器)。TOML 有点像 INI 格式,但与 INI 不同的是,它有自己的标准,而且对于嵌套结构有很好的支持。它要比 YAML 简单得多,所以当配置文件很简单时,TOML就很合适。但如果配置文件有大量嵌套结构,那么 TOML 可能会显得有点啰嗦,此时其他语言如 YAML、HOCON 可能是更好的选择。



HJSON


HJSON(https://hjson.org/)是个基于 JSON 的语言,但更灵活,因此更容易阅读。它支持注释、多行字符串、不带引号的键和字符串,以及可选的逗号。如果你喜欢 JSON 的简单结构,但希望更适合配置文件的话,可以试试HJSON。它还提供命令行工具将 HJSON 转换成 JSON,因此如果你的工具要求 JSON 的话,你可以用 HJSON 写配置文件,并在构建过程中转换成 JSON。与 HJSON 相似的另一个选择是 JSON5。



HOCON


HOCON 是为Play框架设计的配置语言,但在Scala项目中非常流行。它是JSON的超集,所以可以兼容JSON文件。除了注释、可选逗号、多行字符串等标准功能之外,HOCON还支持从其他文家中导入,引用其他值的键以避免重复代码,以及使用点分隔的键指定到某个值的路径,这样用户就不需要把所有值直接放在大括号对象里了。



YAML

YAML(YAML Ain't Markup Language,“YAM不是标记语言”)是个非常灵活的格式,它几乎是JSON的超集,许多著名的项目都使用YAML,如Travis CI、Circle CI和AWS CloudFormation。YAML的库几乎和JSON一样流行。除了支持注释、换行符分隔、多行字符串、不带引号的字符串和更灵活的类型系统之外,YAML还可以引用之前定义过的结构,从而避免代码重复。


YAML的主要缺点就是它的标准太复杂,导致不同实现之间的不一致。它的缩进层次还有重要的语法意义(类似于Python),这也是褒贬不一的地方。复制粘贴YAML也比较困难。关于YAML的缺点可以参考“也许不是那么好的YAML”一文。



脚本语言

如果你的应用程序是用某种脚本语言写的,如 Python 或 Ruby,而且配置文件的来源可信,那么最好的选择就是用那种语言本身编写配置文件。对于编译语言,如果需要真正灵活的配置选项,也可以嵌入类似 Lua 这种脚本语言。这样可以享受到脚本语言的灵活性,而且比使用另一种配置文件更容易。但使用脚本语言的缺点就是它可能过于强大,而且如果配置语言的来源不可信,这样做会引入很严重的安全问题。


编写自己的配置语言


如果出于某种原因,键值配置格式不符合你的要求,并且由于性能或大小限制不能使用脚本语言,那么可能自己写一个配置格式更合适。但在这样做之前,务必要认真考虑,因为这样做不仅需要自行维护解析器,还需要让你的用户熟悉一种新的配置格式才行。


结论


有了这么多配置语言的选择,使用JSON并不是个好注意。如果你要创建新的应用、框架或库,需要一个配置文件,那么选择JSON之外的格式吧。


原文:

https://www.lucidchart.com/techblog/2018/07/16/why-json-isnt-a-good-configuration-language/

作者:Thayne McCombs© Lucidchart。

译文:CSDN


开源中国征稿开始啦!


开源中国 www.oschina.net 是目前备受关注、具有强大影响力的开源技术社区,拥有超过 200 万的开源技术精英。我们传播开源的理念,推广开源项目,为 IT 开发者提供一个发现、使用、并交流开源技术的平台。


现在我们开始对外征稿啦!如果你有优秀的技术文章想要分享,热点的行业资讯需要报道等等,欢迎联系开源中国进行投稿。投稿详情及联系方式请参见:我要投稿





推荐阅读

微软按月收费桌面计划,Win 10 将变成 Win 365?

Istio 1.0 正式版发布,可用于生产环境!

福布斯:谷歌的 Flutter 和 Fuchsia 将成下一代新兴技术

网站 HTTP 升级 HTTPS 完全配置手册

点击“阅读原文”查看更多精彩内容

登录查看更多
0

相关内容

JSON( Java Script Object Notation)是一种轻量级的资料交换语言,以文字为基础,且易于让人阅读。尽管 JSON 是在 JavaScript 的一個子集,但 JSON 是独立于语言的文本格式,並且采用了类似于 C 语言家族的一些习惯。
【2020新书】实战R语言4,323页pdf
专知会员服务
100+阅读 · 2020年7月1日
【实用书】学习用Python编写代码进行数据分析,103页pdf
专知会员服务
192+阅读 · 2020年6月29日
【2020新书】使用高级C# 提升你的编程技能,412页pdf
专知会员服务
57+阅读 · 2020年6月26日
【实用书】Python技术手册,第三版767页pdf
专知会员服务
234+阅读 · 2020年5月21日
【实用书】Python爬虫Web抓取数据,第二版,306页pdf
专知会员服务
117+阅读 · 2020年5月10日
【经典书】数据结构与算法C++,第二版,738页pdf
专知会员服务
166+阅读 · 2020年3月27日
机器学习速查手册,135页pdf
专知会员服务
338+阅读 · 2020年3月15日
【电子书】C++ Primer Plus 第6版,附PDF
专知会员服务
87+阅读 · 2019年11月25日
如何使用自然语言工具包(NLTK)在Python3中执行情感分析
Python程序员
19+阅读 · 2019年10月28日
你真的会正确地调试 TensorFlow 代码吗?
数据库开发
7+阅读 · 2019年3月18日
Python3.7中一种懒加载的方式
Python程序员
3+阅读 · 2018年4月27日
刚开始学编程?这几款小工具能让你事半功倍
Python为啥这么牛?
Python程序员
3+阅读 · 2018年3月30日
快乐的迁移到 Python3
Python程序员
5+阅读 · 2018年3月25日
33款可用来抓数据的开源爬虫软件工具 (推荐收藏)
数据科学浅谈
7+阅读 · 2017年7月29日
VrR-VG: Refocusing Visually-Relevant Relationships
Arxiv
6+阅读 · 2019年8月26日
Learning by Abstraction: The Neural State Machine
Arxiv
6+阅读 · 2019年7月11日
Arxiv
8+阅读 · 2019年3月28日
Arxiv
6+阅读 · 2018年11月1日
Arxiv
5+阅读 · 2017年7月23日
VIP会员
相关VIP内容
【2020新书】实战R语言4,323页pdf
专知会员服务
100+阅读 · 2020年7月1日
【实用书】学习用Python编写代码进行数据分析,103页pdf
专知会员服务
192+阅读 · 2020年6月29日
【2020新书】使用高级C# 提升你的编程技能,412页pdf
专知会员服务
57+阅读 · 2020年6月26日
【实用书】Python技术手册,第三版767页pdf
专知会员服务
234+阅读 · 2020年5月21日
【实用书】Python爬虫Web抓取数据,第二版,306页pdf
专知会员服务
117+阅读 · 2020年5月10日
【经典书】数据结构与算法C++,第二版,738页pdf
专知会员服务
166+阅读 · 2020年3月27日
机器学习速查手册,135页pdf
专知会员服务
338+阅读 · 2020年3月15日
【电子书】C++ Primer Plus 第6版,附PDF
专知会员服务
87+阅读 · 2019年11月25日
相关资讯
如何使用自然语言工具包(NLTK)在Python3中执行情感分析
Python程序员
19+阅读 · 2019年10月28日
你真的会正确地调试 TensorFlow 代码吗?
数据库开发
7+阅读 · 2019年3月18日
Python3.7中一种懒加载的方式
Python程序员
3+阅读 · 2018年4月27日
刚开始学编程?这几款小工具能让你事半功倍
Python为啥这么牛?
Python程序员
3+阅读 · 2018年3月30日
快乐的迁移到 Python3
Python程序员
5+阅读 · 2018年3月25日
33款可用来抓数据的开源爬虫软件工具 (推荐收藏)
数据科学浅谈
7+阅读 · 2017年7月29日
相关论文
Top
微信扫码咨询专知VIP会员