乐于分享
好东西不私藏

EXCEL|Power Query的M语言入门

EXCEL|Power Query的M语言入门
从今天开始,咱们再来一点点从M语言走起。这本书的后半场,我发现了新大陆。它开始一点一点由浅入深地讲解Power Query的根本-M语言。
因为今天在出差,所以就根据书上的内容稍微整理下发出来作为入门。
在深入学习 M 语言之前,我们有必要对 M 语言中的数据结构进行学习,有必要了解 M 语言中的值和数据是如何呈现的。本章从 Power Query 的数据结构理论讲起,逐步过渡到实战应用。掌握 M 语言的数据结构和实战方法论,有助于更加充分地发挥 M 语言在数据清洗实战中的作用。

在 Power Query 中,数据可以分成原生(Primitive)数据与结构化(Structured)数据两大类。原生数据很容易理解,就是填写在 Excel 单元格中的数据。它们可以是文本、数值、时间、日期等。在 Power Query 的数据区域中,我们经常会见到绿色字体的数据,它们通常是列表、记录、表或二进制文件等,这些就是结构化数据,如下图所示。

结构化数据的概念与 Python 中的 DataFrame 的概念相似,在 Python 中 DataFrame 是二维数据结构,一般指包含行和列的二维表结构,行和列通过索引获取。在 Power Query 中引入结构化数据,突破了 Excel 单元格的限制,在单个单元格中可以存储一行或一列数据,也可以存储整个表,甚至整个数据文件。M 语言就是在结构化数据基础上衍生出来的一门数据处理编程语言。

如果我们将不同数据类型的数据都添加成查询,在查询列表中可以看到不同数据类型对应的图标各不相同,如下图所示。这也是微软系列软件的一大特色,通过图标将功能、选项可视化,给予用户更好的使用体验。

M 语言中的结构化数据类型众多,其中列表、记录、表这三大数据容器较为常见,后面几天咱们来对这三大数据容器进行重点学习。

以上内容来自以下这本书。