查看类别

将多个 Excel 文件合并到一个表格中

阅读需时27分钟

Excel文件夹连接器

将多个 Excel 文件合并到一个表格中

将查询流指向工作簿文件夹,每个工作表都会变成一个 SQL 表——所有文件中的同一个工作表,合并、已键入且只读。无需合并宏,也无需每月重建主工作簿。

每个工作表一张表格 下个月的文件自动加入 每个工作簿全部投入或全部投入 未上传任何内容。
财务月末
2026-06.xlsx 2026-07.xlsx 2026-08.xlsx + 41
每个标签页一张表格
数据订单 数据返回 数据摘要

Query Streams 是一个安全的实时数据库集成平台,它将 Excel 工作簿文件夹转换为实时 SQL 表,您可以从 Microsoft Excel、Google Sheets、Airtable 和您的 AI 助手进行查询。 了解更多信息,请访问 QueryStreams.com免费注册 几分钟内即可合并您的第一个工作簿文件夹。

几乎每个机构里都有这样一个文件夹。每月、每个分支机构、每个季度都有一本工作簿,每本都有三四个相同的标签页,都是由当初根本没想到有一天需要汇总的人制作的。每年都会有人被要求“汇总工作簿”,而老实说,这得花一天时间,而且明年还得再做一遍。

难点不在于算术,而在于感兴趣的数据不在文件夹里,而是在…… 穿过 文件夹内包含 48 个文件和 140 个标签页。 Excel文件夹连接器 它反过来将文件夹表示为一组 SQL 表,每个工作表名称对应一个表,因此在编写任何 SQL 语句之前,每个工作簿中的同一选项卡就已经合并在一起了。

一个装有工作簿的文件夹
2026-06.xlsx — 订单、退货、汇总 2026-07.xlsx — 订单、退货、汇总 2026-08.xlsx — 订单、退货、汇总 下个月的工作簿
三个 SQL 表
data_orders — 每个“订单”选项卡 data_returns — 每个“返回”选项卡 数据摘要 — 每个“摘要”选项卡 已包含

为什么常用的Excel文件合并方法都行不通了

有三条常用的路线,但它们都失败在同一个地方:它们最终会合并成一个 事物 ——一个主工作簿、一个查询加载、一个透视缓存——在运行当天是正确的,但第二天就错了。

方法可处理多个标签页这需要花费你多少钱?
将工作表复制到主工作簿中 手工 每过一段时间就重新生成,主文件不断增长,直到打开速度变慢。
Power Query“从文件夹” 一次一个 每个查询合并一个选定的工作表,该工作表位于其所属的工作簿中,并将每一行加载到文件中。三个工作表意味着三个查询,分别维护。
VBA 循环或 Office 脚本 如果写给 有人拥有并调试它,它会打开每个工作簿进行读取,而同事打开的一个文件会导致程序停止运行。
在线“合并 XLSX”服务 你把公司的财务数据上传到陌生人的服务器上。如果是商业用途,那就到此为止了。
查询流 Excel 文件夹 他们所有人 没有任何文件被合并、在 Excel 中打开、复制或上传——每个工作表都会变成它所在位置的表格。

底层共享机制——文件夹扫描、文件账本、加密本地缓存等 文件文件事件 库存表、容量限制和只读保证——对于每种文件夹类型都是相同的,并且会在文中解释一次。 如何使用 SQL 查询文件夹中的文件接下来的内容仅涉及工作簿,而工作簿的特殊之处远超你的想象。

每个工作表一个表格,而不是每个文件夹一个表格。

这是与……的主要区别 CSV文件夹其中每个文件都会合并到一个表中。工作簿并非单一实体,而是一个小型数据库: 工作簿等于数据库,工作表等于表格因此,一个 Excel 文件夹连接器会将一个数据表固定到每个文件夹上。 工作表名称 并用文件夹中每个工作簿中该工作表的行填充它。

在 Excel 文件夹连接器中无需填写表名,因为工作表会自动决定表名。每个固定的表都会被命名。 数据_ 后面跟着经过脱敏处理的工作表名称,因此,一个包含“订单”、“退货”和“汇总”三个标签页的工作簿文件夹会显示以下内容: 数据订单, 数据返回数据摘要每个都是一个结构完整的固定表格,具有真实的列类型,而不是一堆文本。

每个工作簿中的每个“订单”选项卡,一个查询
SELECT strftime(order_date, '%Y-%m') AS month, region, COUNT(*) AS orders, SUM(line_total) AS revenue FROM data_orders GROUP BY month, region ORDER BY month, revenue DESC;

因为每一行都承载着 源文件 根据中心指南中描述的列,可以将单个工作簿中的工作表重新组合在一起。将明细表与其自身的标题表连接起来。 源文件 它将同一文件的两个工作表重新合并,这相当于 SQL 中需要编写 48 次的跨工作表公式。

重新合并同一工作簿中的两个标签页
SELECT s.report_month, s.prepared_by, SUM(o.line_total) AS detail_total FROM data_orders AS o JOIN data_summary AS s ON s._source_file = o._source_file GROUP BY s.report_month, s.prepared_by ORDER BY s.report_month;

如果两个工作表名称清理后都变成了相同的表名——例如“Q1 Orders”和“Q1-Orders”——则系统会发出命名拒绝通知,而不是静默覆盖。系统会显示冲突的消息,告诉您是哪两个工作表发生了冲突。您可以重命名其中一个工作表,或者只列出您需要更改的工作表。

缺少一张钉在别针上的工作簿会被完全搁置。

这种行为令人惊讶,因此值得好好解释,而不是简单地归类为“怪癖”。

连接器固定了“订单”、“退货”和“汇总”表后,每个工作簿都应该包含这三个表。如果一个工作簿包含“订单”和“汇总”表,但没有“退货”表,则说明该工作簿存在问题。 整个停放 — 并未完全吞噬,其退货行悄然缺失。其订单行也未包含在内。 数据订单 此外,原因也记录在案。

另一种方法听起来更温和,但危险得多。吞下这两片药片会让你…… 数据返回 表格中完全缺失了一个月的数据,但数字中没有任何迹象表明这一点。由此计算出的所有总数都会出现误差,误差的数值恰好是任何人都看不到的。这种缺失的工作表是典型的静默式部分数据错误,连接器会将其视为数据错误,而不是格式差异。

工作簿要么全部填写,要么全部不填写,所有工作表都一样。 文件中的所有工作表都在一次事务中写入,因此,如果第四个工作表上的值读取失败,则第一到第三个工作表也会回滚。这样就不会出现只读取了三分之二的工作簿——这使得按文件计数进行完整性检查成为一种可靠的方法。

这条规则也适用于反向操作。如果工作簿中新增了一个之前从未被标记过的工作表,它也会被冻结,因为新工作表代表新数据,连接器不会自动判断它是否属于某个工作簿。同样,如果工作表的列发生了变化,例如新增列、删除列或文本类型更改为数字,都会导致工作簿冻结,并标记出与之不一致的工作表和列。

如果工作簿带有草稿标签,请为所需的草稿页命名。 设置 纸张 指定一个明确的包含列表(例如“订单和退货”)会告知连接器,其他所有内容都已明确排除在外——因此,同事的“备注”或“透视表1”选项卡不再被视为意外的工作表。这是此驱动程序中最有用的设置。

包含列表的检查与其他所有内容一样严格:列表中列出的工作表,如果在任何抽样工作簿中都找不到,则视为拒绝,并列出该工作表。 之所以发现这个问题,是因为包含列表中的一个拼写错误会导致配置看起来与正常工作的配置完全一样。

拒绝,让你免于面对一堆空表格。

如果严格遵循整本练习册规则,就会遇到一个棘手的问题。如果文件夹中的练习册确实存在,并且…… 不同的 工作表集——一个包含“订单”和“汇总”,另一个包含“发货”和“汇总”——然后,固定的集合是所有这些集合的并集,没有哪个工作簿包含整个并集,每个文件都会被搁置。连接器会固定五个表,不接收任何数据,并报告技术上正确的成功。

因此,该结果会在首次同步期间被检测到,并在任何操作发生之前按名称被拒绝。该消息会列出即将固定的工作表,显示实际检测到的不同工作表集及其示例文件名,并指出两个真正的修复方案。

  • 缩小表格选项 每个工作簿真正共享的标签页——如果您想要的是一个通用的工作表,这通常是正确的答案。
  • 将表格布局切换为每个布局一张表格这样就完全停止使用工作表名称作为分组键了。这是下一节的内容。

拒绝通知中列明了两个补救措施,总比五个空表格和一个绿色勾号要好,这也是为什么这个连接器值得指向你不确定的文件夹的原因。

每个布局一张表格,用于存放人工组装的文件夹。

Excel 是人类的领域。实际文件夹中的工作簿很少会共享同一个布局,因为它们是由人创建的,而不是由每日导出程序自动生成的。可选功能 每个布局一张桌子 模式正是为此而设计的。

在这种模式下,单位不是工作表名称,而是单个工作簿中的单个工作表,工作表按其名称分组。 精确的 形状:列名和列类型的有序列表。每个不同的形状都会生成一个独立的表格。这种做法带来的结果既自由又略显奇怪:一个工作簿中名为“Sheet1”的标签页,只要其列名和类型与另一个工作簿中名为“Data”的标签页完全匹配,就会合并到一起;而两个名称相同但形状不同的标签页则会分别生成不同的表格。

行为默认布局(已固定)每个布局一张桌子
分组键工作表名称确切的列名和类型顺序
不同工作簿的图纸集可能有所不同。不——一开始就拒绝了。是的,这就是重点。
险些发生的布局停放成漂移状态合并为一个单独的表——不允许合并“几乎相同”的数据。
表名数据表名称源自于提供给该组的文件名
天花板每张纸上找到一个表格25 种不同的布局,然后是命名拒绝

在这种模式下,文件名来自文件而不是标签页。连接器会提取组内文件名共有的前半部分,并去掉末尾的数字部分。 orders_2026_01.xlsx 通过 orders_2026_12.xlsx 生成一个名为 命令 ——而且,重要的是,一个孤独的 发货周_01.xlsx 生产 每周发货量 而不是 发货周_01这一点很重要,因为一旦保存的查询引用了固定表,该表就不会再重命名,所以单个文件生成的名称必须与其后续同级文件生成的名称相同。如果没有可用的名称,则使用工作表名称;如果两个组仍然想要相同的名称,则其中一个组会获得一个简短的哈希后缀。

此处的更改是累加的,绝不追溯。如果某个工作表的布局从未被图钉识别过,则该工作表会保留其工作簿,而不是被强制放入最近的表格;更改连接器选项会重新采样文件夹,并将新布局作为图钉识别。 新的 表格中,前一个引脚已经命名的每个布局都会保留其名称。

电子表格中的每个数字都是浮点数。

在底层,.xlsx 文件会将每个数值单元格存储为双精度浮点数 (double) 类型。工作表中没有整数类型,这意味着订单号、数量和百分比对于读者来说看起来都是一样的。如果不加修改,就会得到一列…… 双倍的 原本预期显示整数的地方,却显示为标识符 1002.0.

查询流会探测采样值,而不是依赖声明的类型。如果数值列中的每个值都是整数、有限值且在范围内,则该列会被提升并固定为整数。 大情报 — 因此,标识符、计数和数量在 SQL 和它们最终所在的电子表格中都表现得像整数一样。

然后逐个文件地检查提升操作。每个工作簿在写入行之前都会重新检查,如果提升后的列中出现小数、无穷大或超出范围的值,则会将该工作簿冻结,并指定工作表和列的名称。这是有意为之:将双精度浮点数转换为整数时会进行无声的四舍五入,因此如果按照默认行为,0.5 会变成 0 或 1,而不会告知具体是哪一个。而使用命名冻结则是更诚实的替代方案。

金钱的价值取决于具体类型。 货币列包含小数,因此永远不会被提升为浮点列——它始终保持浮点数形式,而非常大的浮点货币金额可能会出现几分之一美分的误差。如果需要精确的总额,请在连接器的清单覆盖中将该列重新转换为十进制。重新转换是在读取行时执行的官方认可的转换,如果某个值无法转换,则会将文件保留,而不是进行四舍五入以适应。

文件夹中的类型也必须保持一致。如果 发票号 在大多数工作簿中,该列被读取为数字,而在某个工作簿中则被读取为文本。首次同步时,系统会拒绝匹配,并同时引用这两个文件和两种类型,而不是采用多数投票法并剔除不匹配的那个。对于某些工作簿中根本不存在的列,处理方式则较为简单:它们会被固定为可空类型,并在缺少这些列的工作表中被读取为空。

连接器认为您的表格从哪里开始,到哪里结束。

工作表不是一种文件格式,它更像是一块画布,人们在上面放置各种内容。工作表转换成行的方式遵循两条规则,一旦掌握了这两条规则,操作起来就非常简单。

阅读从这里开始 第一行实际包含单元格该行被视为表头,并提供列名。数据上方的空白行会被跳过,因此即使表格从 A4 开始(因为有人在顶部留了空白),也能正确读取。A1 中的标题或合并横幅会被忽略。 然而,由于是空白的,所以它会被读作标题——这会立即显示为荒谬的列名,而不是一个微妙的错误答案。

阅读到此结束 第一行完全空白因此,在汇总块之前留一个空白的间隔行是一个自然的边界:它上面的数据是表格内容,而下面的汇总行则被排除在外,这通常是你想要的结果,因为汇总行会使你的数据翻倍。这也意味着,如果在长列表中间留一个空白行,该工作表会被静默截断。因此,如果每个文件的行数看起来偏少,首先要检查的就是是否存在空行。

每个工作簿贡献的行
SELECT _source_file, COUNT(*) AS rows, MIN(order_date) AS first_date, MAX(order_date) AS last_date FROM data_orders GROUP BY _source_file ORDER BY _source_file;

该查询是对文件夹内工作簿的完整性检查。由于文件要么全部包含在内,要么全部不包含,因此结果中缺少的工作簿已被暂时搁置,原因正在等待处理。 文件事件如果一个工作簿的计数远低于相邻的工作簿,那么它通常会遇到一个空行。

读者与代理人一同登场,而非下载。

正确读取 .xlsx 文件是一项真正的工程技术,Query Streams 使用官方签名的 Excel 读取器作为其查询引擎,而不是自行开发的解析器,这正是真正实现类型推断的来源。该二进制文件大小约为 46 MB,并且与它所构建的引擎版本绑定。

因此, 在网络代理安装或更新时,与网络代理一起部署。而且,查询时从未获取过该文件。代理程序可能运行在位于代理服务器后、隔离网段或暂时离线的机器上,如果连接器在首次查询时需要静默地从互联网下载文件,则在这些情况下连接失败。如果文件确实不存在,连接器会通过文件名提示您重新运行安装程序——它不会回退到低级解析器并给出不同的答案。

值得注意的是,工作簿中的标签页列表是由代理程序自动读取工作簿自身的索引来完成的——.xlsx 文件是一个 zip 压缩包,工作表列表就位于其中。非有效的 Open XML 工作簿文件无法建立索引,因此,旧版二进制 .xls 文件被重命名为 .xlsx、上传的文件被截断或只写入了一半,都会显示“无法作为 xlsx 工作簿读取”的错误信息,而不是产生令人困惑的解析错误。真正的 .xls 文件需要先另存为 .xlsx 格式。

发生了什么连接器的作用
工作簿对列的类型存在分歧。拒绝首次同步,引用两个文件和两种类型。
没有哪个工作簿会保存所有钉住的表格。拒绝,显示所见的床单组和两个修复方案
工作簿中缺少一张已钉好的表格。公园里的工作簿是完整的;其余部分则保持同步。
工作簿增加了一张表格除非公园把它关上,否则 纸张 include-list 会将其移出范围。
在同一张工作表中,可以添加、删除或重新输入列。将工作簿中的工作表和列命名为“公园”。
提升为整数列中的分数将工作簿中的工作表和列命名为“公园”。
该文件不是可读的 .xlsx 文件。按名称将其停放;首次同步时会跳过并报告。
未识别的驱动程序选项直接拒绝——设置不起作用比出错更糟糕。

注意前两行与其余行的区别。关于分歧 文件夹的形状 这些都是拒绝操作,因为没有安全的固定台面。问题在于…… 个人练习册 是公园,因为其他 47 个文件没有做错任何事,应该继续运行。

Excel 的所有设置以及何时更改

Excel文件夹连接器仅添加了两个自身的设置, 板材表格布局其中两个共享项在工作簿上的行为差异显著,值得在此详细介绍。表单上的其他所有内容——根文件夹、递归和最大深度、符号链接、文件名解析模式、文件夹标记、扫描间隔、哈希、删除策略、事件保留、扫描限制和四个摄取上限——对所有文件夹类型都是共享的,并且在文档中仅记录一次。 文件集连接器指南本节介绍工作簿在此基础上添加的功能。

勾选“显示高级选项”之前,部分设置是隐藏的。 哈希算法、删除策略、事件保留策略、扫描限制、四个数据摄取上限以及清单覆盖设置都位于该开关下方。如果屏幕上没有显示以下设置,原因就在于此。

你会寻找但却找不到的一个字段是 表名CSV、Parquet 和 JSONL 文件夹都有一个统一的表,因为它们包含的所有内容都会合并到一个表中。Excel 文件夹则没有,因为工作表已经为表命名了。 数据订单, 数据返回 诸如此类,如上所述。无需输入任何内容,也无法通过输入任何内容来更改它。

板材

默认值:为空,即每个工作簿中的每个工作表。 这是对该驱动程序影响最大的设置,也是出现异常情况时最值得首先尝试的设置。

设置方法: 每行填写一张纸的名称,在标有“”的方框中。 板材每个名称都与工作簿中显示的工作表标签名称完全匹配。您列出的每个名称都会成为其自身的固定表格;所有未列出的名称都被视为有意超出范围,永远不会被读取。

工作表——每行一个标签页名称
订单退货

何时更改? 有两种情况,而且都很常见。第一种情况是工作簿中包含一些没人需要的标签页——例如“备注”工作表、“说明”工作表、创建文件的人遗留的“透视表1”工作表、以及“图表数据”辅助区域。第二种情况是只有九个标签页的工作簿,而你只关心订单。无论哪种情况,直接命名你需要的标签页都比描述你不需要的标签页要清晰得多。

当一个标签页脱落导致打印失败或大量工作簿被搁置时,这也是最简洁的解决方法。因为每个工作簿都应该包含所有钉好的纸张——如果工作簿缺少一张,就会被完全搁置。 缺少一张钉在别针上的工作簿会被完全搁置。 如上所述,一位同事只需在其副本中添加一个个人标签页,就足以将该文件置顶。列出您实际需要的表格,即可将多余的标签页排除在外,并将整个工作簿重新纳入控制范围。

如果你答错了: 如果您指定的某个工作表未出现在任何抽样工作簿中,则该工作表会被标记为已找到的工作表,而不是一个完全空白的表格。拼写错误不能被误认为是有效的配置。

表格布局

默认:一个固定布局它要求作用域内的每个工作簿都共享一个形状。另一种方法是 每个布局一张桌子它按确切的列和类型而不是按工作表名称对工作表进行分组,最多可创建 25 个不同的布局。

坦白地说: 在 Excel 文件夹中,按布局进行管理通常比在任何其他类型的文件夹中都更合适。 机器生成的 Parquet 文件文件夹格式统一。而工作簿文件夹则是由人工历时数年整理而成,格式统一性往往难以保证。如果默认设置拒绝您的文件夹,这并非需要绕过的问题——而是连接器在告诉您这是一个按布局分类的文件夹。

更改后会发生什么: 文件夹会被重新采样,表格也会被重建。这是有意为之,因为固定的形状正是发生变化的地方。重建过程中会保留已使用的表名,因此现有的已保存查询、电子表格刷新和 Nova 查询仍然有效。 每个布局一张表格,用于存放人工组装的文件夹。 以上内容介绍了名称的由来以及两种模式的区别。

包含和排除模式

这些是共享设置,但 Excel 卡片会为您预先设置其中一个,并且存在一个值得注意的锁定文件陷阱。 包含模式 到货时已预先填充 **/*.xlsx通常情况下,这样定义是正确的。但如果文件夹中包含不属于同一数据集的工作簿,则需要缩小范围。 **/month-end-*.xlsx,或 exports/**/*.xlsx 跳过同级存档文件夹。

添加 **/~$* 排除任何共享驱动器上的模式。 当有人打开一个工作簿时,Microsoft Excel 会在其旁边写入一个名为“lock.txt”的隐藏锁定文件。 ~$whatever.xlsx它符合包含模式,但不是可读的工作簿,并且会暂停——因此,每次扫描时,打开该文件的同事都会生成一个新的暂停文件。只需排除一次前缀即可永久解决此问题。您的排除模式会被添加到内置列表中,而不是替换现有列表。

巫师强制执行的一条规则是: 混合文件夹是指同一根目录下有两个连接器,每个驱动程序一个连接器。 如果同一个文件夹中同时包含工作簿和 CSV 文件,扩大包含模式以同时捕获两者是行不通的,因为两种格式不能共享一个固定形状。正确的做法是,将 Excel 文件夹连接器和 CSV 文件夹连接器指向同一路径。

清单覆盖(JSON)

在后面 显示高级选项这是针对结构正确但细节错误的已固定形状的“逃生舱”:例如,您想要重命名的列、您想要固定的类型,或者您根本不想拥有的列。它会在固定形状时应用,因此它会成为表定义的一部分,而不是在每次查询时都重新应用。

清单覆盖——三个关键
{ "重命名": { "数量": "数量" }, "重新类型": { "价格": "DECIMAL(18,4)" }, "排除": [ "内部备注" ] }
  • 重命名 — 给列取一个比标题行更好的名称。这在工作簿中很有用,因为标题单元格可能是一个完整的句子。
  • 重新输入 — 将列固定为您选择的类型,而不是被嗅探到的类型。
  • 排除 — 完全从表格中删除列。

具体到Excel而言, 重新输入 是浮点问题的实际解决方案 如上所述。货币列包含小数,因此永远不会被转换为整数类型,而是保持浮点数形式,这会导致非常大的金额出现偏差。 总计:DECIMAL(18,2) 提供精确的算术运算;固定标识符 "invoice_no": "BIGINT" 阻止它渲染为 1002.0重新输入被视为一项有意的指令,并在读取行时执行。

清空此框会清除您的覆盖设置,并将表格恢复到采样时的形状。仅接受带有可选精度的纯类型名称。 DECIMAL(18,2), VARCHAR, 大情报, 日期 — 任何异常情况都会在保存时而不是同步时被拒绝。

设置

您需要一个 Query Streams 帐户,并在可以访问该文件夹的位置安装网络代理——例如文件服务器、已映射共享的工作站或您自己的笔记本电脑。Excel 文件夹连接器需要 网络代理 2.6 或更高版本.

  1. 从此处安装代理。 下载页面 如果它还没有运行的话。
  2. 在门户中,添加数据连接器并选择 Excel文件夹.
  3. 输入代理计算机上显示的文件夹路径。 包含模式 已经播种了 **/*.xlsx将其缩小到类似这样 **/month-end-*.xlsx 如果文件夹中包含您不想合并的工作簿。
  4. 如果工作簿中包含您不需要的工作标签页,请列出您需要保留的工作标签页。 板材每行一个。留空则占用所有纸张。
  5. 保存。该代理最多可抽取 64 个工作簿的样本,每个工作表固定一个表格,并报告其发现的内容——包括任何无法读取的工作簿。
  6. 打开查询生成器,选择连接器并查询工作表表——或者让 Nova AI 为您编写 SQL。
使用代理看到的路径。 您桌面上映射的驱动器号在运行代理的服务器上无法解析。请使用 UNC 路径,例如: 财务月末或者代理自身机器上的本地路径,并检查代理运行所用的帐户是否可以读取它。

工作表表格可以放在哪里?

  • 微软Excel和谷歌表格 — 从加载项运行查询,合并后的行将出现在工作表中,并可根据需要刷新。
  • Airtable、Smartsheet、Baserow、SeaTable 和 Anvil — 定时同步会将合并后的数据推送到您的团队已经使用的工具中。
  • 新星人工智能 — 用简单的英语提出问题,即可在每个工作簿中获取 SQL,并附带图表。
  • Claude、Cursor、ChatGPT 和 Grok — 通过 Query Streams MCP 服务器,AI 助手可以直接查询工作簿文件夹。
  • REST API — 将合并工作表表格转换为合作伙伴或内部应用程序的端点。

第一个例子有一种令人愉悦的对称性。工作簿文件夹变成了一个动态表格,你可以从电子表格中查询它——这样,答案就会直接显示在 Microsoft Excel 中,而无需任何人打开 48 个 Excel 文件来生成结果。

常见问题

如何将多个Excel文件合并成一个表格? +
在可以访问该文件夹的计算机上安装 Query Streams 网络代理,并添加一个 Excel文件夹 连接器并为其提供文件夹路径;包含模式已预先填充。 **/*.xlsx每个工作表名称都会变成一个 SQL 表,其中包含文件夹中每个工作簿中对应工作表的行。所有数据都不会合并到新文件中,因此之后添加的工作簿会在下次同步时自动包含在内。
为什么每个工作表都只有一个表格,而不是一个合并的表格? +
因为工作簿的行为更像是一个小型数据库,而不是一个单独的文件:工作簿等同于数据库,工作表等同于表格。将“订单”选项卡与“汇总”选项卡合并会产生无意义的结果,所以每个工作表名称都有其自己的固定表格。 数据订单, 数据摘要 ——并且每个工作簿中的同一个工作表标签页都会被合并到同一个表格中。如果您想要将一个工作表中的所有内容都放在一个表格中,那么您就能得到想要的结果。
因为缺少一个工作表,所以有一个工作簿被搁置了。为什么不直接导入其他工作簿呢? +
因为一个表格悄悄缺少一个月的数据行比一个表格出现明显的数据缺失更糟糕。每个工作簿都应该包含所有固定的工作表,所以缺少一个工作表会导致整个文件停止运行,并将原因记录下来。 文件事件 其他工作簿保持同步。重新添加工作表,或缩小范围。 纸张 包含到真正出现在各处的标签页。
我的工作簿有不同的标签页。我还能把它们合并吗? +
是的,通过 每个布局一张桌子 此设置会根据工作表的确切列和类型(而非工作表名称)进行分组,因此即使工作簿的标签页完全不同,也能正常使用,并且每个不同的形状都会拥有自己的表格,最多可达 25 个。默认布局会预先拒绝此文件夹,而不是固定那些将始终保持为空的表格,拒绝消息会将您引导至此。
我可以只合并每个工作簿中的一个特定工作表吗? +
是的——设定 纸张 选项中仅包含一个名称。只有该名称会被固定并读取,其他所有标签页都会被刻意排除在外,这也阻止了临时标签页和数据透视表占用工作簿。如果某个标签页的名称出现在选项中,但该标签页不存在于任何抽样工作簿中,则会被报告为错误而不是被忽略,因此拼写错误不会被忽略。
为什么我的身份证号码会显示小数,或者为什么突然不显示了? +
.xlsx 文件将所有数字存储为浮点值,因此标识符和计数看起来像小数。查询流会检查采样值,并将所有值均为整数、有限值且在范围内的列固定为整数类型,这就是为什么 ID 会显示为整数的原因。然后,每个工作簿都会被重新检查,如果此类列中存在小数,则会保留该列的名称,而不是默默地进行四舍五入。
货币总额是否准确? +
货币列包含小数,因此会保留电子表格本身使用的浮点类型,导致大额金额出现几分之一的误差。如果需要精确计算,请在连接器的清单覆盖设置中将该列重新转换为十进制——转换会在读取行时应用,如果值无法转换,则会直接丢弃文件,而不是进行四舍五入。
它能读取 .xls 文件吗?我的工作表需要从 A1 单元格开始吗? +
该连接器读取的是 Open XML 工作簿,因此旧版二进制 .xls 文件需要先另存为 .xlsx 格式;仅仅重命名是不够的,会导致文件显示“无法作为 xlsx 工作簿读取”。您的表格不必从 A1 单元格开始——数据上方的空白行会被跳过,第一个包含单元格的行将用作标题行。读取操作会在遇到第一个完全空白的行时停止,因此列表中间的空白行会导致该工作表被截断。
一个连接器可以处理多少个工作簿? +
默认文件数上限为 10 万个,可提升至 200 万个,单个文件读取大小上限为 512 MB,默认行数上限为 200 万行。对于 Excel,行数上限适用于整个工作簿及其所有工作表,并且在提交任何数据之前都会进行检查,因此如果超过上限,文件将被回滚并写入上限值,而不是存储部分数据。完整数据请参见[此处]。 文件集概览.
我的工作簿是否已打开、更改或上传? +
以上都不是。Microsoft Excel 从未启动,文件从未被写入、移动或重命名,也从未上传任何内容——解析后的数据会以加密形式缓存在与网络代理相同的计算机上,只有查询返回的行才会离开您的网络。查询必须是单行的。 选择, , 实践, 描述解释 声明中,任何可能写入的内容都会在运行前被拒绝。
我可以将工作簿数据合并到数据库中吗? +
是的。Excel 文件夹本身就是一个普通的连接器,因此它的工作表可以连接到 Microsoft SQL Server、PostgreSQL、MySQL、Oracle、BigQuery 等数据库,以及 Stripe 或 Shopify 等 API 连接器。包含月末工作簿的文件夹可以通过一条只读语句连接到数据库中的实时订单表,而无需事先将任何数据加载到数据仓库中。

开始

停止手动合并工作簿

只需将代理指向文件夹一次,即可将每个工作表作为 SQL 表进行查询——无论是在 Microsoft Excel、Google Sheets、Airtable 还是您的 AI 助手上。下个月的工作簿会自动添加,您的文件永远不会离开您的网络。

相关指南: 如何使用 SQL 查询文件夹中的文件 | 合并多个 CSV 文件到一个表格中 | 下载查询流代理 | 所有文件集连接器指南

类别:文件集连接器

标签:合并多个Excel文件、合并Excel文件、将多个Excel文件合并为一个、使用SQL查询Excel文件、Excel文件夹连接器、xlsx文件夹、合并工作簿

元描述:将多个 Excel 文件合并到一个实时 SQL 表中。每个工作表对应一个表,不支持上传,只读。

更新 2026 年 8 月 27 日

Powered by BetterDocs