采购同事随口提了句比价,我用 TextIn xParse + WorkBuddy 做了个采购决策助手

0 阅读17分钟

最近采购同事聊到一个很具体的任务:为桥梁隧道结构健康监测项目比较几家传感器供应商。采购方关心的不只是总价,还要核对光纤应变、裂缝位移、倾角、振动传感器的参数和数量,以及数据采集仪、边缘网关的通道数、交付周期、质保期限和运维条件。麻烦在于,厂家甲发多级表头 Excel,厂家乙发带“表中表”的 Word,厂家丙发扫描 PDF,厂家丁又用了含包级折扣的报价表;包级总价、设备子项、选配附件和服务条款经常不在同一层。

我平时经常用 WorkBuddy,之前还用 TextIn 做过发票、合同助手。看到 WorkBuddy 里有 TextIn xParse 连接器后,就拿这组脱敏模拟材料做了一次验证:不先手工整理文件,直接把采购方需求和四家原始报价交给它,看看最后能不能生成一份可继续评审的供应商综合评估报告。

先看最后交付的结果

这次一共用了 6 份文件:采购方的需求 Word 和点位 Excel,以及甲、乙、丙、丁四家供应商提交的 Excel、Word 和 PDF。经过 TextIn xParse 逐份解析,四家的有效含税报价、B-01 频率、交付周期、质保期限和风险等级被放进了同一张综合评估表,另外还列出了 7 项勾稽异常与口径问题。

四家供应商综合评估结果

这份结果没有直接把最低价排在第一位。供应商乙报价最低,但 B-01 的 0.8Hz 低频下限构成硬性负偏离;供应商丁价格居中、质保 36 个月且包含包级折扣,因此成为条件性第一候选;供应商甲交付周期最短,但需要补充 B-01 频率证明。拿不准的数量、金额和参数没有被自动补全,而是留在人工复核清单中。

如果当下只是想快速初筛,不想先翻完整报告,也可以直接让它按自己关心的维度输出对比表。我又追问了一句,把有效报价、必选设备完整性、B-01 频率、D-01 通道数、技术偏离、选配附件、包级折扣、交付、质保、服务响应、安装调试、培训运维、报价勾稽、资料完整性、风险依据和推荐结论放在同一张表里。

TextIn xParse 解析后生成四家供应商多维对比表

这种多维表更适合临时讨论和快速筛选,关键差异一眼就能找到。需要把原始证据、勾稽异常和推荐依据完整留存,或者进入后续评审流程时,我再让它生成详细报告。

最后得到的是一份 18 页、5955 字的 Word 版《供应商综合评估报告》 。供应商总表、报价口径、技术偏离、商务风险、推荐顺序和待确认事项都在里面,采购人员可以继续修改、流转和归档。

生成可继续编辑的供应商综合评估 Word 报告

最终要交付的是这份报告,前面的文档解析是基础。下面先从 TextIn xParse 的连接和两轮实际测试说起,最后再把验证过的采购规则整理成可以直接复用的 Agent。

先把连接器接起来

在 WorkBuddy 的连接器页面搜索 TextIn xParse,入口并不难找。它不是把文件简单转成一段纯文本,而是先调用解析服务,把 Excel、Word、PDF 中的文字、表格和版面关系整理出来,再交给 WorkBuddy 继续做跨文件分析。连接器页面显示当前可用 PDF、Excel、Word 等文件类型,这正好对应采购资料的混杂状态。

WorkBuddy 中添加 TextIn xParse 连接器

授权时会弹出一组授权码。账号、密钥和完整 token 都属于敏感信息,文章中不能放可复用的真实凭证。授权码只用于当前连接流程,输入后回到 WorkBuddy 确认授权对象。这一步只建立连接,不会开始解析文件,真正调用服务要等到后面上传材料时。

TextIn xParse 授权码弹窗

复制授权码后回到授权页面确认 WorkBuddy,页面会显示正在授权的连接器和授权状态。我没有在授权完成后立刻上传文件,而是先检查连接器状态和可用能力,确认 Excel、Word、PDF 都在支持范围内,也避免把授权页面的成功提示误当成连接器已经可用。

WorkBuddy 授权 TextIn xParse

授权页面确认后,WorkBuddy 的连接器状态才会变成可用。这里顺手检查了一遍工具列表、支持的文件类型和调用入口,确保后面做普通解析对照时,测试变量只有是否启用 xParse。如果工具列表里没有出现 xParse,后面的文件分析就还不能算接入成功。

TextIn xParse 连接成功

连接器弹窗还显示 每日免费 1000 页。对这次几份模拟材料的测试足够了,但这只是当前账号页面显示的额度。我把它当作这次验证的可用额度,没有据此推断正式项目的调用成本;实际使用时仍要按采购文件量评估。

连接器显示每日免费 1000 页

连接完成后,我没有马上把四家复杂材料都放进去,而是先用一张普通 Excel 跑基线。简单表格本来就容易读,更适合先确认速度和基础结构是否稳定。

先用普通 Excel 跑一次

第一份测试用的是之前的分项报价 Excel,包含报价概览、父子级分项报价、技术参数和商务偏离 4 个工作表。表格不算特别刁钻,正适合做基线:同一份文件、同一个问题,只改变是否使用 TextIn xParse,先看响应时间和基础结果有什么差别。

这次直接在问题中写明“使用 TextIn xParse 分析该文件内容”。WorkBuddy 的完整回答耗时 2 分 08 秒,结果中同时标出了 xParse 解析耗时 328ms,并正确识别出文件名、供应商、项目和 4 个工作表。两个时间不是一回事:328ms 是连接器完成文件解析的时间,2 分 08 秒还包括 WorkBuddy 后续阅读、整理和生成回答。

明确使用 TextIn xParse 后的文件概览与耗时

核心报价页没有被压成一段散乱文字。xParse 还原出 5 大系统、12 项设备与服务的父子级关系,并保留设备编码、型号、数量、单位、未税单价、含税金额和交付批次。原表中省略重复父级名称的空白行,也能继续归到对应的 A、B、C、D、E 类系统下。

xParse 还原 5 大系统和 12 项设备服务的父子级报价

识别没有停在价格表。商务响应页中的交付、质保、技术偏离和服务风险也被整理出来:总报价 ¥1,309,184.80,交付分两个批次,质保 30 个月;B-01 频率下限优于采购要求,SV-01 因不同区域到场时间存在差异,被列为唯一中等风险项。页面底部还能看到 xParse 生成的 Markdown 和 JSON 文件,右侧原始 Markdown 保留了 rowspancolspan 等合并表头信息。

xParse 整理商务偏离并输出 Markdown 和 JSON 结构化文件

随后关闭 xParse,用同一个问题重新识别同一份 Excel,普通解析耗时 3 分 39 秒。两次都能读出这张规整表格的主要内容,但按完整回答时间比较,接入 xParse 后从 219 秒降到 128 秒,少等了 91 秒,响应速度约为普通解析的 1.7 倍。这是单份文件的一次实际记录,不是大规模性能测试。

未接入 xParse 时同一问题耗时 3 分 39 秒

普通 Excel 主要验证了速度和基础结构。接入 xParse 后,完整回答更快,同时还拿到了保留表格关系的 Markdown 和 JSON。更明显的差异,还要放到嵌套 Word、扫描 PDF 和跨文件比价里看。

把四家供应商的原文件放到桌面上

我先固定采购方的要求:哪些设备是必选,点位怎么换算数量,交付周期上限是多少,质保和故障响应有什么硬门槛。供应商文件保持收到时的样子,不提前改成统一模板,也不先手工抄表。

厂家甲用 Excel 报价。它的报价页同时出现采购包、设备本体、配套附件、实施服务、包小计、全量含税合计和必选含税合计,多级表头中还有合并单元格。采购人员如果只复制最后一个总价,很容易把选配附件或包级折扣一起算进去。

厂家甲原始 Excel 总包报价

厂家乙交的是 Word 技术响应。外层表先按采购包回应,内层又嵌了一张配置包明细,后面还有分项报价和商务条件。设备参数、报价和证明文件不在同一张表,某个型号有没有对应附件,需要把几个位置拼起来才能判断。

厂家乙原始 Word 技术响应与嵌套表格

厂家丙的 PDF 更接近采购人员实际收到的扫描件:表头复杂,表格边界不总是清晰,部分信息分散在不同页,最后还有修订页和手写补充。这样的文件把字读出来并不算结束,还要保留表格层级、页码关系和修订优先级。

厂家丙原始扫描 PDF 报价

厂家丁的报价先以 Excel 作为数据源,又导出成带水印的 PDF。A-02 裂缝位移传感器的数量被故意改成 2,单价和金额保持原值,用来检查解析结果能不能把这个勾稽异常列入复核。

厂家丁带复杂表头、水印和异常数量的 PDF 原件

文件摆齐后,问题已经不是“能不能识别汉字”,而是能不能把不同厂家的写法映射到采购方的 A-01、A-02、B-01、D-01、E-02 等编码上,并且保留证据来源。接下来把不接 xParse 和接入后的结果放在一起看。

效果对比:有没有 xParse,差别在哪里

不接 xParse,普通解析会漏掉什么

第一次联合测试刻意 不使用 TextIn xParse。我上传采购方 Word、采购方 Excel、厂家甲 Excel、厂家乙 Word 和厂家丙 PDF,模型用的是 Deepseek-V4-Flash。问题也按采购人员的口吻来:比较传感器、采集设备、含税价格、交付、质保和偏离项,最后给出需要人工复核的地方。

第一次不使用 TextIn xParse 的多文档采购分析

普通解析并不是完全不能用。它能发现采购方数量口径存在冲突,也能抓到乙的 B-01 频率下限和丙报价修订页这些关键词。但在 Word 技术响应上,模型把 PK-D、PK-E 判断成“报价缺失” ,而原文件实际上把报价放在另一层表格里。文字被读到了,表格之间的关系没有被保留下来。

为了确认问题出在哪,我把厂家乙的 Word 单独拿出来,用同一个 Hy3 模型做对照。没有 xParse 时,结果把外层配置包和分项报价拆成了两个互不相关的区域,PK-D、PK-E 没能完成对应。

未使用 xParse 分析厂家乙 Word 的结果

普通模型可以快速扫文本、找关键词,但采购比价需要可追溯的字段。漏掉一个嵌套表,就可能把一整包设备误判为缺项。问题已经明确,接着保持文件和模型不变,只打开 TextIn xParse

接入 xParse 后,表格关系回来了

启用 xParse 后再问同样的问题,结果里多出了普通解析没有稳定保留的信息:原始文件名、页码或工作表名、合并表头形成的层级、内嵌表格和外层采购包的关系,以及每个结论对应的证据位置。 WorkBuddy 负责跨文件比较,xParse 先把文件结构还原出来。

启用 TextIn xParse 后对多文档采购资料追问

追问结果里,厂家乙的正式名称被补全,厂家甲的三层表头和证据位置被保留下来,采购方 Word 中的点位拆分也能对应到设备数量。右侧还能看到 xParse 输出的多个 Markdown 文件,表格以 HTML table 形式保留,为后面的归一化提供了稳定输入。

同一个 Hy3 模型继续分析厂家乙 Word,结论就能核对了:PK-A、PK-B 缺少内嵌配置;PK-C 外层响应缺失但报价有 C-01、C-02;PK-D、PK-E 的外层、嵌套和报价能够对应;B-01 的响应范围是 0.8-120Hz,低于采购要求的低频下限;附件没有嵌入,需要厂家补充证明。

启用 xParse 后对厂家乙 Word 的结构化分析

我又把三家的必选设备和服务按采购执行口径放到一起比较。A-01 数量冲突、B-01 频率、D-01 通道数、E-02 质保期限被单独列出,金额按必选项计算,没有把选配附件直接塞进最低有效报价。

三家供应商必选设备与服务的含税总价对比

早期三家样本的归一化结果中,厂家甲必选含税约 132.27 万元,厂家乙约 126.71 万元,厂家丙按修订页口径约 134.86 万元。 这些数字只适用于当前采购清单、税率和必选定义。xParse 的作用是让金额、技术偏离和缺失证据能回到原始行,而不是只留下一张无法追溯的价格排名。

到这里,普通 Excel 的速度、复杂材料的结构还原和跨文件比价都验证过了。单次对话已经能完成任务,我又把这套采购口径整理成一个可以反复使用的 Agent。

最后,把这套流程做成可复用 Agent

我把角色、解析要求、归一化规则和报告结构写进 Agent 的 System Prompt。以后再收到新的供应商材料,只要替换上传文件,不需要重新解释必选、选配、折扣和技术偏离怎么判断。识别不到的字段标记为“未识别”,原文件没写的标记为“未提供”,不能为了补齐表格自行猜测。

一次上传六份材料并提交采购评审任务

这套 System Prompt 先要求 TextIn xParse 还原文档结构,再按设备编码统一采购口径,最后输出能够追溯到页码或工作表的评估报告。完整原文可以直接复用:

【角色】
你是一名桥梁隧道结构健康监测项目的采购决策助手,负责对供应商材料进行初筛、归一化比价、技术偏离检查和采购风险识别。
​
你的任务是为采购人员提供有证据依据的决策辅助,不得代替采购人员作出最终审批,不得在资料缺失时自行推测结论。
​
【任务目标】
根据采购方需求、点位清单、评审规则,以及各供应商提交的 Excel、Word、PDF 材料,生成一份《供应商综合评估报告》,并输出可继续编辑和归档的 Word 文档。
​
【工具使用要求】
1. 必须先逐份调用 TextIn xParse 解析所有采购方和供应商文件,不得仅依赖文件名称、文件摘要或普通文本抽取判断内容。
2. 每份文件解析完成后,保留文件名、页码或工作表名、表头层级、合并单元格、嵌套表格、父子级关系和原始文本。
3. 优先使用 xParse 返回的 Markdown 文本和表格结构数据进行后续分析。
4. 某份文件解析失败或内容不完整时,记录文件名、失败原因和缺失范围,不得跳过后假定其满足要求。
​
【文档解析要求】
1. 识别采购包、子系统、设备本体、配套附件、实施服务和包级折扣之间的层级关系。
2. 提取设备编码、设备名称、厂家型号、数量表达式、计算数量、单位、技术参数、未税金额、税率、含税金额、交付周期、质保期限和服务响应时间。
3. 区分必选项、随包附件和可选附件;包小计、合计和总计不得重复计入设备明细。
4. Word 中存在外层表格、嵌套配置表和附件引用时,应建立对应关系,不得把嵌套表误判为缺失。
5. PDF 中存在扫描表格、手写修订、跨页内容或修订页时,应同时保留原值、修订值和对应页码。
6. 无法识别的信息标记为“未识别”,原文件未提供的信息标记为“未提供”,不得自行补全。
​
【采购归一化规则】
1. 以采购方文件中的设备编码和采购包作为主要比较键,将不同供应商的字段统一到同一套比较口径。
2. 将设备本体、必选附件、随包附件、可选附件、实施服务、包级折扣、包小计和总计分别处理。
3. 有效含税报价只计算采购范围内的必选设备、随包附件和必选服务;可选附件单独列出,不得混入最低有效报价。
4. 同一编码在不同文件中出现多个数量、型号、参数或金额时,不得直接覆盖,应保留全部原值并标记冲突来源。
5. 数量、单价、未税金额、税额和含税金额需要进行勾稽校验;无法勾稽时列入人工复核。
6. 供应商自报必选范围与采购方范围不一致时,分别保留两种口径,并说明对有效报价的影响。
​
【评审要求】
1. 技术参数、交付、质保、服务响应和实施范围必须以采购方要求为判断依据。
2. 明确不满足硬性条件的项目标记为“负偏离”;证据缺失或内容冲突的项目标记为“待确认”。
3. 不得仅按照最低价格推荐供应商。推荐理由必须同时考虑技术满足度、有效报价、交付、质保、实施完整性和风险。
4. 每个风险、偏离和异常必须标注供应商、设备编码、原始值、判断依据以及文件名、页码或工作表位置。
5. 所有推荐均为条件性初筛建议,应单独列出可能改变推荐顺序的人工确认事项。
​
【报告输出】
生成《供应商综合评估报告》,至少包含:
1. 解析文件清单及 TextIn xParse 解析结果说明。
2. 供应商综合评估表:供应商、有效含税报价、技术匹配、交付周期、质保期限、风险等级和初步建议。
3. 必选设备、随包附件和实施服务完整性对照。
4. 可选附件、包级折扣及报价口径差异。
5. 技术偏离和商务风险清单。
6. 数量、单价、税额、含税金额及跨页内容的勾稽异常。
7. 供应商推荐顺序、推荐理由和不建议首选的原因。
8. 必须由采购人员确认的事项,并附文件名、页码或工作表位置。
​
先完成全部文件解析和交叉核验,再输出结论。报告结论必须能够追溯到原始材料,不得输出没有证据位置的确定性判断。

实际执行时,6 份文件都生成了 Markdown 文本和表格结构数据,总量约 1.3MB。页码、工作表名、合并单元格、嵌套表格和父子层级仍然保留,WorkBuddy 后面才能按设备编码做跨文件归一。

TextIn xParse 为六份文件保留文本与表格结构数据

以前收到供应商材料,通常要先展开合并单元格、补父级、拆 Word 内嵌表,再把 PDF 修订页抄回 Excel,做完这些才能开始比价。现在供应商发来不同格式的材料,可以先交给这个 Agent:TextIn xParse 保留文字、表格、层级和证据位置,WorkBuddy 再按采购规则整理成同一套比较口径。

简单 Excel 的对照里,TextIn xParse 的完整响应更快;换成多级表头 Excel、嵌套 Word 和扫描 PDF 后,它保留下来的结构让报价、参数、偏离和异常能够继续核对。最终得到的不是几段解析文字,而是一份能继续编辑、流转和归档的供应商综合评估 Word 报告

这份报告用于采购初筛和决策辅助。报价有效期、付款条款、原厂授权、缺失附件和技术偏离仍要由采购人员确认,最终审批也不会交给工具。TextIn xParse 先把最费时间的文档整理和证据定位做扎实,采购人员才能把精力放到真正需要判断的地方。

最后再次提醒一下,如何在Workbuddy中添加TextIn xParse

WorkBuddy 中添加 TextIn xParse 连接器