首页
学习
活动
专区
圈层
工具
发布
社区首页 >专栏 >采购同事随口提了句比价,我用 TextIn xParse + WorkBuddy 做了个采购决策助手

采购同事随口提了句比价,我用 TextIn xParse + WorkBuddy 做了个采购决策助手

原创
作者头像
一只牛博
发布2026-08-13 14:04:46
发布2026-08-13 14:04:46
1.8K0
举报
文章被收录于专栏:AIAI

最近采购同事聊到一个很具体的任务:为桥梁隧道结构健康监测项目比较几家传感器供应商。采购方关心的不只是总价,还要核对光纤应变、裂缝位移、倾角、振动传感器的参数和数量,以及数据采集仪、边缘网关的通道数、交付周期、质保期限和运维条件。麻烦在于,厂家甲发多级表头 Excel,厂家乙发带“表中表”的 Word,厂家丙发扫描 PDF,厂家丁又用了含包级折扣的报价表;包级总价、设备子项、选配附件和服务条款经常不在同一层。

我平时经常用 WorkBuddy,之前还用 TextIn 做过发票、合同助手。看到 WorkBuddy 里有 TextIn xParse 连接器后,就拿这组脱敏模拟材料做了一次验证:不先手工整理文件,直接把采购方需求和四家原始报价交给它,看看最后能不能生成一份可继续评审的供应商综合评估报告。

先看最后交付的结果

这次一共用了 6 份文件:采购方的需求 Word 和点位 Excel,以及甲、乙、丙、丁四家供应商提交的 Excel、Word 和 PDF。经过 TextIn xParse 逐份解析,四家的有效含税报价、B-01 频率、交付周期、质保期限和风险等级被放进了同一张综合评估表,另外还列出了 7 项勾稽异常与口径问题。

四家供应商综合评估结果
四家供应商综合评估结果

这份结果没有直接把最低价排在第一位。供应商乙报价最低,但 B-01 的 0.8Hz 低频下限构成硬性负偏离;供应商丁价格居中、质保 36 个月且包含包级折扣,因此成为条件性第一候选;供应商甲交付周期最短,但需要补充 B-01 频率证明。拿不准的数量、金额和参数没有被自动补全,而是留在人工复核清单中。

如果当下只是想快速初筛,不想先翻完整报告,也可以直接让它按自己关心的维度输出对比表。我又追问了一句,把有效报价、必选设备完整性、B-01 频率、D-01 通道数、技术偏离、选配附件、包级折扣、交付、质保、服务响应、安装调试、培训运维、报价勾稽、资料完整性、风险依据和推荐结论放在同一张表里。

TextIn xParse 解析后生成四家供应商多维对比表
TextIn xParse 解析后生成四家供应商多维对比表

这种多维表更适合临时讨论和快速筛选,关键差异一眼就能找到。需要把原始证据、勾稽异常和推荐依据完整留存,或者进入后续评审流程时,我再让它生成详细报告。

最后得到的是一份 18 页、5955 字的 Word 版《供应商综合评估报告》。供应商总表、报价口径、技术偏离、商务风险、推荐顺序和待确认事项都在里面,采购人员可以继续修改、流转和归档。

生成可继续编辑的供应商综合评估 Word 报告
生成可继续编辑的供应商综合评估 Word 报告

最终要交付的是这份报告,前面的文档解析是基础。下面先从 TextIn xParse 的连接和两轮实际测试说起,最后再把验证过的采购规则整理成可以直接复用的 Agent。

先把连接器接起来

在 WorkBuddy 的连接器页面搜索 TextIn xParse,入口并不难找。它不是把文件简单转成一段纯文本,而是先调用解析服务,把 Excel、Word、PDF 中的文字、表格和版面关系整理出来,再交给 WorkBuddy 继续做跨文件分析。连接器页面显示当前可用 PDF、Excel、Word 等文件类型,这正好对应采购资料的混杂状态。

WorkBuddy 中添加 TextIn xParse 连接器
WorkBuddy 中添加 TextIn xParse 连接器

授权时会弹出一组授权码。账号、密钥和完整 token 都属于敏感信息,文章中不能放可复用的真实凭证。授权码只用于当前连接流程,输入后回到 WorkBuddy 确认授权对象。这一步只建立连接,不会开始解析文件,真正调用服务要等到后面上传材料时。

TextIn xParse 授权码弹窗
TextIn xParse 授权码弹窗

复制授权码后回到授权页面确认 WorkBuddy,页面会显示正在授权的连接器和授权状态。我没有在授权完成后立刻上传文件,而是先检查连接器状态和可用能力,确认 Excel、Word、PDF 都在支持范围内,也避免把授权页面的成功提示误当成连接器已经可用。

WorkBuddy 授权 TextIn xParse
WorkBuddy 授权 TextIn xParse

授权页面确认后,WorkBuddy 的连接器状态才会变成可用。这里顺手检查了一遍工具列表、支持的文件类型和调用入口,确保后面做普通解析对照时,测试变量只有是否启用 xParse。如果工具列表里没有出现 xParse,后面的文件分析就还不能算接入成功。

TextIn xParse 连接成功
TextIn xParse 连接成功

连接器弹窗还显示 每日免费 1000 页。对这次几份模拟材料的测试足够了,但这只是当前账号页面显示的额度。我把它当作这次验证的可用额度,没有据此推断正式项目的调用成本;实际使用时仍要按采购文件量评估。

连接器显示每日免费 1000 页
连接器显示每日免费 1000 页

连接完成后,我没有马上把四家复杂材料都放进去,而是先用一张普通 Excel 跑基线。简单表格本来就容易读,更适合先确认速度和基础结构是否稳定。

先用普通 Excel 跑一次

第一份测试用的是之前的分项报价 Excel,包含报价概览、父子级分项报价、技术参数和商务偏离 4 个工作表。表格不算特别刁钻,正适合做基线:同一份文件、同一个问题,只改变是否使用 TextIn xParse,先看响应时间和基础结果有什么差别。

这次直接在问题中写明“使用 TextIn xParse 分析该文件内容”。WorkBuddy 的完整回答耗时 2 分 08 秒,结果中同时标出了 xParse 解析耗时 328ms,并正确识别出文件名、供应商、项目和 4 个工作表。两个时间不是一回事:328ms 是连接器完成文件解析的时间,2 分 08 秒还包括 WorkBuddy 后续阅读、整理和生成回答。

明确使用 TextIn xParse 后的文件概览与耗时
明确使用 TextIn xParse 后的文件概览与耗时

核心报价页没有被压成一段散乱文字。xParse 还原出 5 大系统、12 项设备与服务的父子级关系,并保留设备编码、型号、数量、单位、未税单价、含税金额和交付批次。原表中省略重复父级名称的空白行,也能继续归到对应的 A、B、C、D、E 类系统下。

xParse 还原 5 大系统和 12 项设备服务的父子级报价
xParse 还原 5 大系统和 12 项设备服务的父子级报价

识别没有停在价格表。商务响应页中的交付、质保、技术偏离和服务风险也被整理出来:总报价 ¥1,309,184.80,交付分两个批次,质保 30 个月;B-01 频率下限优于采购要求,SV-01 因不同区域到场时间存在差异,被列为唯一中等风险项。页面底部还能看到 xParse 生成的 Markdown 和 JSON 文件,右侧原始 Markdown 保留了 rowspancolspan 等合并表头信息。

xParse 整理商务偏离并输出 Markdown 和 JSON 结构化文件
xParse 整理商务偏离并输出 Markdown 和 JSON 结构化文件

随后关闭 xParse,用同一个问题重新识别同一份 Excel,普通解析耗时 3 分 39 秒。两次都能读出这张规整表格的主要内容,但按完整回答时间比较,接入 xParse 后从 219 秒降到 128 秒,少等了 91 秒,响应速度约为普通解析的 1.7 倍。这是单份文件的一次实际记录,不是大规模性能测试。

未接入 xParse 时同一问题耗时 3 分 39 秒
未接入 xParse 时同一问题耗时 3 分 39 秒

普通 Excel 主要验证了速度和基础结构。接入 xParse 后,完整回答更快,同时还拿到了保留表格关系的 Markdown 和 JSON。更明显的差异,还要放到嵌套 Word、扫描 PDF 和跨文件比价里看。

把四家供应商的原文件放到桌面上

我先固定采购方的要求:哪些设备是必选,点位怎么换算数量,交付周期上限是多少,质保和故障响应有什么硬门槛。供应商文件保持收到时的样子,不提前改成统一模板,也不先手工抄表。

厂家甲用 Excel 报价。它的报价页同时出现采购包、设备本体、配套附件、实施服务、包小计、全量含税合计和必选含税合计,多级表头中还有合并单元格。采购人员如果只复制最后一个总价,很容易把选配附件或包级折扣一起算进去。

厂家甲原始 Excel 总包报价
厂家甲原始 Excel 总包报价

厂家乙交的是 Word 技术响应。外层表先按采购包回应,内层又嵌了一张配置包明细,后面还有分项报价和商务条件。设备参数、报价和证明文件不在同一张表,某个型号有没有对应附件,需要把几个位置拼起来才能判断。

厂家乙原始 Word 技术响应与嵌套表格
厂家乙原始 Word 技术响应与嵌套表格

厂家丙的 PDF 更接近采购人员实际收到的扫描件:表头复杂,表格边界不总是清晰,部分信息分散在不同页,最后还有修订页和手写补充。这样的文件把字读出来并不算结束,还要保留表格层级、页码关系和修订优先级。

厂家丙原始扫描 PDF 报价
厂家丙原始扫描 PDF 报价

厂家丁的报价先以 Excel 作为数据源,又导出成带水印的 PDF。A-02 裂缝位移传感器的数量被故意改成 2,单价和金额保持原值,用来检查解析结果能不能把这个勾稽异常列入复核。

厂家丁带复杂表头、水印和异常数量的 PDF 原件
厂家丁带复杂表头、水印和异常数量的 PDF 原件

文件摆齐后,问题已经不是“能不能识别汉字”,而是能不能把不同厂家的写法映射到采购方的 A-01、A-02、B-01、D-01、E-02 等编码上,并且保留证据来源。接下来把不接 xParse 和接入后的结果放在一起看。

效果对比:有没有 xParse,差别在哪里

不接 xParse,普通解析会漏掉什么

第一次联合测试刻意 不使用 TextIn xParse。我上传采购方 Word、采购方 Excel、厂家甲 Excel、厂家乙 Word 和厂家丙 PDF,模型用的是 Deepseek-V4-Flash。问题也按采购人员的口吻来:比较传感器、采集设备、含税价格、交付、质保和偏离项,最后给出需要人工复核的地方。

第一次不使用 TextIn xParse 的多文档采购分析
第一次不使用 TextIn xParse 的多文档采购分析

普通解析并不是完全不能用。它能发现采购方数量口径存在冲突,也能抓到乙的 B-01 频率下限和丙报价修订页这些关键词。但在 Word 技术响应上,模型把 PK-D、PK-E 判断成“报价缺失”,而原文件实际上把报价放在另一层表格里。文字被读到了,表格之间的关系没有被保留下来。

为了确认问题出在哪,我把厂家乙的 Word 单独拿出来,用同一个 Hy3 模型做对照。没有 xParse 时,结果把外层配置包和分项报价拆成了两个互不相关的区域,PK-D、PK-E 没能完成对应。

未使用 xParse 分析厂家乙 Word 的结果
未使用 xParse 分析厂家乙 Word 的结果

普通模型可以快速扫文本、找关键词,但采购比价需要可追溯的字段。漏掉一个嵌套表,就可能把一整包设备误判为缺项。问题已经明确,接着保持文件和模型不变,只打开 TextIn xParse

接入 xParse 后,表格关系回来了

启用 xParse 后再问同样的问题,结果里多出了普通解析没有稳定保留的信息:原始文件名、页码或工作表名、合并表头形成的层级、内嵌表格和外层采购包的关系,以及每个结论对应的证据位置。 WorkBuddy 负责跨文件比较,xParse 先把文件结构还原出来。

启用 TextIn xParse 后对多文档采购资料追问
启用 TextIn xParse 后对多文档采购资料追问

追问结果里,厂家乙的正式名称被补全,厂家甲的三层表头和证据位置被保留下来,采购方 Word 中的点位拆分也能对应到设备数量。右侧还能看到 xParse 输出的多个 Markdown 文件,表格以 HTML table 形式保留,为后面的归一化提供了稳定输入。

同一个 Hy3 模型继续分析厂家乙 Word,结论就能核对了:PK-A、PK-B 缺少内嵌配置;PK-C 外层响应缺失但报价有 C-01、C-02;PK-D、PK-E 的外层、嵌套和报价能够对应;B-01 的响应范围是 0.8-120Hz,低于采购要求的低频下限;附件没有嵌入,需要厂家补充证明。

启用 xParse 后对厂家乙 Word 的结构化分析
启用 xParse 后对厂家乙 Word 的结构化分析

我又把三家的必选设备和服务按采购执行口径放到一起比较。A-01 数量冲突、B-01 频率、D-01 通道数、E-02 质保期限被单独列出,金额按必选项计算,没有把选配附件直接塞进最低有效报价。

三家供应商必选设备与服务的含税总价对比
三家供应商必选设备与服务的含税总价对比

早期三家样本的归一化结果中,厂家甲必选含税约 132.27 万元,厂家乙约 126.71 万元,厂家丙按修订页口径约 134.86 万元。 这些数字只适用于当前采购清单、税率和必选定义。xParse 的作用是让金额、技术偏离和缺失证据能回到原始行,而不是只留下一张无法追溯的价格排名。

到这里,普通 Excel 的速度、复杂材料的结构还原和跨文件比价都验证过了。单次对话已经能完成任务,我又把这套采购口径整理成一个可以反复使用的 Agent。

最后,把这套流程做成可复用 Agent

我把角色、解析要求、归一化规则和报告结构写进 Agent 的 System Prompt。以后再收到新的供应商材料,只要替换上传文件,不需要重新解释必选、选配、折扣和技术偏离怎么判断。识别不到的字段标记为“未识别”,原文件没写的标记为“未提供”,不能为了补齐表格自行猜测。

一次上传六份材料并提交采购评审任务
一次上传六份材料并提交采购评审任务

这套 System Prompt 先要求 TextIn xParse 还原文档结构,再按设备编码统一采购口径,最后输出能够追溯到页码或工作表的评估报告。完整原文可以直接复用:

代码语言:txt
复制
【角色】
你是一名桥梁隧道结构健康监测项目的采购决策助手,负责对供应商材料进行初筛、归一化比价、技术偏离检查和采购风险识别。

你的任务是为采购人员提供有证据依据的决策辅助,不得代替采购人员作出最终审批,不得在资料缺失时自行推测结论。

【任务目标】
根据采购方需求、点位清单、评审规则,以及各供应商提交的 Excel、Word、PDF 材料,生成一份《供应商综合评估报告》,并输出可继续编辑和归档的 Word 文档。

【工具使用要求】
1. 必须先逐份调用 TextIn xParse 解析所有采购方和供应商文件,不得仅依赖文件名称、文件摘要或普通文本抽取判断内容。
2. 每份文件解析完成后,保留文件名、页码或工作表名、表头层级、合并单元格、嵌套表格、父子级关系和原始文本。
3. 优先使用 xParse 返回的 Markdown 文本和表格结构数据进行后续分析。
4. 某份文件解析失败或内容不完整时,记录文件名、失败原因和缺失范围,不得跳过后假定其满足要求。

【文档解析要求】
1. 识别采购包、子系统、设备本体、配套附件、实施服务和包级折扣之间的层级关系。
2. 提取设备编码、设备名称、厂家型号、数量表达式、计算数量、单位、技术参数、未税金额、税率、含税金额、交付周期、质保期限和服务响应时间。
3. 区分必选项、随包附件和可选附件;包小计、合计和总计不得重复计入设备明细。
4. Word 中存在外层表格、嵌套配置表和附件引用时,应建立对应关系,不得把嵌套表误判为缺失。
5. PDF 中存在扫描表格、手写修订、跨页内容或修订页时,应同时保留原值、修订值和对应页码。
6. 无法识别的信息标记为“未识别”,原文件未提供的信息标记为“未提供”,不得自行补全。

【采购归一化规则】
1. 以采购方文件中的设备编码和采购包作为主要比较键,将不同供应商的字段统一到同一套比较口径。
2. 将设备本体、必选附件、随包附件、可选附件、实施服务、包级折扣、包小计和总计分别处理。
3. 有效含税报价只计算采购范围内的必选设备、随包附件和必选服务;可选附件单独列出,不得混入最低有效报价。
4. 同一编码在不同文件中出现多个数量、型号、参数或金额时,不得直接覆盖,应保留全部原值并标记冲突来源。
5. 数量、单价、未税金额、税额和含税金额需要进行勾稽校验;无法勾稽时列入人工复核。
6. 供应商自报必选范围与采购方范围不一致时,分别保留两种口径,并说明对有效报价的影响。

【评审要求】
1. 技术参数、交付、质保、服务响应和实施范围必须以采购方要求为判断依据。
2. 明确不满足硬性条件的项目标记为“负偏离”;证据缺失或内容冲突的项目标记为“待确认”。
3. 不得仅按照最低价格推荐供应商。推荐理由必须同时考虑技术满足度、有效报价、交付、质保、实施完整性和风险。
4. 每个风险、偏离和异常必须标注供应商、设备编码、原始值、判断依据以及文件名、页码或工作表位置。
5. 所有推荐均为条件性初筛建议,应单独列出可能改变推荐顺序的人工确认事项。

【报告输出】
生成《供应商综合评估报告》,至少包含:
1. 解析文件清单及 TextIn xParse 解析结果说明。
2. 供应商综合评估表:供应商、有效含税报价、技术匹配、交付周期、质保期限、风险等级和初步建议。
3. 必选设备、随包附件和实施服务完整性对照。
4. 可选附件、包级折扣及报价口径差异。
5. 技术偏离和商务风险清单。
6. 数量、单价、税额、含税金额及跨页内容的勾稽异常。
7. 供应商推荐顺序、推荐理由和不建议首选的原因。
8. 必须由采购人员确认的事项,并附文件名、页码或工作表位置。

先完成全部文件解析和交叉核验,再输出结论。报告结论必须能够追溯到原始材料,不得输出没有证据位置的确定性判断。

实际执行时,6 份文件都生成了 Markdown 文本和表格结构数据,总量约 1.3MB。页码、工作表名、合并单元格、嵌套表格和父子层级仍然保留,WorkBuddy 后面才能按设备编码做跨文件归一。

TextIn xParse 为六份文件保留文本与表格结构数据
TextIn xParse 为六份文件保留文本与表格结构数据

以前收到供应商材料,通常要先展开合并单元格、补父级、拆 Word 内嵌表,再把 PDF 修订页抄回 Excel,做完这些才能开始比价。现在供应商发来不同格式的材料,可以先交给这个 Agent:TextIn xParse 保留文字、表格、层级和证据位置,WorkBuddy 再按采购规则整理成同一套比较口径。

简单 Excel 的对照里,TextIn xParse 的完整响应更快;换成多级表头 Excel、嵌套 Word 和扫描 PDF 后,它保留下来的结构让报价、参数、偏离和异常能够继续核对。最终得到的不是几段解析文字,而是一份能继续编辑、流转和归档的供应商综合评估 Word 报告

这份报告用于采购初筛和决策辅助。报价有效期、付款条款、原厂授权、缺失附件和技术偏离仍要由采购人员确认,最终审批也不会交给工具。TextIn xParse 先把最费时间的文档整理和证据定位做扎实,采购人员才能把精力放到真正需要判断的地方。

最后再次提醒一下,如何在Workbuddy中添加TextIn xParse

WorkBuddy 中添加 TextIn xParse 连接器
WorkBuddy 中添加 TextIn xParse 连接器

原创声明:本文系作者授权腾讯云开发者社区发表,未经许可,不得转载。

如有侵权,请联系 cloudcommunity@tencent.com 删除。

目录
  • 先看最后交付的结果
  • 先把连接器接起来
  • 先用普通 Excel 跑一次
  • 把四家供应商的原文件放到桌面上
  • 效果对比:有没有 xParse,差别在哪里
    • 不接 xParse,普通解析会漏掉什么
    • 接入 xParse 后,表格关系回来了
  • 最后,把这套流程做成可复用 Agent
问题归档专栏文章快讯文章归档关键词归档开发者手册归档开发者手册 Section 归档