**摘要:**把 20714 个岗位的国考职位表直接丢给 AI,它一次筛出 2913 个岗,还主动标出六级风险——先别急着夸:你没告诉它的条件,它一个都不查。18 个"限女性"的岗原样推给了男生表弟,要求双学位的商务部岗被荐成"刷到 425 即可报",换张表再问一遍,可报清单里照样混着 5 个白报岗。本文拆解这份官方文件里的四处"反 AI 设计",把"先解析、再问"的流程固化成一个可复用的选岗 Agent——完整 System Prompt 可以直接抄走。全部素材都是官方公开文件,零模拟数据,100% 可复现。

先看最终结果:
👉 国考选岗 Agent 推荐清单 · 2281 条可 
一、问题复现:AI 答得挺流畅,岗位就是不能用
我表弟明年毕业,计算机专业应届硕士,共青团员,英语六级 421 分,没有基层工作经历。眼看 10 月中旬 2027 国考公告就要发,他把官方专题页的《招考简章》压缩包发给我:哥,你不是搞 AI 的吗,帮我看看我能报哪些岗。
解压出来一个 9.9MB 的 2026国考职位表.xls(2026 国考是刚落幕的这一轮,那就先拿它练手,公告一出换文件就能用)。打开第一眼:
- 4 个工作表:中央党群机关(124 个岗位)、中央国家行政机关本级(334 个)、省级以下直属机构(19215 个)、参公事业单位(1041 个)
- 合计 20714 个岗位、27 列、招 38119 人
- 光"专业"一个列,就有 3951 种不同写法

我的第一反应跟大多数人一样:这还用筛?直接问 AI 呗。
打开 Workbuddy,把文件一传,问:“应届硕士、计算机专业、共青团员、英语六级 421,能报哪些岗位?”
它干得比我预想的好。几分钟后丢回来一份 Excel:2913 个岗位、计划招录 5483 人,19 列信息齐全,还主动加了一列"英语风险"高亮——表弟六级 421 没过 425 线,它把 382 个含六级要求的岗位全标了出来。我不放心,抽了 200 行回官方原表逐字段核对:岗位全部真实存在,学历、专业一字不差,人数分毫不差。
说实话,到这一步我差点想收工。

但我干这行的,还有个习惯:AI 查过的先别夸,先看它没查什么。表弟的提问里给了学历、专业、面貌、六级——它就只核这四样。那么,没被告知的条件呢? 回原表翻备注列,三个坑现形:
18 个"限女性"的岗,原样推给了表弟——但是他是个男生啊!!!比如国家统计局内蒙古调查总队"呼和浩特调查队业务科室四级主任科员(1)“,学历"仅限硕士研究生”,跟表弟条件严丝合缝,备注第一条就是"限女性报考"。这 18 个岗全在统计局调查总队系统,而且大多是硕士专属岗——学历越配,报得越亏。 
134 个岗的备注里埋着硬性证书要求——明明写明白了的硬性要求:“持有计算机全国计算机等级考试二级合格证书”“取得计算机技术与软件专业技术资格中级及以上证书或信息安全NISP二级”“取得英语专业四级或专业八级合格证书”……它一个没筛、一个没标。而且其中约 97 个恰好同时要求英语、被英语风险列"顺带照亮",剩下约 37 个纯证书岗在清单里完全裸奔。不是漏看——它的"风险"列只设计了"英语"一个维度,证书这个维度在它的筛选框架里压根不存在。 
2 个能报的岗,被它直接排掉了。其中备注的原文是"非应届毕业生应为具有2年以上工作经历的国有企事业单位在职人员"——这句话其实分两截,我们拆开来看:非应届的,得有 2 年国有企事业单位工作经历;应届生不受这条限制,所以能报。表弟正好是应届。但它的规则是"基层年限一栏不是’无限制’就排除",两个岗就这么没了——"应届生不受限"那层意思,它那条规则里没有。前两个坑是报了会被打回,这个坑是岗位直接从清单里少掉——所以少了什么,我们都不知道。 
算笔账:55 个岗(18 限女 + 37 纯证书)没任何提示就混进了候选清单,能报的岗反倒少了 2 个。而它交卷的时候,没有半点犹豫。
这时候我意识到一件事:它不是算力不行,也不是读不懂表——它只核对"你告诉过它的条件",没说的,当然它一个都不查。可人提问时只能报出自己记得的条件,这份文件真正藏硬条件的地方,恰恰是想不到要说的那一列。
我不死心。2 万行的主表也许是个极端案例,那就换官方同一专题页的《2026国考补充录用职位表.xlsx》——929 行、30 列、单 sheet,一张干干净净的小表——传上去,第一轮的问题原样再问一遍:
应届硕士、计算机专业、共青团员、英语六级 421,能报哪些岗位?
这轮答卷比第一轮还体面:漏斗每步都有数——927 岗 → 排除仅限本科 48、仅限博士 4,剩 875 → 政治面貌剩 844 → 基层年限剩 827 → 专业分了级(强相关 109/ 相关 6 / 需确认 24)→ 英语 425 不达标的 7 个单列。最终 139 个可报,产物是 33 列的 Excel,连"专业匹配说明"都填了。学历口径这次全对,"421 差 425 四分"也标出来了。

但我拿上一轮的抽查习惯又翻了备注列——老毛病一分没改:额尔古纳出入境边防检查站一级警长及以下(一)、阿拉善边境管理支队警务技术一级主管及以下,这 2 个岗的备注白纸黑字写着"通过全国统一考试,取得无人机、软件、计算机、通信等相关专业技术初级资格之一",还限"内蒙古户籍或生源"——没证书、没当地户籍,报了就是白报,照样标着"强相关"躺在可报清单里;集安出入境边防检查站那个岗要求"参加过校级及以上数据建模、程序设计、编程等竞赛并获得奖项",也混在里面。英语单列的那 7 个里,还有 2 个同样藏着竞赛、证书硬条件,一个没标。前前后后 5 个白报岗,风险列一句没提???
顺手又试了张更狠的:商务部那张 14 页、表头竖排的 PDF(第二节病因②的主角就是它)。传上去,问:
按上面的条件,把这张表里的 14 个岗位逐条筛一遍,哪些能报?

这里得说句公道话——它读出来了:司局、语种、英语分数线(哪些要六级 500、哪些只要 425)、哪四个岗限中共党员,我逐项回源核对全对,“0 个完全符合"的结论也成立,还附了一份字段工整的逐岗判定 Excel。但问题恰恰就在这份表里:岗 6 那行的"专业要求"格,原样抄着源表的"复合型专业(理工类专业+经济学类专业、理工类专业+人文学类专业)”——意思是要拿两个专业的学位:一理工、一经济或人文。表弟从本科到硕士全是计算机,这个岗连门都进不去。可同一行判定给出的卡点是"专业需确认",最终结论还写着"岗 3、岗 6……仅差英语 4 分"“把英语刷到 425 即可报岗 3、岗 6”。硬条件的原文就印在它自己输出的表格里,判定却没把它当硬条件——英语 425 那条引用得一字不差,"取得两个专业学位"那条(专业列、备注各写了一遍)就是没进决策。
两轮加一仗,一个模子:它只核对我们告诉过它的条件。表头错位、超大文件这类结构难题,它自己写代码绕过去了;可备注里一万个岗位各写各的作文,没想到要说的,它一条都不挖——而且答卷越漂亮,坑藏得越深。
下面讲清楚三件事:为什么直接问必翻车(第二节)、这套流程怎么搭(第三节,System Prompt 全文可抄)、同一个问题两种喂法差多少(第四节)。
二、原因分析:这份官方文件是怎么"反 AI"的
先说结论:国考职位表不是"难读",是系统性地反 AI。它为人类视力+耐心设计,每一处"人眼一看就懂"的排版,落在 AI 眼里都是一个坑。我数了四处。
2.1 病因清单:四处反 AI 设计
| ① | 表头不在第一行,顶部压一行合并说明文字 | 下文实拍 | 列名整体错位 |
| ② | PDF 版表头竖排文字 + 超宽表格跨页 | 下文实拍 | 文本层直接乱码,列和数据对不上 |
| ③ | 专业列口径混乱:按代码/按大类/排除式/本硕分段,3951 种写法 | 下文实拍 | "计算机类含不含我的专业"没法机械匹配 |
| ④ | 备注列自由文本藏硬条件 | 下文关键词统计 | 结构化筛选对自由文本投降 |
病因①:第一行不是表头。
四个 sheet 的第一行,都是一句合并居中的说明文字:
招考职位由招录机关编报,招录专业、学历等与职位资格条件相关的问题,由招录机关负责解释。
人类打开文件,视线自动跳过它看第二行的表头。但绝大多数解析工具默认第一行就是表头——这句说明会被拆成一堆"列名",真正的 27 个列名整体错位一格,后面所有的"第 X 列是学历"全对不上。(说句公道话:第一节的实测 Agent 靠写代码跳过了说明行,没踩这个坑——但那是它聪明,不是文件合理;RAG 管线里的默认解析器,可不会替你检查这一行是不是表头。)

病因②:PDF 版是重灾区。
职位表还有个 PDF 版(以商务部官网发布的为例,14 页)。表头是竖排文字,表格超宽,一页放不下、跨页续表。我用最常见的普通文本提取方式(pypdf 库)读第一页,提取结果是这样的:
用
人
司
局
机
构
性
质
职
位
名
称
…
竖排表头一个字一行,正文数据混在里面,列和数据完全对不上号。这就是"PDF 文本层"的真相:PDF 说到底是一张画着表格的图纸,不是表格本身——Excel 好歹是"结构化的乱",PDF 连结构都没有。图纸给人眼看没问题,给 AI 读就是灾难。

病因③:专业列,3951 种写法。
随手抽几种真实写法感受一下:
- 按大类:“理学类、工学类”
- 按学科代码:“哲学(0101)、政治学(0302)、马克思主义理论(0305)……等相关专业”
- 排除式:“理、工类专业(不含核、航天、火炸药相关理工类专业)”
- 本硕分段式:“本科:0807电子信息类、0808自动化类、0809计算机类;研究生:0810信息与通信工程、0811控制科学与工程、0812计算机科学与技术、0854电子信息”
同一个岗位招"计算机",可能写作"计算机类",可能写作"0812",可能写作一长串列举,还可能在最后缀一句"不含网络安全"。人眼能靠常识折算,AI 做字符串匹配必错——要么漏报(你的专业明明在里面),要么误报(排除项没看)。

病因④:备注列,98.5% 的岗位都藏条件。
主表 20714 个岗位,20399 个的备注列非空。这些条件不写在"学历""专业"这种规规矩矩的列里,全埋在自由文本里。我在全表扫了一遍关键词:
| 含"限男性" | 1071 |
| 含"限女性" | 350 |
| 含英语"六级"要求 | 2468 |
| 含"425"(四六级分数线) | 4547 |
| 含"应届"相关表述 | 5883 |
| 含服务年限要求 | 13890 |
随手贴一条真实备注,一条里叠了好几个条件:
限2026届高校毕业生报考;持有注册会计师证书(报考时须在备注栏注明是否取得该证书及证书编号);全国大学英语六级考试成绩达到425分及以上;限女性;基层一线岗位……
"学历、专业"是结构化列,筛起来容易;真正的杀器是备注列——它是一万个岗位各写各的作文,每篇作文里都可能埋着一票否决项。
2.2 人要筛对一个岗位,实际要过几道工序
把上面四处坑串起来,一个岗位要筛"对",实际处理链路是:
拿文件 → 理结构(表头在哪/列是什么)→ 统一口径(专业大类折算/学历9种口径)
→ 挖自由文本(备注里的隐藏条件)→ 逐岗核对 → 出清单
更麻烦的是:每一道工序的损耗,都会被下游成倍放大。表头错位,后面所有列全错;专业口径折算错,筛出来整个集合就是错的;备注漏看,最后清单里的岗位"报了也白报"。这就是为什么 AI"答得流畅"和"答得对"是两回事——错在上游,下游的语气再笃定也没用。
2.3 解法:在 AI 之前,先有人把文件理干净
所以我的判断是:筛岗的准确率上限,在你把文件交给 AI 之前就定了。
这就轮到本文的第二个工具出场:TextIn xParse,合合信息做的文档解析服务。一句话说清它的定位:
它不给你任何答案,只干一件事:把乱七八糟的文件,变成 AI 能直接用的干净数据。
任意版式的文档丢进去——Excel、PDF、Word、扫描件——出来的全是规整的结构化数据(Markdown + JSON),表格是表格、段落是段落、阅读顺序不乱,合并单元格和跨页表格都能正确还原,JSON 里还带每个元素的坐标,每条结论都能溯源到原文的具体位置。
作为AI数据层基础设施,它像水电煤——你平时不会注意到它,但没有它,下游什么都开不了火。AI 和 Agent 是灶台上的锅,xParse 是把水先引到家的那根管子。 
放进我们的场景,整条链路变成:
乱文件(职位表 xls / 商务部 PDF / 专业目录 xls)
│
▼
TextIn xParse ──► 干净数据(Markdown + JSON,带坐标,表头归位、表格还原、备注成段)
│
▼
Workbuddy Agent ──► 每条结论带出处的选岗清单
听起来很美好?下一节就把它搭出来——还是第一节的那些文件、还是那个问题,看每条坑这次是不是都有人接。
三、实践方案:把这套流程固化成你的选岗 Agent
两轮翻车,一个模子:直接问,永远只核对你告诉过它的条件。现在把"先解析、再问"的整套流程搭出来——从零开始,全部照抄可用。
3.1 第一步:接上 xParse 连接器(手把手,5 步)
前提:一个 TextIn 账号——免费额度就挂在这个账号上(PDF/图片每日免费 1000 页,本文够用;Excel 和 md 按量计费)。
账号可以现在去 textin.com 提前注册好;嫌麻烦也可以先跳过,到第 2 步的授权页上再注册,一样能往下走。然后:




两句提醒:① 授权码是敏感凭证,我的截图已打码,你的也别外传;② 接上连接器≠自动使用——第一节它就是自己写代码读的表;对话里明说"使用 TextIn xParse",文件才走 xParse。
3.2 第二步:准备素材(全部官方公开,零模拟数据)
| 《2026国考招考简章.zip》(解压即 2026国考职位表.xls,20714 岗) | 官方专题 bm.scs.gov.cn/kl2026 → 相关下载 → “招考简章” | 全量筛(3.4 实测整表过筛) |
| 《2026国考补充录用职位表.xlsx》(927 岗,30 列) | 同上 → “补充录用公务员职位表” | 本文演示主数据 |
| 《商务部2026国考职位表.pdf》(14 页竖排表头) | 商务部官网 → 人事信息 | 折磨测试/结构还原能力 |
| 《专业参考目录.xls》 | 深圳市政府官网附件(各地招考通用参考) | "大类↔具体专业"对照知识库 |
| 《普通高等学校本科专业目录2025年版.pdf》 | 教育部官网通知附件 | 专业口径权威依据 |
| 《2026国考报考指南.md》 | 官方专题/各地税务官网镜像网页(如上海税务),复制正文存成 md 即可 | 应届身份、基层经历界定规则 |
| 《2026国考报名登记表.docx》 | 官方专题 → 相关下载 | 3.7 彩蛋 |
三个小提示:① zip 解压出来文件名乱码的话,把下划线改成点就能解压;② 实测 20MB 的主表整表传给 xParse,解析本身能成功,但结果导出会超传输上限——大表要稳就按 sheet 或每 1500 行切块再传,或者像本文实测这样(见 3.4):解析这关过了之后,授权 Agent 直接读原始表取数;③ 免费额度只覆盖 PDF 和图片(每日 1000 页,本文两份 PDF 绰绰有余),Excel 和 md 文件走按量计费端点——20MB 主表那次解析就是付费的,别当成免费无限用。
3.3 第三步:喂文件,先验货
新建对话,上传素材,对话里写明"使用 TextIn xParse 解析以下文件"。Workbuddy 会把任务自动拆解成步骤清单:逐份解析 → 提取结构 → 按条件筛选 → 汇总输出,一步一步执行给你看。

解析产物直接验货,两组对比(这就是 xParse 的主场)。 先交代产物形态:Markdown 文件,表格以 HTML 表格语法保留,合并单元格的 rowspan/colspan 全部显式标注——对机器来说比管道符表格还好读,浏览器一渲染就是规规整整的表(下文对比截图即渲染效果)。

对比①:商务部竖排 PDF——第一节它绕过去的那张表,解析层直接还原。

对比②:专业参考目录——Excel 三层表头 + 纵向合并的"硬骨头"。

3.4 第四步:贴 System Prompt,问两道
第一道,就用第一节的原题:“应届硕士、计算机专业、共青团员、英语六级 421,能报哪些岗位?”
这轮一上来就出了个插曲:20MB 的主表整表传给 xParse,解析本身成功了,结果导出时反复失败——超传输上限。按 System Prompt 里"解析失败必须告知、不得假装"的规矩,Agent 停下来向我报告,没有硬编。我授权它改读原始表取数——还有个意外收获:解析产物不保留原始行号,原始表的真实 Excel 行号,引用起来反而更准。
最终答卷:主表加补充表 21641 个岗位全部过筛,漏斗每步有数——政治面貌淘汰 1054、学历淘汰 3112、专业淘汰 13558、备注硬条件淘汰 502、基层年限淘汰 1041——可报 2281、易误报 19267、待人工确认 93,三份清单装进一个 Excel 交卷。可报岗位每行带着"匹配依据"(工作表+行号+列原文),1862 条另附风险提示;19267 个不可报岗一个没扔,每个注明"最容易看走眼的条件"和备注原文;93 个待确认的还拆出了构成——限男性 71、限女性 6、专业口径拿不准 16(提问里没说性别,规矩是不猜:性别限制岗一律转待确认)。
第一节那 5 个白报岗,这次一个都没混进可报:长春边检站(二)被备注里的"四级 425"卡进易误报,阿拉善边境管理支队(三)被专业限制(限法学、公安学)卡进易误报,原因和原文都附在清单里;额尔古纳边检站(一)、阿拉善警务技术岗、集安边检站(二)这 3 个限男性的岗,转进待确认——备注里的证书、竞赛条件按"可后天取得"处理,只进风险提示、不一票否决。5 个岗,5 个都有了下落。

第二道,考专业口径:““电子信息类"含不含我的"计算机科学与技术”?给我依据。”
职位表里写的是大类,答案得去专业目录里查大类包不包含你的专业——这是跨文件对齐,直接问时只能凭常识猜。这次它给了结论:不含,两个是并列的大类,不是包含关系。依据三份,全部引自 xParse 解析出的文本:《本科专业目录(2025年版)》里,0807 电子信息类在解析文本第 1388-1455 行、0809 计算机类在第 1484-1543 行,“计算机科学与技术"躺在 0809 名下,两块平级;《专业参考目录》的对照关系是"本科 B0809 计算机类 ↔ 研究生 A0812”,而"本科 B0807 电子信息类"对应的是 A0809/A0810,那一栏里找不到 A0812;职位表里天津铁路公安处的岗,专业原文就写着"大学本科:0809计算机类、0807电子信息类"——招录机关自己也是并列着用的。第一道清单里那 16 个"专业口径拿不准"的待确认岗,照这个办法就能逐个核掉。

3.5 System Prompt 全文
【角色】
你是一名国考选岗助手,只做辅助筛选,不做报名决定。你的每一条结论都必须附带核对依据(引用具体的工作表名、行号、列名和原文),给不出依据的结论一律不输出。
【任务目标】
用户会提供国考职位表(Excel,如 2026国考补充录用职位表.xlsx)、专业参考目录.xls、普通高等学校本科专业目录2025年版.pdf、2026国考报考指南.md 等官方文件,以及个人条件(学历、专业、政治面貌、英语等级、性别、应届身份、基层工作经历等)。
你需要输出三份清单:可报岗位清单(附核对依据与风险提示)、不可报但容易误报的岗位清单(附原因)、待人工确认清单。
【工具使用要求】
每一份上传的文件,必须先逐份调用 TextIn xParse 解析,禁止跳过解析直接读取原文;
解析结果中的文件名、工作表名、页码、表头层级必须保留,作为后续引用依据;
任何一份文件解析失败:记录失败原因并明确告知用户,不得假装已解析,也不得跳过该文件继续作答。
【文档解析要求】
职位表每个 sheet 的第一行是合并说明文字、第二行才是表头,解析时跳过说明行;
学历列共有 9 种口径(仅限本科 / 大专及以上 / 大专或本科 / 本科及以上 / 本科或硕士研究生 / 硕士研究生及以上 / 仅限硕士研究生 / 仅限博士研究生 / 仅限大专),逐字原样保留,不得归并改写;
备注列是自由文本,必须逐条挖掘以下类型的隐藏条件并单独列出:应届限制、性别限制、英语等级及分数、最低服务年限、专业方向限定、工作经历要求、证书要求;
备注中识别不出的条件,标"未识别";原文没有写明的条件,标"未提供"。两者都不得自行补全或猜测。
【筛选归一化规则】
学历:严格按口径字面匹配。"仅限本科"不包含硕士研究生,"硕士研究生及以上"不包含本科。用户的学历必须落在岗位口径的区间内;
专业:按职位表写法分四类处理——
a. 具体专业名或专业代码:直接匹配;
b. 大类/学科名(如"计算机类""工学类"):先在专业参考目录中查出该大类包含的全部专业,再判断用户专业是否在其中;具体专业名称(含新旧专业名对照)以《普通高等学校本科专业目录2025年版.pdf》为权威依据,两份目录结论冲突时放入"待人工确认";
c. 排除式写法("XX类,不含YY"):先匹配大类,再逐项核对排除名单;
d. 本硕分段写法("本科:…;研究生:…"):只按用户报考学历对应的那一段判断;
任何一岗的专业判断存在不确定,一律放入"待人工确认"清单,不得直接判定可报或不可报;
政治面貌:只有"不限"和明确包含用户政治面貌的岗位可报;
身份界定:应届毕业生、基层工作经历等身份类条件,以《2026国考报考指南.md》原文为准;指南未写明而岗位又要求的,放入"待人工确认",不得自行推断;
备注中的每一条硬条件都必须逐条与用户条件核对,任何一条不满足,整个岗位判定为不可报,并在"易误报"清单中注明是哪一条。
【输出要求】
可报岗位清单,列:部门名称 / 用人司局 / 招考职位 / 职位代码 / 招考人数 / 学历(原文)/ 专业(原文)/ 匹配依据(引用列原文+工作表名+行号)/ 风险提示(备注中需人工注意的条件原文);
易误报清单:岗位 + 最容易看走眼的条件(如"仅限本科""限男性""六级425");
待人工确认清单:岗位 + 不确定的原因;
报告同时输出 Excel(三份清单各一个工作表)和 Markdown 两种格式;如已开通智能邮箱,发送至用户指定邮箱;
报告末尾附漏斗统计:初筛岗位数 → 每项条件各淘汰多少 → 最终可报数。
为什么这么写(每一段对应一个翻车点):
- 【角色】“给不出依据的一律不输出”——掐死直接问时那种"沉默放行":你没提的条件,它要么给出处、要么明说未识别,不许静默跳过;
- 【工具使用要求】“禁止跳过解析直接读原文”+“解析失败不得假装”——防止 Agent 偷懒走内置解析,也防止文件解析失败时它硬着头皮编(3.4 那次主表导出超限,就是这条规矩把它拦下来报告的);
- 【文档解析要求】①②③④ 分别对应病因①②③④:跳说明行、保留 9 种学历口径原样、逐条挖备注、"未识别/未提供"分开标——允许它说"我不知道",它才不会编;
- 【筛选归一化规则】专业的四类写法各给一条明确处理路径,判断不确定就进待确认——把"归一化"(各种写法折算成同一口径)这件最玄的事变成了机械规则;
- 【输出要求】“易误报"清单是整份 Prompt 的灵魂:它不光回答"你能报什么”,还回答"你最容易错报什么"——这正是第一节三个坑的解药。
3.6 这套东西适合谁
| 目标明确,只认某部门/某几个岗 | 不需要。Excel 手动筛十分钟的事 |
| 省考/小表,几百行以内 | 不需要,直接问 AI 就够用 |
| 国考全表海选、专业要对齐大类口径、职位表+目录+指南跨文件核对 | 必须,这就是本文场景 |
| 每年都要做一遍(考公家庭/机构) | 必须,搭一次年年用(见 3.7) |
10 秒自测法: 把职位表的备注列整列复制进记事本——如果"限应届;六级425;限男性;服务5年"糊成一片,你自己都分不清哪个条件属于哪个岗位,那就别指望直接问 AI 能替你分清:它最多帮你查你提过的词,不会替你把每一条条件归到每一个岗。这时候你就需要"解析成结构化数据+逐条挖掘"这道工序。
3.7 复用与彩蛋
年年复用: 2027 国考公告预计 10 月中旬发布。到时候去官方专题页下载新表,替换对话里的文件,System Prompt 一个字不用改。整套流程的寿命是"公务员招考制度",不是某一年。
进阶彩蛋: 官方《2026国考报名登记表.docx》(26 行 × 8 列,照片列还是跨行合并的)也可以交给 Agent——筛完岗位,让它按你的条件把登记表预填一版,你只核对不改格式。Word 里的合并表格同样能被结构化。

四、复盘:同一个问题,两种喂法
回到第一节的翻车。搭好 Agent 后,我把同一个问题原样重问——就是 3.4 跑的那轮:主表加补充表 21641 个岗位过筛,可报 2281、易误报 19267、待确认 93;每个推荐岗位后面都跟着出处——学历列原文、专业列原文、备注原文,引用到工作表+行号。我抽查了十几条引用回原表核对,行号和原文全对得上。直接问和先解析再问,差距摆在一起:
| 显性条件(学历/专业列) | 全对、零幻觉 | 全对,且口径原文保留 |
| 备注硬条件 | 5 个白报岗一个没标:3 个直接混进可报清单,2 个藏在英语单列里(主表那轮是 55 个) | 逐条挖出、附原文——5 个白报岗 2 个判不可报、3 个转待确认,一个没漏进可报;19267 个淘汰岗每个注明原因 |
| 商务部竖排 PDF | 内容读对了,双学位要求连读带抄两遍,照样没进判定 | 14 页 14 岗 21 列还原,岗 6 备注第 1 条原文可引用 |
| 专业大类口径 | 凭模型常识猜 | 对照两份目录折算,不确定进待确认 |
| 每条结论的依据 | 无 | 工作表+行+列原文 |
一句话:直接问输的不是模型,也不全是数据——是"备注里每条硬条件都挖出来逐条对"这道工序。System Prompt 定工序,xParse 把最难啃的文件变成带行号、能引用的干净底料——3.4 第二道那三份依据,全部出自它的解析文本。两个一起,这道工序才补得上。
按角色给建议:
| 明年考公的 | 拿 2026 表练手跑通流程,10 月公告一出,换文件即用 |
| 搭 Agent 玩的 | 把"文件先过 xParse"固化成你所有 Agent 的第一步——选岗只是场景,方法是通用的 |
| 做效率内容的 | 官方公开文件是最好的演示素材:真实、免费、读者可 100% 复现 |

诚实声明: 本文所有 AI 输出仅做初筛辅助。报名条件的最终权威是招录机关——职位表里就带着咨询电话 1/2/3 三列,拿不准的条件,打电话问,一分钟的事,别赌。Agent 说"可报"只是"依据原文没筛掉你",不是"招录机关承诺你能报"。
最后多说一句。职位表每年都换,Agent 框架千变万化,模型三个月一迭代,但"先把文件理干净"这一步永远需要——这就是"数据层基础设施"的意思:台前的东西一直在换,水电气一直得通。
五、总结(核心要点 5 条)
相关链接:
- TextIn xParse 产品页:https://www.textin.com/market/detail/xparse
- Workbuddy:https://www.workbuddy.link
- 2026 国考官方专题(素材下载):https://bm.scs.gov.cn/kl2026





