- 17 Aug, 2026 20 commits
-
-
Data Governance Dev authored
主题 16 — Oracle 反查 0 行 - 现象:Oracle 扫描有违规值但反查表格 0 行 - 根因:data_dict 的 column_name 是 Oracle 原样「大写」,但 _rows_as_dicts 把行 dict key 规范化成「小写」, row.get('TZRSFZH') 永远 None → 现场 validate 误判 NULL 跳过 - 修复:_fetch_bad_rows_one 加 row.get(cname.lower()) fallback 主题 17 — Oracle 表格其他列也空 - 现象:DA60_QY_MSXX 70 行违规展开后只有「违规」列,其他列全空 - 根因:Oracle _rows_as_dicts 把所有列名强制小写,data_dict 大写, 前端 row[colName](大写)查不到 → formatCell(undefined)='∅' 主题 16 只修了 cname 单列,没修其他列 - 用户反馈:「mysql 和 Oracle 难道不是用的同一套接口吗?」 三个 DB 走同一个 _rows_as_dicts,但驱动 case 行为不同: MySQL pymysql: 跟 schema 达梦 dmPython: 保留原样 Oracle oracledb: 总是 lowercase - 修复:新增 _normalize_row_keys(row, columns),装配 BadTable 时 用 columns 元数据做大小写权威,把 row 所有 key 改成一致 主题 18 — 0 违规的表不显示 - 现象:PM_SYSTEMUSER.SFZH 0 违规但表格仍渲染 + 空表 + 「该表无违规行」 - 根因:装配点不管有没有违规都创建 BadTable - 修复:流式推送处 + 最终汇总处都加 if not fixed_rows: continue 详细 work-log 见 work-logs/2026-08-17.md 主题 16/17/18 -
Data Governance Dev authored
问题: - IdCardTable 数据列 el-table-column 上挂了两个动态 class-name 绑定: :class-name="isColSelected(c) ? '' : 'idcard-table__col-unselected'" :header-class-name="isColSelected(c) ? '' : 'idcard-table__col-unselected'" - 任意一列 checkbox 切换都让 columnSelection 变化 → 每列重算 className → el-table 对全表 <td> 重写 class 属性 - 800+ 行 × 19 列 ≈ 15000+ 次 DOM patch,操作密集导致卡顿 修复: - 删掉 el-table-column 上的 :class-name / :header-class-name 绑定 - 删掉对应的 .idcard-table__col-unselected 样式 - 保留 checkbox 勾选状态、selectedColumns / exportedDataColumns 响应式数据 以及工具栏「已勾选 N 列」提示;导出仍按 selectedDataColumns 过滤 效果:勾选/取消 checkbox 不再让整列变灰,表格交互流畅度恢复正常。 -
Data Governance Dev authored
UI/UX 调整: - 左侧菜单 + 路由 meta + 面板标题统一改为「身份证合规验证」 - 左侧菜单字号加大(14→17px)、行高加高(52px) IdCardTool.vue 顶部新增独立 textarea 面板: - 与下方 5 张规则卡片完全分离(互不联动) - 默认填充 5 句规则 summary(每行一条),用户可自由编辑 - 自有 localStorage key(idcard:rule-text-v1)持久化 - 提供「清空」按钮 5 张规则卡片样式还原 a5990444(图标 + 标题 +
❓ ,hover tooltip 看详细): - 每条规则拆成 summary(一句话)+ detail(详细列表) - tooltip 展示 detail 多条 li(恢复 a5990444 详细版本) - 顶部 textarea 默认值取 summary 涉及踩坑: - 后端 FastAPI 直接托管 web2/dist/(web2/backend/app.py:93), 源码改动后浏览器不更新,必须 npm run build 重新生成 dist/ 才能让 192.168.101.126:8766 服务拿到新版本 -
Data Governance Dev authored
- 问题:MySQL DISTINCT/IN 按 collation 比较(utf8mb4_unicode_ci 不区分 大小写),但 Python dict 区分大小写。如果数据库真实存的是大写 X 但 distinct 返回小写 x,bad_reasons 里只有小写的 key,反查拿到大写 X 的行就查不到 key,错误地标 '不合规'。 - 例子:'42112319760324521X'(合规)+ '42112319760324521x'(CHARSET 违规)共存时,大写 X 那行被错误标 '不合规',且原因不明确。 - 修复:去掉 bad_reasons 缓存查询,对每行现场 validate —— 合规行直接 丢弃,违规行给出准确原因。出现丢弃时打 INFO 日志方便排查。
-
Data Governance Dev authored
需求调整:业务上认为「字段没填」≠「填了不合规的值」。 之前 NULL/空字符串会被打成 EMPTY violation 计入 bad_rows,新逻辑直接合规。 改动: - idcard_validator.py - validate():value is None 或 strip() 后空字符串 → ok=True, violations=[] - VIOLATION_LABELS 移除 EMPTY 条目 - docstring 顶部去掉「1. EMPTY」校验项,更新设计说明 - IdCardTool.vue - ruleLabels 移除 EMPTY → '空值' 验证(python 直接调 validate): None / '' / ' ' / '\t\n ' → ok=True, violations=[] ✓ '110101199003078888' → ok=False, ['CHECK_DIGIT'] ✓ '12345' → ok=False, ['LENGTH'] ✓ 涉及到的语义变化: - 统计上:matched_columns 不变(仍然命中的字段),invalid_count 会下降 - 前端 UI:「空值」chip 不会再出现
-
Data Governance Dev authored
列选择(为「导出选列」预埋): - 每列表头前加 el-checkbox,可单独控制该列是否参与导出 - 第 0 列固定全选 checkbox(支持半选 indeterminate) - 「违规」列也加 checkbox,内部用 __violation__ 作 key - 默认全部勾选;新出现的列自动勾上 - 未勾选的列**不隐藏**(仍显示),仅加 idcard-table__col-unselected class 灰显 - 暴露 selectedColumns / selectedDataColumns / selectAll / deselectAll 给父组件 - emit columns-change 事件 导出 Excel: - 表格上方加工具栏:[
📥 导出当前表 (N 行)] 已勾选 X/Y 列 - 文件格式: - 第 1 行:字段注释(column_comment) - 第 2 行:字段名(column_name,加粗 + 浅灰背景 + 居中) - 第 3 行起:数据 - 含「违规」列时,第1行首列 = 「违规原因」,第2行首列 = _id_card_violation - 黑色细边框(4 边 thin + #000000) - 冻结前 2 行(Excel 滚动时表头固定) - 超过 5000 行弹确认框 - sheet 名 sanitize(去掉 :\/?*[],最长 31 字符) - 文件名 sanitize(去掉 <>:"/\|?*,最长 100 字符) IdCardTool.vue:给 <IdCardTable> 加 :table-name="t.table_name" -
Data Governance Dev authored
- 卸载 xlsx(社区版不支持 cell-level s 属性) - 装 xlsx-js-style(API 完全兼容 + 支持 s.border / s.font / s.fill) - 用于 IdCardTable 导出 Excel 时给有数据区域加黑色细边框 - bundle size: xlsx 290KB → xlsx-js-style 870KB(gzip 后约 230KB)
-
Data Governance Dev authored
- DbConnectionPopover.vue - 触发器显示:「display · host:port」 - 弹框按 db_type 分组(MySQL / 达梦 / Oracle),每组下显示该 type 的所有连接 - 每行:连接名 + host:port + 测试/切换按钮 - 切换按钮独立判断 isCurrent(db_type, id),不再按 db_type 切换 - 弹框宽度 280 → 320(容纳 host:port 信息) - IdCardTool.vue - state.currentType 引用全部替换为 currentConnection?.host - db_type 从 conn.db_type 取(store 已注入),不再用 state.currentType
-
Data Governance Dev authored
- dbPresets.js:DB_PRESETS 改为列表结构(每 db_type 是 Connection[]) - useDbConnection.js - state.currentType: string → state.currentConnection: {db_type, id} - presets[db_type] 从单 dict 改为 Connection[] - 新增 currentType computed(便捷暴露 db_type) - 新增 setCurrentConnection(db_type, id) 替代 setDbType(type) - localStorage 新 key web2.dbConnection.current,序列化用 "db_type::id" - API 拉回后校准:当前连接丢失则 fallback 到第一个连接 -
Data Governance Dev authored
- 路径:web/configs/db_defaults.yaml → web2/configs/db_defaults.yaml (web2 与 web1 配置完全分离,2026-08-17 起) - 新增 _normalize_defaults(): - 新格式 {db_type: [conn, ...]} → 直接归一化(自动注入 id + db_type) - 旧格式 {db_type: {conn}} → 包成单元素 list(向后兼容) - 返回结构:{mysql: [{...}, ...], dameng: [...], oracle: [...]} 每个连接有 id + db_type(自动注入,避免前端漏字段 → FastAPI 422) - _mask_password 加 id 字段打印,日志输出加「总连接数 + 各 type 数」统计 -
Data Governance Dev authored
- web2 现在用独立的 db_defaults.yaml(列表格式,多连接) - 与 web1 的 web/configs/db_defaults.yaml 同样不进版本 - 含真实凭据(Cd@…/HGwxzj2026/GJJ80_Hg41RG)
-
Data Governance Dev authored
- SKILL.md - 项目级 skill(.claude/skills/kill-port/) - 默认杀 8765 (web) / 8766 (web2) / 5173 / 5174 (Vite dev) - 可传自定义端口 - 退出码 0/1/2 分别表示成功/端口空闲/杀失败 - scripts/kill-port.sh(Git Bash / Linux / macOS) - 自动检测平台:netstat.exe+taskkill.exe (Windows) / lsof+kill -9 (POSIX) - 多端口串行处理,独立退出码 - 杀完二次确认端口已释放 - scripts/kill-port.bat(Windows cmd 原生版) - 同等功能,:kill_one 子函数处理单端口
-
Data Governance Dev authored
- 弃用 SSE(EventSource) - 原方案 push 大 payload + Vue 响应式触发 1000+ 行 el-table 重渲,主线程卡 2s+ 导致页面「无响应」 - 改为 setInterval(1000ms) 轮询 + 立即首次触发 - 删除大进度卡片(3 指标 + el-progress) - 改为单行扫描提示:Loading 图标 + 「已发现 X 张问题表 / Y 行违规(Zs)」 - 结果区改为 el-collapse 折叠面板(每张表一个 collapse-item) - 新增 violationsByTable + liveBadRowCount 两个 ref(模板读这两个,不直接读 scanResult) - polling 累加 + done 兜底: - running 阶段 partial 来的表 push 到 violationsByTable(dedupe by renderedTableNames Set) - done 分支兜底:若 violationsByTable 为空,从 data.response.violations_by_table 同步灌入 (解决扫描太快<1s 时 running partial 没机会被观察到的问题) - 错误处理: - 404 = scan_id 过期(10 分钟 TTL),友好提示 - 网络瞬断不停轮询,下次自动恢复 -
Data Governance Dev authored
- 第 1 列固定「违规」摘要(width=200, min-width=160) - el-tooltip 展示详细原因(前 N 字符截断 + 悬停看完整) - 违规标签: red 圆角徽章 + 警示图标 - 数据列:身份证列加宽到 220px + 蓝字 + User 图标 - 其余列 min-width=120,列可拖拽(el-table-column 默认 resizable) - 表头 tooltip:字段名 / 字段注释 / 数据类型 三行 - 单元格:身份证列若值不合规显示红字(粗略校验,真实校验在后端) - 防爆:rows > 5000 时显示「仅展示前 5000 行」提示 - 内部字段(_ 开头)自动从 dataColumns 过滤掉
-
Data Governance Dev authored
后端: - idcard_validator.py - 新增 EMPTY 校验项(值空/None 视为不合规) - 返回结构增加 reasons: dict[rule_id, str],每条违规带具体原因文本 - 原因文本含「现场值」+「期望值」,方便前端直接展示 - routes/idcard_scan.py - BadRow 增加 violation 字段,扫描时把 reasons 串成单行文本塞进每行 - BadTable.rows_meta 把字段注释 + 数据类型带出来给前端表头 tooltip - ProgressTracker 加 _partial_tables + partial_snapshot() - 新增 GET /api/id-card/scan/{scan_id}/partial 端点(轮询用) - 旧 /stream SSE 端点保留但前端不再调用 -
Data Governance Dev authored
配合后端三端点改造前端: - POST 立即拿 scan_id → 不阻塞 UI - setInterval 800ms 轮询 /progress 更新 el-progress - status=done → 拉 /result → 渲染命中列清单 + 折叠问题表 UI 改造: - 新增「扫描进度」卡片:旋转 Loading 图标 + el-progress 百分比 + done/total 计数 + 耗时 + 当前列名 - 「重置」按钮同时停轮询、清进度状态 onQuery 拆三个函数: - onQuery() 启动 + 立即首次轮询 - pollProgress() 拉进度;status=done/error 自动收尾 - fetchResult() 拉最终结果 踩坑(production build 不会报 import 缺失): 之前改 IdCardTool 加 computed() 时漏了 import 'computed', dev 模式 Vite 红屏能看出来,production build 只打包不校验, 运行时 ReferenceError 只出现在浏览器 console,server log 完全没痕迹。 这次提交补回 import。 踩坑见 work-logs/2026-08-17.md 第七章。
-
Data Governance Dev authored
需求链路(按用户描述): 1. 按当前数据库连接抽数据字典(复用 web.core.data_dict) 2. 按「字段名 / 字段注释」关键字过滤命中列 3. 每个命中列 SELECT DISTINCT → Python 校验(GB 11643-1999) 4. 按违规值反查完整行(SELECT * WHERE col IN (...)) 5. 前端按表折叠渲染 架构亮点 —— 三端点异步: POST /api/id-card/scan → 立即 202 {scan_id}(不阻塞) GET /api/id-card/scan/{id}/progress → {done, total, current_column, status} GET /api/id-card/scan/{id}/result → 完整 IdCardScanResponse / 202 / 500 进度共享一个 in-memory ProgressTracker(thread-safe,10min TTL) 性能: ThreadPoolExecutor(max_workers=5) 并发跑每列 每个 worker 自己开 DBConnection(oracledb/pymysql/dmPython 不能跨线程共享) 实测 Oracle 84 列从单线程 221s → 多线程 115s(1.9x 加速) 方言适配(按 web2 库三态): MySQL → LIMIT %s,%s 占位符 达梦 → LIMIT ?,? 占位符 Oracle → 子查询 ROWNUM <= N,:1 :2 :3 numbered bind(11g 无 LIMIT;? 占位符会 ORA-01036) 文件: - web2/backend/idcard_validator.py 新增 GB 11643-1999 §6 加权和 + mod 11 映射 + 15 位老号升级 18 位 违规规则:EMPTY / LENGTH / CHARSET / CHECK_DIGIT / ADDRESS_PREFIX / BIRTH_DATE / ORDER_CODE - web2/backend/routes/idcard_scan.py 新增 异步三端点 + ProgressTracker + ThreadPoolExecutor 5 worker - web2/src/config/idCardKeywords.js 新增 默认关键字常量(前端离线兜底,与 web/configs/standards_match.yaml 的 IND-001-a 保持一致) DEFAULT_NAME_KEYWORDS = [id_card, id_card_no, id_number, identity_card] DEFAULT_COMMENT_KEYWORDS = [身份证号] 踩坑见 work-logs/2026-08-17.md 第三、五、六章。 -
Data Governance Dev authored
背景(按踩坑时间线): 1. start.py 用 print("✓ 关键依赖齐全"),Windows 默认 GBK console 抛 UnicodeEncodeError, 整个启动流程在 09:45 死在第一行 2. app.py main() 函数引用 LOG_DIR 但没 import,跑 main() 直接 NameError; 之前走 uvicorn 启动不跑 main() 所以没暴露 3. 浏览器访问 http://localhost:8766/#/id-card 时页面空白 —— FastAPI 对 SPA 路由(hash 路由 path 是 /,history 路由会触发 404)没有兜底,Vue Router 没机会接管 改动: - start.py:入口处 sys.stdout.reconfigure(encoding='utf-8', errors='replace'); ✓ → [OK],✗ → [FAIL](Windows GBK 永远安全) - app.py:同上加 stdout reconfigure;从 _logging 多 import LOG_DIR; 加 @app.exception_handler(404) 做 SPA fallback: · /api/* 404 → JSON(前端 fetch 期待 JSON) · 其他路径 404 → dist/index.html(让 Vue Router 接管) 顺手: - CLAUDE.md 加规则:「永远不要使用数据操作语句,本工具只做查询!」 验证: - start.py 启动不再因为 ✓ 崩 - GET /id-card 现在返回 200 + index.html(之前 404) - GET /api/nonexistent 仍返回 404 JSON 踩坑见 work-logs/2026-08-17.md 第五、七章。 -
Data Governance Dev authored
清理内容: - 移除项目目标 / 字段对象 / 大致流程等已过时的工作流描述 - 移除 LLM 依赖矩阵(已分散到 web/README 等具体文件) - 移除「下一阶段」段落 - 新增 web2 与 web 的关系说明(web/ 是参考实现,web2/ 是新开发) - 保留 4 条总体要求(记录工作 / 不自动提交 / 写清内容 / 记踩坑)
-
Data Governance Dev authored
前端 (Vue 3.5 + Element Plus 2.9 + Vite 6, 端口 5174): - 脚手架: package.json / vite.config.js / index.html / main.js / App.vue - 路由 + 布局: router/index.js + layouts/MainLayout.vue + views/IdCardTool.vue - 状态: stores/useDbConnection.js (响应式单例 + localStorage 持久化) - UI: components/DbConnectionPopover.vue (数据库名 + 真实 logo + 测试/切换) - 配置: config/dbPresets.js (后端不通兜底) + config/dbBranding.js (logo/icon/颜色) 后端 (FastAPI, 端口 8766): - 入口: app.py + _logging.py (idempotent logger + RotatingFileHandler) - API: routes/db.py (GET /api/db-defaults 读 web/configs/db_defaults.yaml, POST /api/connect/test 复用 web.core.db_adapter.test_connection) - 启动: start.py (依赖检查 + uvicorn) / backend/start.bat 一键启动: web2/start.bat / web2/start.sh 同时拉起前后端两个窗口 数据流: - 前端启动 → 异步 GET /api/db-defaults → 覆盖 presets (4s 超时 fallback) - 点击测试 → POST /api/connect/test → 后端复用 web.core.db_adapter 安全策略: - dbPresets.js 中 password 字段留空(真实密码不入库) - 运行时由 GET /api/db-defaults 注入;后端不通时测试连接因密码空失败(预期) 配套改动: - .gitignore: 忽略 web2/logs/ (start 脚本的 console 输出目录)
-
- 14 Aug, 2026 2 commits
-
-
Data Governance Dev authored
后端: - step6_length_check.py: LENGTH_RULES 扁平列表 → 7 个 _BUILTIN_CATEGORIES (len_id_card / len_uscc / len_mobile / len_xzqh / len_postal / len_email / len_bank_card) 每个分类独立 rules + UI 元数据 + expected_length + standard - orchestrator.py: 单 length_check step → 7 个 len_* 独立 step (工厂函数 _run_length_check_category(cat_id));旧的 length_check 保留为 hidden - match_config.py: 新增 get_length_categories_rules(cat_id);旧 get_length_rules() 保留为兜底 - standards_match.yaml: step6_length.rules → step6_length.categories.<cat_id>.rules 每分类 1 个 name_pattern + 1 个 comment_keyword(区划留 2 个) - routes.py /api/analysis-tree: 加递归 3 层嵌套(group → subgroup → leaf) 新增 is_subgroup: True 显式标记(避免靠 step_id 缺失推断) /api/match-config: 给每个 len_* 单独返回 names/comments 默认值 前端: - analysis_tree.json: 「字段长度检查」从 leaf 改为 subgroup (key=length_check_group, 含 7 个 len_* 子 step) - index.html: flatCheckRows + flatResultRows 支持 3 层(_level 0/1/2) toggleGroupCheck / setAllChecks / setAllGroupsExpanded 改为递归处理子组叶子 flatResultRows fallback 分支抽出 _push_leaf_row(item, level) 助手 - style.css: 加 .tree-row--subgroup / .subgroup-title / .subgroup-count / .subgroup-description Bug fix: - step_id vs tab_key 混用导致 displayedTabs 过滤掉 7 个 length tab section_key='length_len_id_card' / tab_key='length_len_id_card' / step_id='len_id_card' 三者分离 _wrap() 加 step_id 参数(默认沿用 tab_key,向后兼容旧 length_check) WORKLOG 记录所有改动 + 5 个踩坑(subgroup 识别 / YAML 关键词精简 / fallback 分支复用 / CSS .tree-row--subgroup / LengthRule.__dict__ 转 dict 抛错 / step_id 与 tab_key 混用) -
Data Governance Dev authored
合并两轮迭代的修改: 1) 违规原因细化(来自「细化所有目前显示的分析对象的错误信息」) - 21 个 IND validator + step4/5/6 的 reason 加上: · 标准来源编号(GB/T 2260 / GB 11643-1999 / 工信部 / GB 32100-2015 等) · 常见错因 ①②③(末位错填 / 出生日期段 / 地址码舍 0 等) · 建议核对原始证件 / 用脚本批量重算 - reason 字符串内含 \n 换行符(前后端一起生效) 2) 异常值字符位高亮(用户截图反馈「异常值要指出哪里错了」) - standards/base.py:ValidationResult 新增 bad_positions 字段 - 11 个 validator populate bad_positions: · IND-001/002/003/004/005/006 按字段类型填具体错位 · IND-016 银行卡 Luhn 错:暴力枚举找出「单字符修正」位 - web/core/step_impl/step7_standards.py:_build_value_highlighted · 区间合并(重叠/相邻)+ HTML escape → <mark class='bad-pos'>... - web/static/index.html: · .bad-pos CSS(淡红 + 红字 + 下划线 + cursor:help) · kind='code' 渲染分支 v-html='row.value_highlighted' 3) tooltip 多行修复(用户截图反馈「[a] [b] [c] 三个子检查挤在一行」) - 上一轮 .el-popper { white-space: pre-line !important } 看着对实际不生效 · Element Plus 2.x show-overflow-tooltip 内部 normalize 文本,外层 CSS 救不回来 - 本轮改用自渲染路线:放弃 show-overflow-tooltip,用 <el-tooltip> + #content 槽 · escapeTooltipHtml():HTML escape + \n → <br> · cell 内 text-overflow: ellipsis 保持单行布局 · 没 \n 的列无感升级 4) IND-003 / IND-004 合并步骤 TypeError 修复(用户截图反馈「有报错」) - 报错:TypeError: 'NoneType' object is not iterable - 根因:_merge_violations_by_tuple 里的死循环 for p in (r.get('value_highlighted') and []) · 当 value_highlighted 为 None/空串时短路返回 None, for p in None 抛错 · IND-003-b / IND-004-b 不填 bad_positions 时必触发 - 修复:直接删这段死代码(loop 里只有 pass,真正 fallback 在下面) 5) 其他 - docs/WORKLOG.md:四段工作记录(细化 / 高亮 / tooltip / 合并 bug) - scripts/reformat_reasons.py:AST-based 批量加 \n 工具,留作下轮兜底 未提交产物(生成报告 + tmp 脚本,不入库): - data_dictionary/standard_fields_violations_report.md - scripts/_tmp_build_violations_md.py 踩坑见 WORKLOG: - .el-tooltip__popper vs .el-popper(Element Plus 2.14.3 选择器) - and [] 短路求值返回 None(应为 or [] 或干脆删除) - show-overflow-tooltip 不可控,normalize 文本外层 CSS 救不回来
-
- 13 Aug, 2026 18 commits
-
-
Data Governance Dev authored
## db_defaults 三套化 用户反馈:「@db_defaults.yaml 现在这个文件里面由三套数据库配置, 现在页面要改成切换数据库类型同时也要切换默认IP,端口,账户密码和数据库」 ### 改动 - web/configs/db_defaults.yaml —— 旧单 dict → 新三键 dict (mysql / dameng / oracle 各一套,含 port 字段;文件已在 .gitignore 安全) - web/api/routes.py /api/db-defaults —— 返回三套 JSON; 兼容旧格式单 dict(用 _flat 包裹,前端识别后只填 mysql) - web/static/index.html —— 加 dbDefaults ref + DB_FALLBACK_PRESETS 兜底 + _applyPreset(t);onDbTypeChange 之前只切 port(保留用户自定义), 现在无条件套用预设全部 6 个字段(host/port/user/password/database/oracle_client_dir); loadDbDefaults 先缓存三套再按当前 db_type 套用 ## scripts/kill_web.{sh,bat} 杀掉 web 服务(默认端口 8765,可自定义): - kill_web.sh —— Git Bash + Linux/macOS 通用(netstat.exe / lsof 自动分支) - kill_web.bat —— Windows 原生 cmd 兼容 退出码: 0 杀掉占用进程成功 / 端口空闲 1 端口已空闲(无需处理) 2 杀进程失败 ## 验证 - curl /api/db-defaults 返回三套预设(端口 3306/5236/1521)✓ - kill_web.sh 空闲端口返 1 / 占用端口返 0(实测杀 18999 PID 23160)✓ - 静态资源 200 ✓ - JS 结构平衡 ✓ ## 踩坑 - API 旧格式兼容:YAML 老结构(单 dict 平铺)→ 检测 value 不是 dict 时用 _flat 包裹 - oracle_client_dir 仅 Oracle 有效,三套配置统一保留 key 占位 - password 空串语义:'password' in preset 判定(保持与之前一致) -
Data Governance Dev authored
用户反馈:partial/full 选项不再需要,所有检查(包括用户自定义规则) 都跑全量扫描。 改动: - 删除每条 IND leaf 行的 <el-radio-group class="sample-scope"> - 删除自定义规则卡片 header 的 <el-radio-group> - 删除 sampleScope ref / SAMPLE_PARTIAL_LIMIT / buildSampleLimitsForSubmit() - 删除 watch(analysisTree.groups) 里初始化 sampleScope 的循环 - startJob() payload 不再发 sample_limits 字段 - 删除 setup return 中的 sampleScope 相关导出 - 删除 .sample-scope / .sample-scope--leaf / .custom-rule-sample CSS - .tree-row--group .group-description max-width 从 280px 放宽到 560px (radio 让位消失后,description 可以更长) 后端零改动:sample_limit 参数链(models → job_manager → orchestrator → step7/step9)保留。前端不发 sample_limits → 后端默认 None = 全量扫描。 附带 UI 改进:进度区显示「失败 N 步(...)」行 + 进度条部分失败变 warning + 状态 tag 显示「completed (N 失败)」,避免静默失败误导用户。 (对应 step6 length_check TypeError 的 bug 修复,wrapper 签名 修改在 3dfd038c commit 已包含)
-
Data Governance Dev authored
本次会话累计改动(5 个文件): standards_match.yaml — 表注释匹配关键词 - IND-001-a/b/c/d (身份证) : comment_keywords 默认 [身份证, 证件号码] - IND-002-a/b/c (统一社会信用代码) : comment_keywords 默认 [信用代码] - IND-004-a/b (行政区划) : comment_keywords 默认 [行政区划] - IND-013-a (UI 显示 IND-017 单位类型) : 单位类别 → 单位性质 - IND-013-c (UI 显示 IND-019 行业代码) : 关键词精简到 3 个 (去掉 行业分类 / 国民经济行业) - IND-016-b → IND-016 : YAML key 改名 standards/ind_016b_bank_account_format.py — standard_id 同步 - standard_id 'IND-016-b' → 'IND-016' - docstring 同步更新 web/core/orchestrator.py — 描述字典 key 同步 - 'IND-016-b' → 'IND-016' web/configs/analysis_tree.json — UI step_id 同步 - 'std_ind_016_b' → 'std_ind_016' docs/WORKLOG.md — 记录改动 + 踩坑 - 单位性质重复问题 - IND-016 改名后 smoke 验证结果 - 行业单字被移除风险 注:standards_match.yaml / orchestrator.py 里还有其他未提交的 keyword 精简 (如 IND-003-a / IND-005-a / IND-006-a / IND-013-b / IND-101 / IND-201 / IND-202 / IND-401 / IND-402),看着是之前会话留下没提交的,本 commit 一并带走。 -
Data Governance Dev authored
需求:分析配置卡折叠时不必再点开它启动分析 → 自定义规则卡也加一个同样的按钮。 实现(web/static/index.html 卡 2.5): - 复用 startJob(),disabled/loading 逻辑与配置卡完全一致 - 按钮放在 <div v-show="!customConfigCollapsed"> 外面 → 卡片折叠时按钮也可见 - 同时附「取消任务」按钮(运行中显示) CSS(web/static/style.css): - 新增 .card-footer-action(margin-top: 18px, flex row, gap 8px) 视觉对齐配置卡里 <el-form-item> 的默认间距
-
Data Governance Dev authored
包含两段工作: 1. 2026-08-13 数据字典浏览器动态分页 + 后端缓存复用 - 后端 3 个分页端点 - 前端状态机重写(删 tableSummary/dataDict 全量 ref) - selectAllTables/Invert 改调 all-table-names - CSS 隐藏两边表格的全选 checkbox 2. 2026-08-13 数据字典浏览器滚动到底不增量刷新(bug fix) - 现象:滚到底不拉第二页 - 根因:EP 2.14.3 + height 时内部 <el-scrollbar> 包裹 body, scroll 不冒泡到 el-table 根 - 修复:直接在 .el-scrollbar__wrap 上挂原生 scroll 监听 -
Data Governance Dev authored
状态机重构: - 删 tableSummary / dataDict 全量 ref + 4 个前端过滤 computed - 新增 tableList/fieldList + page/hasMore/total/loading 共 10 个 ref - 新增 fetchTablesPage/fetchFieldsPage(防 stale 响应 + nextTick 后重挂 scroll) - 新增 onTablesScroll/onFieldsScroll:EP 2.14.3 + height 时 scroll 不冒泡到 el-table 根, 改在 .el-scrollbar__wrap 上挂原生 addEventListener('scroll', { passive: true }) - 新增 rebindDictScroll:每次 fetch + nextTick 后重挂兜底(el-table 重建 wrap 时失效) - 筛选 commit 时从后端重读第 1 页(applyTableSearch/applyFieldSearch) - watch(form.tables) 触发 fetchFieldsPage(1, true)(勾选表变化自动更新字段表) 跨页勾选同步: - onTableSelectionChange 改为 set 合并(visible 名 + 新选中 → add;visible - 未选中 → delete; 不在 visible 的保留)—— 旧实现会丢跨页勾选 - 新增 restoreTableSelection:数据刷新后把 el-table 可见勾选与 form.tables 对齐 (reserve-selection 在 :data 整体替换时失效,必须手动同步) 按钮重写: - 全选 / 反选:调 /api/dict/all-table-names 拿全量匹配名字 → 设 form.tables → fetchTablesPage(1, true) 把所有匹配表拉回首屏 - 清空:form.tables = [] + clearSelection() CSS:web/static/style.css - .dict-tables-table thead .el-checkbox, .dict-fields-table thead .el-checkbox { visibility: hidden; pointer-events: none; } (display:none 会算错表头高度) addCustomRule:去除 tableSummary 兜底(后端 /api/dict/fields 每行附 table_comment) 踩坑: - EP 2.14.3 + height → <el-scrollbar> 包裹 body → @scroll 不触发,必须原生监听 - selection-change 只返 visible 选中行,直接赋值丢跨页勾选 → set 合并 - reserve-selection 在 :data 整体替换时失效 → 自写 restoreTableSelection -
Data Governance Dev authored
DataDictCache 之前只在 connect/test 写入;这次新增 3 个 GET 端点让前端按需切片: - GET /api/dict/tables?db_type=&host=&port=&user=&database=&page=&page_size=&q= → 分页返回 table_summary,每项附加 field_count(前端不再算) - GET /api/dict/fields?...&tables=t1,t2&page=&page_size=&q= → 分页返回 data_dictionary(按 tables 参数过滤),每项附加 table_comment - GET /api/dict/all-table-names?...&q= → 仅返名字列表,供前端「全选 / 反选」按钮使用(不分页) 实现要点: - 全部走 DataDictCache.get_instance().get(cfg),命中即 list[a:b] 切片(微秒级) - cache miss 时现场抽一次(缺 password 抛 warning 让前端提示重连) - 多连接并存按 5 元组 (db_type, host, port, database, user) 区分 key - 排序:tables 按 table_name 字典序;fields 按 (table_name, ordinal_position) 与旧前端 filteredFields 排序保持一致 踩坑: - port=3306 默认参数必须放最末位(Python SyntaxError) - list_dict_fields 重复定义 host 别名导致 FastAPI 参数解析歧义 → 简化为单一 host 参数 - list_columns SQL 不带 table_comment,/api/dict/fields 响应里要手动从 table_summary 关联
-
Data Governance Dev authored
用户反馈:自定义规则命中明细表里「规则」列只显示 'tree',没有信息量。 ## 改动 - step9_custom_rules.py: 新增 _serialize_rule_human(group) 递归把条件树 序列化为可读 SQL 形态字符串 - 叶子: col LIKE '%X%' / col NOT LIKE '%Y%' / col > 10 / col < '2026-01-01' - 顶层组: children 用 AND/OR 串接;单 child 不加括号 - 嵌套组: (children) 加括号让优先级清晰 - 每条 entry 增加 rule_text 字段(common dict);删除无意义的 rule_type 赋值 - ColumnSpec: prop 'rule_type' → 'rule_text';render tag → code(等宽字体) ;min_width 120 → 240 - step8_report._md_custom_value_check / docx 版同步: - 去掉「关键字」列(v1 字段,v2 已不存在) - 「规则」列改用 rule_text ## 端到端验证 mock DB 跑一条含嵌套组的规则: 输入: AND(contains(X), OR(contains(Y), not_contains(Z))) rule_text: 'col LIKE \'%X%\' AND (col LIKE \'%Y%\' OR col NOT LIKE \'%Z%\')' 真实 SQL: '... WHERE (`id_card` LIKE %s ESCAPE \'!\' AND (`id_card` LIKE %s ESCAPE \'!\' OR `id_card` NOT LIKE %s ESCAPE \'!\')) LIMIT 100' 显示与真实 SQL 语义一致;区别仅是显示用 'col' 占位列名(方便看),真实 SQL 用 quote_ident。 ## 踩坑 第一版递归在父循环对子组额外包括号 '(" + walk() + ")',而 walk(is_top=False) 内部对嵌套组已经返回带括号形式 → 嵌套组变成 '((col < 5 OR col = 100))'。 修法:用 is_top 参数让递归本身决定是否加括号,调用方不再重复加。 教训:写递归字符串拼接时给一个 is_root / is_top 参数控制顶层 vs 嵌套行为。 -
Data Governance Dev authored
用户需求:针对特定字段的分析(国标字段规范、业务字段规范、用户自定义规则) 希望可切换「部分(前 1000 行)抽样 / 全量扫描」,且每个分析项独立配置(A 项选部分, B 项可独立选全量)。 ## 后端 - 新增 web/core/sql_utils.py: apply_sample_limit(sql, sample_limit, db_type) - sample_limit=None → 移除末尾 LIMIT N / AND ROWNUM <= N(全量扫描) - sample_limit=int → 保留原样(partial 模式) - 三方言均覆盖:MySQL / 达梦(标准 LIMIT)/ Oracle 11g(AND ROWNUM <= N) - models.ConnectRequest 新增 sample_limits: dict[str, int | None] - job_manager.submit 透传 sample_limits 给 orchestrator - orchestrator.run_governance_workflow 新增 sample_limits kwarg;按 step_id 取值 分发给各 _run_* 闭包 - step7_standards._run_round1/2/3_* 全部加 sample_limit 参数:渲染 SQL 后用 apply_sample_limit 二次处理(partial→加 LIMIT 1000,full→剥 LIMIT) - step9_custom_rules.run_step_custom_value_check 加 sample_limit 参数: SQL 构造按 None / oracle / else 三分支 ## 前端 - index.html sampleScope ref + SAMPLE_PARTIAL_LIMIT 常量 - 每个 IND-XXX leaf 行(checkbox 之后、字段名输入框之前)加 partial/full radio - key = step_id(每个 IND 独立),不再按 group 共享 - 标签去掉了「1000」后缀,仅显示「部分 / 全量」 - 自定义规则卡片保持 card-level 单个 radio(共享 custom_value_check step_id): step9 后端所有规则共用一个 LIMIT,要下沉需另改接口 - watch(analysisTree.groups) 加载后为每个 step_id 初始化 sampleScope='partial' - buildSampleLimitsForSubmit() 把 sampleScope 转成后端要的 {step_id: int|None} - startJob() payload 加 sample_limits 字段 - style.css 新增 .sample-scope--leaf(margin-left: 8px,紧贴字段名输入框) ## 端到端验证 - 用户在 IND-001/002/003 选全量、IND-004 选部分 → payload 正确: {std_ind_001: None, std_ind_002: None, std_ind_003: None, std_ind_004: 1000} - Pydantic ConnectRequest 解析通过;类型 [(str, 'NoneType'/'int'), ...] - 三方言 × partial/full × 多种 SQL 形态,行为符合预期 ## 踩坑 edit 工具改函数签名+docstring 时只换首行 → 留孤儿 """ → SyntaxError。 教训:edit 改函数签名 + docstring 时,把整个 docstring 完整贴一遍。 -
Data Governance Dev authored
新增 2026-08-13 条目,覆盖 6 块改动: 1) ORA-01036: illegal variable name/number - sql_builder 历史 Oracle 路径输出 qmark ?,但 python-oracledb 不支持 - Bind.next_idx 加 numbered :1/:2/... 占位符 2) ORA-00933: SQL command not properly ended - step9 无条件 LIMIT 200,Oracle 11g 不支持 - 截断子句分支:Oracle 走 WHERE ROWNUM <= N 3) 中间 bug:Oracle 分支漏 WHERE 关键字 - 静态验证三方言 SQL 时暴露,立即补 WHERE - 教训:跨方言分支必须同一组测试数据验证 4) evalPathExpr 不支持 dict 索引 - 设计 data.matches_rule_<idx> 扁平字段避开 this.x[key] 语法 - 教训:协议路径表达式先看支持语法再设计数据结构 5) flatResultRows 折叠表聚合踩坑 - 顶层 summary 是 section 共享的,按 tab key 前缀识别 custom_value_check_<idx> 6) UX:默认名「自定义规则N」 - nextDefaultRuleName() 扫已用名,找最小可用 N - 后端兜底回落 <table>.<column>(不再用 (未命名))
-
Data Governance Dev authored
两个用户反馈: 1) 自定义规则命中明细:原来 N 条规则塞进 1 个 tab,规则一多翻不到。 改为每条规则单独占 1 个 tab: - key = custom_value_check_<idx>(idx 从 1 开始,与前端卡片顺序一致) - title = <rule_name>(<table>.<column>) - summary alert:成功显示"本规则命中 N 行";失败显示"执行失败:**错误**"(红 alert) - table source = this.matches_rule_<idx>(扁平命名) 失败规则也出 tab(alert 显示错误),用户能直接看到为什么失败。 2) 新建自定义规则时输入框默认「自定义规则N」,N 从已用编号集合里找最小可用, 用户手动改名后 N 仍递增不会撞名。 数据 / 前端配套: - 后端 data 顶层加 matches_rule_<idx> / error_rule_<idx> / matched_rule_<idx> 三组扁平字段 - 为什么不走 dict 索引(this.by_rule['rule_X']):前端 evalPathExpr 是简单属性路径 (this.x.y.z),不识别 [key] 语法,扁平命名最干净 - 前端 flatResultRows 识别 custom_value_check_<idx> 前缀的 tab:命中数从 matched_rule_<idx> 取,检查数固定 1(每条规则 = 1 个字段) 静态验证(mock 两条规则,1 ok + 1 ORA-00933 失败)已通过: tabs: [ {key:custom_value_check_1, type:info, vars:{matched:this.matched_rule_1}}, {key:custom_value_check_2, type:error, vars:{error:this.error_rule_2}} ] WORKLOG 待用户在 Oracle 端实跑自定义规则验证后追加(不阻塞提交) -
Data Governance Dev authored
两个 Oracle 专属问题,连续两次跑自定义规则暴露: 1) ORA-01036: illegal variable name/number - 原因:sql_builder._placeholder 旧版 Oracle 路径输出 '?',但 python-oracledb 不支持 qmark 占位符(thin 模式不会自动转 :N,必须显式给 numbered) - 修复:Bind 加 next_idx;Oracle 路径按递增编号输出 :1, :2, ...,与 bind.params 顺序一一对应 2) ORA-00933: SQL command not properly ended - 原因:step9_custom_rules 无条件拼 'LIMIT 200',Oracle 11g 不支持 LIMIT (12c 引入 FETCH FIRST;11g 只能用 WHERE ROWNUM <= N) - 修复:截断子句按 db_type 分支,Oracle 走 WHERE ROWNUM <= 200 中间 bug:Oracle 分支漏写 WHERE 关键字(FROM "tbl" "col" LIKE :1 ...), 静态验证脚本(三个方言各跑一遍)暴露后补上 WHERE。 静态验证 SQL: MySQL : SELECT `COL` FROM `TBL` WHERE `COL` LIKE %s ESCAPE '!' LIMIT 200 达梦 : SELECT "COL" FROM "TBL" WHERE "COL" LIKE ? ESCAPE '!' LIMIT 200 Oracle : SELECT "COL" FROM "TBL" WHERE "COL" LIKE :1 ESCAPE '!' AND ROWNUM <= 200 WORKLOG 待用户在 Oracle 端跑自定义规则验证后追加(不阻塞提交) -
Data Governance Dev authored
把原本 3 行布局的「连接数据库」卡片重排为 2 行独立 form,结构更清晰 且整体更紧凑。 主要改动: 1. 拆成两个独立的 <el-form> - 第一个 form 只包「数据库类型」(3 个 radio-button) - 第二个 form 包「主机 IP / 端口 / 用户名 / 密码 / 数据库名 / 字符集」+ 测试连接按钮 + 结果 alert - 共享同一个 reactive form 对象,校验 / 重置不受影响 - 两个 form 之间用 margin-top: 12px 留白(不用 hr 不用 divider) 2. 切到 inline form 模式 - :inline="true" + label-width="auto" + label-position="right" - label 和控件同一行(不再是 label 上方 + 控件下方占两行) 3. span 重新分配(合计 24) - 主机 IP: 5(缩到刚好显示 192.168.20.196) - 端口: 3(数字 input) - 用户名: 2(用户名通常短) - 密码: 3(含眼睛图标) - 数据库名: 4(schema 名长度可变) - 字符集: 7(select + 下拉箭头占空间) 4. 端口字段改造 - 从 el-input-number 改 el-input(用户偏好) - v-model.number 保证后端拿到 int(Pydantic cfg.port: int 兼容) - @input 过滤非数字字符(避免 Pydantic "not a valid integer") 5. 解决 inline form 下 select/input 撑不满 col 的问题 - 给每个 el-form-item 加 display: inline-flex; align-items: center; width: 100% - 让 form-item 强制撑满 el-col 内部,input/select width:100% 才能真正展开 - 之前只加 width:100% 不够,因为 inline form 下 form-item 默认 inline-block 宽度 = max(label, content),select 会按内容自适应而不是 col 宽 6. gutter 从 20 → 12(列间距减半) 调整过程踩坑(避免再走): - inline form 下 el-form-item 默认 inline-block → 不会撑满 el-col - 单纯给 input 加 width:100% 不够 → form-item 本身也要撑满 - 终极方案是 form-item 用 inline-flex + width:100% 让内部 flex 自动展开 -
Data Governance Dev authored
之前已分别记录了 5 个 Oracle 相关条目(放开 Oracle / connect_timeout / DPY-3010 / 路径外置 / DPI-1047 PE 解析)。本条目汇总本轮新加的 4 个修复: 1. health SQL 不分方言 → ORA-00923(SELECT 1 不 FROM) 2. 前端 UI 隐藏 Oracle Client 输入框 3. 抽数据字典 ORA-00904 → 11g ALL_TABLES 实际可用列清单 4. 抽数据字典 0 行 → service_name vs schema 名混淆 含关键对照表: - MSVC 版本 vs MSVCR DLL(VC++ 2013 Redist 是关键) - MySQL/达梦/Oracle 的 schema 名语义差异
-
Data Governance Dev authored
Oracle Instant Client 路径不再让用户在 UI 填,改为: - 配置文件:web/configs/db_defaults.yaml 的 oracle_client_dir - 前端通过 GET /api/db-defaults 读取,注入 form.oracle_client_dir - 测试连接时 ...form 展开自动带上,后端 cfg.oracle_client_dir 拿到值 - UI 上完全看不到该输入框 修改路径的新流程:改 yaml → 重启 web 服务(sql_loader/db_defaults 不热加载) → 测连接。 state 字段 form.oracle_client_dir 保留(作为 form 数据载体); loadDbDefaults() 注入逻辑保留(只是 UI 不展示)。
-
Data Governance Dev authored
Oracle 11g (11.2.0.4) 数据库连接抽数据字典端到端跑通,解决 4 个独立问题: 1. connect_timeout → tcp_connect_timeout oracledb 1.4.2+ 移除了 connect_timeout kwarg(之前误以为兼容), 改成 tcp_connect_timeout;报错日志加 inspect 自动定位兼容 kwarg。 2. thick 模式加载 + DPI-1047 深度诊断 - _ensure_oracle_client() 解析 oci.dll 的 PE 导入表,自动列出 实际依赖的运行时 DLL(如 MSVCR120.dll → VC++ 2013 Redist) - DPY-3010(thin 不支持老 Oracle)日志加针对性安装指引 - 11.2.0.4 必须 thick 模式(thin 不支持 11.2) 3. 健康检查 SQL 分方言 新建 check_connection.oracle.sql 写 SELECT 1 FROM dual; Oracle 严格执行 SQL 标准,不像 MySQL/达梦 兼容裸 SELECT 1。 sql_loader 按 <name>.<dialect>.sql 优先 + .sql 回退 自动分流。 4. ALL_TABLES 11g 列兼容性 修 list_tables.oracle.sql: - data_length 用 t.BLOCKS * 8192 估算(11g 没 BYTES 列,12c+ 才有) - create_time / update_time 取 NULL(11g 没 CREATED/LAST_DDL_TIME,12c+ 才有) - 注释贴了 11.2.0.4 ALL_TABLES 完整可用列清单(用户 DESC 确认) 5. schema 名传递修正 data_dict.py 之前对所有数据库都传 cfg.database 给 list_tables/list_columns, 但 Oracle 体系里 ALL_TABLES.OWNER 是用户名(=cfg.user),不是 service_name。 加 cfg.db_type == 'oracle' 分支:schema_name = cfg.user 6. /api/db-defaults 加 oracle_client_dir 路径从 web/configs/db_defaults.yaml 预填,前端可隐藏输入框。 验证日志: [DB] Oracle Instant Client 已加载(thick 模式)lib_dir=... [DB] 连接已建立(耗时 ~100ms) [DB] 测试连接成功 [Cache] 写入数据字典: (表 N 张, 字段 M 个) 踩坑详见 docs/WORKLOG.md(2026-08-13 Oracle 端到端打通条目)。 -
Data Governance Dev authored
UI 从 7 组 / 30+ step 收敛到 3 组 / 15 step;隐藏 27 个 indicator。 合并 / 改名为独立 IND 号(移入 standards 组): - IND-401 / IND-402 → std_ind_401(姓名校验,2 子检查合一) - IND-006-b → std_ind_006(邮政编码) - IND-013-a / -b / -c → std_ind_017 / -018 / -019 (单位类别 GB/T 12402 / 经济类型 国统字〔2011〕86 号 / 行业代码 GB/T 4754) 隐藏 27 个 indicator(_HIDDEN_SUBS,暂离 UI,按需恢复): - IND-016-a / -101 / -201..-204 / -301 / -302 / -501 / -502 - IND-601..-603 / -901 / -902 - IND-006-a / -008-a..-011-a(其他业务字段整组下架) - IND-013-a..-c(已改名) - IND-012-a / -014-a / -014-b / -015-a(单位法人经办人整组下架) 整组下架(5 个 group): - 单位对公账户 字段规范 - 民政信息 - 证件信息 - 其他业务字段 - 单位 / 法人 / 经办人 字段规范 新增 / 重命名 group: - 业务字段规范(含 std_ind_401 姓名 + std_ind_007_a 公积金账号) 后端改动: - 抽 _run_standards_ind_renamed(source_id, target_step_id, target_title) 工厂 合并 IND-005/006/013 的改名逻辑 - _run_standards_combined factory 处理 std_ind_401 合并子检查 - _IND_COMBINED['ind_401'] 配置(IND-401/IND-402 字符集 + 长度合一) - _MERGED_SUBS / _HIDDEN_SUBS / mapped_step 同步更新 前端 / 配置: - analysis_tree.json: 7 组 → 3 组;description / default_expand 同步精简 - routes.py /api/match-config: _COMBINED_GROUPS 聚合 + IND-005/006/013 改名映射 docs(WORKLOG): 6 轮完整记录 + 踩坑(log 闭包 bug 修复、sub_prefix 对无后缀 ID 的适配等) UI 顺序:基础检查 → 国标字段规范(10 step)→ 业务字段规范(2 step)
-
Data Governance Dev authored
需求:把 IND-002(USCC 3 子)/ IND-003(手机号 2 子)/ IND-004(行政区划 2 子) 也和 IND-001 一样合并成单 step;IND-005(固定电话,1 子)UI 不再显示 -a 后缀。 改动: - step7_standards.py: 把 IND-001 专属的合并逻辑通用化为配置驱动 - _IND_COMBINED: {parent_id: {sub_ids, title, format}} 配置表(覆盖 ind_001/-002/-003/-004) - _wrap_combined_ind_001 → _wrap_combined_indicator(parent_id, ...) - run_step7_for_ind_001 → run_step7_combined(parent_id, ...) - 旧名保留为薄包装(backward compat) - orchestrator.py: - _MERGED_SUBS 扩展到 12 个子指标(4+3+2+2+1) - _run_standards_combined(parent_id) 工厂 + _COMBINED_STEP_META 注册表 - 循环注册 std_ind_001/-002/-003/-004 四个 step - _run_standards_ind_005 端到端改 4 处:section_key / step_id / tab.key / tab.title - analysis_tree.json: 标准组 7 行 → 5 行(去掉 -a/-b/-c 后缀) - routes.py: _COMBINED_GROUPS 4 组聚合 + IND-005 单独处理(YAML key 仍叫 IND-005-a) - WORKLOG 追加整段记录 + 踩坑说明(IND-005 改名必须 4 处一致)
-