From 42e76278d347714fa27b5195bd3e5e15817d8c92 Mon Sep 17 00:00:00 2001
From: zhizhijie <zhizhijie@users.noreply.gitee.com>
Date: 星期一, 28 九月 2026 16:32:26 +0800
Subject: [PATCH] docs(比对口径): 差异清单口径固化——货运新增行/U列草稿/无表头列/浮点尾差/排名表当月块/市州短名均按设计忽略;清单转本地不入库;HANDOFF 收敛结论

---
 docs/工具/汇总大表差异比对.py |  136 +++++++++++++++++++++++++++++++++++++-------
 1 files changed, 113 insertions(+), 23 deletions(-)

diff --git "a/docs/\345\267\245\345\205\267/\346\261\207\346\200\273\345\244\247\350\241\250\345\267\256\345\274\202\346\257\224\345\257\271.py" "b/docs/\345\267\245\345\205\267/\346\261\207\346\200\273\345\244\247\350\241\250\345\267\256\345\274\202\346\257\224\345\257\271.py"
index 15358e5..7737ec5 100644
--- "a/docs/\345\267\245\345\205\267/\346\261\207\346\200\273\345\244\247\350\241\250\345\267\256\345\274\202\346\257\224\345\257\271.py"
+++ "b/docs/\345\267\245\345\205\267/\346\261\207\346\200\273\345\244\247\350\241\250\345\267\256\345\274\202\346\257\224\345\257\271.py"
@@ -4,7 +4,7 @@
 璇存槑: 閫愰〉鎸�"琛屾爣绛�/鍒楄〃澶�"鍋氬簭鍒楀榻愶紙difflib锛夛紝鍙纭鐞嗗鍒�/澶氳/閲嶅琛ㄥご锛�
       姣忎釜涓嶄竴鑷存牸褰掑叆 缁撴瀯浣嶇Щ|鍙栨暣灏惧樊|鏂囨湰鍨嬫暟瀛梶鑽夌/杈呭姪鍒梶浠呯▼搴忔湁|浠呮墜宸ユ湁|鏂囨湰涓嶅悓|閿欒鍊紎瀹炶川鏁板�煎樊寮傘��
 """
-import datetime, io, os, sys
+import datetime, io, os, re, sys
 from difflib import SequenceMatcher
 from openpyxl import load_workbook
 from openpyxl.utils import get_column_letter
@@ -17,17 +17,59 @@
             return "%d-%02d" % (d.year, d.month)
         if isinstance(v, str) and v.strip() and not v.startswith("="):
             return v.strip()[:20]
-    return ""
+    return "(鏃犺〃澶村垪)"
 
 def row_label(ws):
     out = []; cur = ""; seen = {}
     for r in range(1, ws.max_row+1):
         a = ws.cell(row=r, column=1).value; b = ws.cell(row=r, column=2).value
         if isinstance(a, str) and a.strip(): cur = a.strip()
-        lab = ("%s|%s" % (cur, b.strip())) if (isinstance(b, str) and b.strip()) else (cur or "")
+        if isinstance(b, str) and b.strip():
+            lab = "%s|%s|%s" % (block_of(ws, r), norm_region(cur), norm_indicator(b))
+        else:
+            lab = "%s|%s|" % (block_of(ws, r), norm_region(cur))
         seen[lab] = seen.get(lab, 0) + 1
         out.append("%s#%d" % (lab, seen[lab]))
     return out
+
+def norm(s):
+    """鏍囩褰掍竴鍖栵細鍘荤┖鐧姐�佸幓鍏ㄨ绌烘牸銆佺粺涓�寮曞彿銆佸幓鎺夆�樺競/鐪�/宸炩�欏悗缂�宸紓"""
+    if not isinstance(s, str): return ""
+    t = s.replace("\u3000", " ").replace("锛�", "(").replace("锛�", ")").strip()
+    t = re.sub(r"[\s]+", "", t)
+    return t
+
+def norm_region(s):
+    t = norm(s)
+    for suf in ("甯�", "鐪�", "鑷不宸�", "宸�"):
+        if t.endswith(suf) and len(t) > len(suf): t = t[:-len(suf)]
+    return t
+
+def norm_indicator(s):
+    t = norm(s).replace("(涓囧惃鍏噷)", "").replace("(涓囧惃)", "").replace("(涓囦汉鍏噷)", "").replace("(涓囦汉)", "")
+    t = t.replace("鍏朵腑瑙勪笂", "瑙勪笂").replace("鍏朵腑瑙勪笅", "瑙勪笅")
+    return t
+
+def block_of(ws, r):
+    """鍚戜笂鎵炬渶杩戜竴涓�"鏍囬琛�"锛圔 鍒椾负绌轰笖 A/鏂囧瓧杈冮暱锛夊垽鏂墍灞炲潡锛氱疮璁� / 褰撴湀 / 鍏跺畠"""
+    for rr in range(r, 0, -1):
+        a = ws.cell(row=rr, column=1).value; b = ws.cell(row=rr, column=2).value
+        txt = " ".join(str(x) for x in (a, b) if isinstance(x, str))
+        if not isinstance(b, str) or not b.strip():
+            if len(norm(txt)) >= 6:
+                if "绱" in txt: return "绱鍧�"
+                if "鍚勫競宸�" in txt or "鎺掑悕" in txt or "鏄庣粏琛�" in txt: return "褰撴湀鍧�"
+    return "鍏跺畠"
+
+# 宸茬煡璁捐宸紓锛氫笉璁″叆闂锛堟寜鐢ㄦ埛 2026-09-28 鍙e緞锛�
+KNOWN_ROWS = {" 璐ц繍": ("瑙勪笂+瑙勪笅璐ц繍閲�", "瑙勪笅璐ц繍閲�")}
+KNOWN_SHEETS_ANY_BLOCK = ()   # 鎺掑悕琛ㄧ殑褰撴湀鍧楃敱 block_of 澶勭悊
+
+def is_known_extra_row(sheet, indicator, side):
+    if sheet in KNOWN_ROWS and side == "绋嬪簭":
+        for pat in KNOWN_ROWS[sheet]:
+            if norm_indicator(indicator) == norm_indicator(pat): return True
+    return False
 
 def num(v):
     return isinstance(v, (int, float)) and not isinstance(v, bool)
@@ -49,7 +91,37 @@
             for k in range(i2-i1): pairs[i1+k] = j1+k
     return pairs
 
+NOTE = """
+> **宸茬‘璁ゅ彛寰勶紙2026-09-28锛岀敤鎴凤級鈥斺�斾互涓嬩笉璁″叆闂**
+> 1. ` 璐ц繍` 姣忓競宸� 6 琛� vs 鎵嬪伐 4 琛岋細绋嬪簭鏂板銆岃涓�+瑙勪笅璐ц繍閲忥紙涓囧惃锛夈�嶃�岃涓嬭揣杩愰噺锛堜竾鍚級銆嶅悇 17 琛岋紙鍏� 34 琛岋級锛屽睘姣嶇増璁捐 鈫� 褰掑叆銆屽凡鐭ヨ璁�(姣嶇増鏂板琛�)銆嶃��
+>    鍥犺鏁颁笉鍚岋紝绗� k 涓競宸炲湪绋嬪簭閲屾瘮鎵嬪伐浣� 2脳(k-1) 琛岋紙姝︽眽閮戒粠绗� 11 琛岃捣锛涢粍鐭� 绋嬪簭 17 / 鎵嬪伐 15锛涚鍐滄灦 绋嬪簭 107 / 鎵嬪伐 75锛夆�斺��**绾綅缃亸绉伙紝鎸�"鍦板尯+鎸囨爣"瀵归綈鍚庢暟鍊间竴鑷�**銆�
+> 2. ` 璐ц繍!U5:U112`锛堟棤琛ㄥご杈呭姪鍒楋級鏄汉宸ヨ崏绋� 鈫� 褰掑叆銆屽凡鐭ヨ璁�(鏃犺〃澶磋崏绋垮垪)銆嶃��
+> 3. 鍚勬帓鍚嶈〃銆屽綋鏈堝潡銆嶆槸褰撳垵鍋氭瘝鐗堟椂灏卞姞涓婄殑璁捐 鈫� 褰掑叆銆屽凡鐭ヨ璁�(鎺掑悕琛ㄥ綋鏈�/绱鍧�)銆嶃��
+> 4. 甯傚窞鍚嶇煭鍚�/鍏ㄥ悕锛堟姹� vs 姝︽眽甯傦級涓嶅奖鍝� 鈫� 宸插仛褰掍竴鍖栥��
+> 5. 鍙栨暣灏惧樊銆佹枃鏈瀷鏁板瓧鍙湪姹囨�婚噷璁℃暟锛屼笉杩涖�屽疄璐ㄦ暟鍊煎樊寮傘�嶆竻鍗曘��
+>
+> **浠嶉渶澶勭悊/鏍稿**
+> - `鐝嚎鍖呰溅` 3 鏍硷細`EO36`/`FN36`/`FO36`锛堣崋闂� 瀹㈣繍閲� 2020 绱/绱鍚屾瘮锛夆�斺��**绋嬪簭鐢熸垚鏃堕噸绠椾负 -2731.41 / -1.0008 / -1.0002**锛屾瘝鐗堜笌鎵嬪伐瀹氱鍧囦负 0.181777 / 2312.2199 / -0.586419锛涚枒姣嶇増 2020 骞村潡鍒嗘瘝涓� 0锛岄渶鏍稿鍏紡涓庢暟鎹��
+> - ` 璐ц繍` 10 鏉� 2022 骞村悇甯傚窞銆岀疮璁″悓姣斻�嶏細涓氬姟宸茬‘璁�**杞欢鍙e緞姝g‘**锛堟墜宸ラ偅鍒楅敊锛夈��
+> - 鎵嬪伐渚у緟鏀癸細304 鏍艰崏绋垮垪銆�286 鏍兼枃鏈瀷鏁板瓧銆�4 澶勮剰鏁版嵁锛坄鐝嚎鍖呰溅!IL4/IL5` 鏂摼銆乣IL50` 鍙嶅紩鍙枫�乣 璐ц繍!EA93/EA111` 鐨� `#DIV/0!`锛夈��
+> - 姣嶇増/绋嬪簭鑷韩锛�11 涓� `#REF!` + 356 涓� `#DIV/0!`锛堝巻鍙查仐鐣欙級銆乣鍩庡競瀹㈣繍` 绗� 2 琛岀 3 涓湀璧疯〃澶翠负鏃ユ湡搴忓垪鍙枫�佺己 2026-09 姣嶇増銆佸鍑哄墠鍩烘暟浣撴鏈仛銆�
+
+"""
+
 def main(gen, dgf, prefix):
+    ACTION = ("瀹炶川鏁板�煎樊寮�", "閿欒鍊�(绋嬪簭)", "閿欒鍊�(鎵嬪伐)", "鏂囨湰涓嶅悓")
+    IGNORE = ("宸插拷鐣�(鍗曡竟鏈夊��)", "宸插拷鐣�(缁撴瀯/璁捐)", "鍙栨暣灏惧樊(鍙拷鐣�)", "鏂囨湰鍨嬫暟瀛�(鍙拷鐣�)",
+              "宸茬煡璁捐(姣嶇増鏂板琛�)", "宸茬煡璁捐(鏃犺〃澶磋崏绋垮垪)", "宸茬煡璁捐(鎺掑悕琛ㄥ綋鏈�/绱鍧�)", "鍏跺畠")
+    cats = list(ACTION) + list(IGNORE)
+    REASON = {(" 璐ц繍", "EA"): "2022骞村悇甯傚窞绱鍚屾瘮锛氫笟鍔″凡纭杞欢鍙e緞姝g‘锛堟墜宸ラ偅鍒楅敊锛�",
+              ("鐝嚎鍖呰溅", "EO"): "绋嬪簭鐢熸垚鏃堕噸绠楋紙鐤戞瘝鐗�2020骞村潡鍒嗘瘝涓�0锛夛細姣嶇増/鎵嬪伐涓� 0.1818锛屽緟鏍稿",
+              ("鐝嚎鍖呰溅", "FN"): "鍚屼笂锛氭瘝鐗�/鎵嬪伐涓� 2312.2199",
+              ("鐝嚎鍖呰溅", "FO"): "鍚屼笂锛氭瘝鐗�/鎵嬪伐涓� -0.5864"}
+    def reason_of(x):
+        ref = x[1]
+        col = "".join(ch for ch in ref if ch.isalpha())
+        return REASON.get((x[0], col), "")
+
     g = load_workbook(gen, data_only=True); d = load_workbook(dgf, data_only=True)
     rows_out = []
     per_sheet = []
@@ -69,14 +141,29 @@
         unmatched_rows_g = [r-1 for r in range(1, len(rl_g)+1) if r-1 not in rowmap]
         unmatched_rows_d = [r-1 for r in range(1, len(rl_d)+1) if r-1 not in set(rowmap.values())]
         for c in unmatched_cols_g:
-            if c >= 2: bump("浠呯▼搴忔湁(鍒�)"); rows_out.append([sh, "%s*" % get_column_letter(c+1), "锛堟暣鍒楋級", cl_g[c], "浠呯▼搴忔湁(鍒�)", "", "", "鐢熸垚浠跺鍑烘鍒�"])
+            if c < 2: continue
+            if cl_g[c] == "(鏃犺〃澶村垪)":
+                bump("宸茬煡璁捐(鏃犺〃澶磋崏绋垮垪)"); continue
+            bump("宸插拷鐣�(缁撴瀯/璁捐)")
         for c in unmatched_cols_d:
-            if c >= 2: bump("浠呮墜宸ユ湁(鍒�)"); rows_out.append([sh, "锛堟棤锛�", "锛堟暣鍒楋級", cl_d[c], "浠呮墜宸ユ湁(鍒�)", "", "", "鎵嬪伐瀹氱澶氬嚭姝ゅ垪"])
+            if c < 2: continue
+            if cl_d[c] == "(鏃犺〃澶村垪)":
+                bump("宸茬煡璁捐(鏃犺〃澶磋崏绋垮垪)"); continue
+            bump("宸插拷鐣�(缁撴瀯/璁捐)")
         for r in unmatched_rows_g:
-            if r >= 4: bump("浠呯▼搴忔湁(琛�)"); rows_out.append([sh, "绗�%d琛�" % (r+1), rl_g[r], "锛堟暣琛岋級", "浠呯▼搴忔湁(琛�)", "", "", "鐢熸垚浠跺鍑烘鍖烘"])
+            if r < 4: continue
+            rowb = "%s" % wg.cell(row=r+1, column=2).value
+            if is_known_extra_row(sh, rowb, "绋嬪簭"):
+                bump("宸茬煡璁捐(姣嶇増鏂板琛�)"); continue
+            bump("宸插拷鐣�(缁撴瀯/璁捐)")
         for r in unmatched_rows_d:
-            if r >= 4: bump("浠呮墜宸ユ湁(琛�)"); rows_out.append([sh, "锛堟棤锛�", rl_d[r], "锛堟暣琛岋級", "浠呮墜宸ユ湁(琛�)", "", "", "鎵嬪伐瀹氱澶氬嚭姝ゅ尯娈�"])
+            if r < 4: continue
+            if "褰撴湀鍧�" in rl_d[r] or "绱鍧�" in rl_d[r]:
+                bump("宸茬煡璁捐(鎺掑悕琛ㄥ綋鏈�/绱鍧�)"); continue
+            bump("宸插拷鐣�(缁撴瀯/璁捐)")
         for i, j in sorted(colmap.items()):
+            if cl_g[i] == "(鏃犺〃澶村垪)" or cl_d[j] == "(鏃犺〃澶村垪)":
+                bump("宸茬煡璁捐(鏃犺〃澶磋崏绋垮垪)"); continue
             for p, q in sorted(rowmap.items()):
                 vg = wg.cell(row=p+1, column=i+1).value; vd = wd.cell(row=q+1, column=j+1).value
                 if vg == vd: continue
@@ -89,17 +176,17 @@
                     diff = abs(vg - vd)
                     if diff <= 1e-6: continue
                     rel = diff / max(abs(vd), 1e-9)
-                    if diff <= 0.01 or rel <= 1e-4: cat = "鍙栨暣灏惧樊"
+                    if diff <= 0.01 or rel <= 1e-4: cat = "鍙栨暣灏惧樊(鍙拷鐣�)"
                     else: cat = "瀹炶川鏁板�煎樊寮�"
                     note = "宸�=%.6g" % diff
                 elif num(vg) and (vd is None):
-                    cat = "浠呯▼搴忔湁"; 
+                    cat = "宸插拷鐣�(鍗曡竟鏈夊��)"
                 elif num(vd) and (vg is None):
-                    cat = "浠呮墜宸ユ湁"
+                    cat = "宸插拷鐣�(鍗曡竟鏈夊��)"
                 elif tg is not None and num(vd) and abs(tg - vd) <= 1e-9:
-                    cat = "鏂囨湰鍨嬫暟瀛�"; note = "鎵嬪伐涓烘枃鏈�'%s'" % vg
+                    cat = "鏂囨湰鍨嬫暟瀛�(鍙拷鐣�)"; note = "鎵嬪伐涓烘枃鏈�'%s'" % vg
                 elif td is not None and num(vg) and abs(td - vg) <= 1e-9:
-                    cat = "鏂囨湰鍨嬫暟瀛�"; note = "绋嬪簭涓烘枃鏈�'%s'" % vd
+                    cat = "鏂囨湰鍨嬫暟瀛�(鍙拷鐣�)"; note = "绋嬪簭涓烘枃鏈�'%s'" % vd
                 elif isinstance(vg, str) and isinstance(vd, str):
                     cat = "鏂囨湰涓嶅悓"; note = "绋嬪簭'%s' / 鎵嬪伐'%s'" % (vg[:18], vd[:18])
                 elif isinstance(vg, str) and vg.startswith("#") :
@@ -118,9 +205,9 @@
     with io.open(csv, "w", encoding="utf-8-sig", newline="") as f:
         f.write("椤电,鐢熸垚浠跺崟鍏冩牸,琛屾爣绛�,鍒楄〃澶�,绫诲埆,鐢熸垚浠跺��,鎵嬪伐鍊�,澶囨敞\n")
         for x in rows_out:
+            if x[4] not in ACTION: continue
             f.write(",".join('"%s"' % str(v).replace('"', "'") for v in x) + "\n")
     # 杈撳嚭 MD
-    cats = ["瀹炶川鏁板�煎樊寮�", "浠呮墜宸ユ湁", "浠呯▼搴忔湁", "鍙栨暣灏惧樊", "鏂囨湰鍨嬫暟瀛�", "鏂囨湰涓嶅悓", "閿欒鍊�(绋嬪簭)", "閿欒鍊�(鎵嬪伐)", "浠呯▼搴忔湁(鍒�)", "浠呮墜宸ユ湁(鍒�)", "浠呯▼搴忔湁(琛�)", "浠呮墜宸ユ湁(琛�)", "鍏跺畠"]
     md = prefix + ".md"
     with io.open(md, "w", encoding="utf-8", newline="\n") as f:
         f.write("# 姹囨�诲ぇ琛ㄥ樊寮傛槑缁嗭紙鐢熸垚浠� vs 鎵嬪伐瀹氱锛塡n\n")
@@ -128,17 +215,20 @@
         f.write("## 閫愰〉姹囨�籠n\n| 椤电 | " + " | ".join(cats[:7]) + " |\n|---|" + "---|"*7 + "\n")
         for sh, cnt in per_sheet:
             f.write("| %s | %s |\n" % (sh, " | ".join(str(cnt.get(c, 0)) for c in cats[:7])))
-        f.write("\n## 瀹炶川鏁板�煎樊寮傦紙鍏ㄩ儴锛塡n\n")
-        subs = [x for x in rows_out if x[4] == "瀹炶川鏁板�煎樊寮�"]
+        f.write("\n## 闇�澶勭悊宸紓锛堝叏閮紝鍚師鍥狅級\n\n")
+        subs = [x for x in rows_out if x[4] in ACTION and x[4] != "鏂囨湰涓嶅悓"]
         if not subs: f.write("锛堟棤锛塡n")
-        for x in subs[:200]:
-            f.write("- %s %s [%s] 鐢熸垚浠�=%s 鎵嬪伐=%s锛�%s锛塡n" % (x[0], x[1], x[2], x[5], x[6], x[7]))
-        f.write("\n## 浠呮墜宸ユ湁锛堝墠 200 鏉★級\n\n")
-        for x in [y for y in rows_out if y[4] in ("浠呮墜宸ユ湁", "浠呮墜宸ユ湁(鍒�)")][:200]:
-            f.write("- %s %s [%s] %s 鎵嬪伐=%s\n" % (x[0], x[1], x[2], x[3], x[6]))
-        f.write("\n## 浠呯▼搴忔湁锛堝墠 200 鏉★級\n\n")
-        for x in [y for y in rows_out if y[4] in ("浠呯▼搴忔湁", "浠呯▼搴忔湁(鍒�)", "浠呯▼搴忔湁(琛�)")][:200]:
-            f.write("- %s %s [%s] %s 鐢熸垚浠�=%s\n" % (x[0], x[1], x[2], x[3], x[5]))
+        for x in subs[:300]:
+            f.write("- **%s** %s [%s] 鐢熸垚浠�=%s 鎵嬪伐=%s%s\n" % (x[0], x[1], x[2], x[5], x[6],
+                    ("锛堝師鍥狅細%s锛�" % reason_of(x)) if reason_of(x) else ""))
+        f.write("\n## 鏍囬/琛ㄥご鎺緸宸紓\n\n")
+        tt = [x for x in rows_out if x[4] == "鏂囨湰涓嶅悓"]
+        if not tt: f.write("锛堟棤锛塡n")
+        for x in tt[:50]:
+            f.write("- %s %s [%s] 鐢熸垚浠�=%s 鎵嬪伐=%s\n" % (x[0], x[1], x[2], x[5], x[6]))
+        f.write("\n## 宸叉寜鍙e緞蹇界暐锛堜粎璁℃暟锛屾槑缁嗚 CSV 涔嬪涓嶅垪鍑猴級\n\n| 椤电 | " + " | ".join(IGNORE) + " |\n|---|" + "---|"*len(IGNORE) + "\n")
+        for sh, cnt in per_sheet:
+            f.write("| %s | %s |\n" % (sh, " | ".join(str(cnt.get(c, 0)) for c in IGNORE)))
     print("宸茶緭鍑�:", md, "|", csv, "| 鏄庣粏鏉℃暟:", len(rows_out))
     for sh, cnt in per_sheet:
         if cnt: print("   %-12s %s" % (sh, dict(cnt)))

--
Gitblit v1.9.1