工作日结_2026-09-15
一、今天做了什么
1. 环境
- 21:23 用
start-dev.ps1 启动前后端(启动前 8090/8080 均空闲,无 java 进程)。
- 就绪验证:后端
Started TrafficAuditApplication / Tomcat started on port(s): 8090;前端 Compiled successfully / App running at:。
- 冒烟:
http://localhost:8080 返回 200(885 字节)、http://localhost:8090/api/auth/captcha 返回 200。
- 说明:旧
backend.log 里 9-14 的 MojoExecutionException(exit code 1073807364,进程被终止)是上次会话被打断留下的,与本次启动无关。
2. DeepSeek 外发数据的保密性评估(回答"保密数据走大模型会不会泄露")
- 结论:**有泄露风险,且当前代码仍有三处明文外发**。
- 已具备的防护:白名单表/列;屏蔽 7 个身份联系类字段(
DbQueryExecutor.java:35);查询结果里企业名换成 CompanyN、自由文本内企业名同步替换、手机号脱敏(DbQueryExecutor.java:234);回答返回前端前还原真名(LLMService.java:93)。
- 仍然明文外发到 DeepSeek 的内容:
涉及企业: <真实企业名> 直接写进 system prompt(LLMService.java:157);
企业解释: <原文> 未脱敏(LLMService.java:163)——解释里常见负责人姓名、手机号、车牌、承运方名称;
- 用户在 AI 对话框手输的内容原样转发(
traffic-audit-web/src/components/AiChatDialog.vue:150);
关联上报记录ID 与表名随提示外发(LLMService.java:166),配合云端留存可定位到具体记录。
- 固有风险:数据出内网即失控,留存时长/是否用于训练本地无法验证,一旦泄露不可撤回、不可追溯。
- 给出的三条路线:①内网私有化部署开源模型(推荐,只改
api-url);②必须用云端则先补齐脱敏,再谈数据处理协议与关闭训练通道;③云端不接触业务数据,只外发数字与规则描述。
3. 建了明早的自动自检
- 在本线程挂了一次性 heartbeat 自动化:
C:\Users\郑玉洁\.codex\automations\automation\automation.toml,RRULE FREQ=DAILY;COUNT=1;BYHOUR=8;BYMINUTE=0。
- 行为:明早 08:00 触发后先探测 8090/8080,未启动则每 2 分钟复查(最晚等到 09:30);服务就绪后做只读自检(启动健康度、功能完成度、代码与安全、数据一致性风险、文档缺口、Git 状态),按「严重问题/功能未完成/待优化」三档输出中文清单,报告发出后自置 PAUSED,不修改任何文件。
二、测试结果摘要
- 前后端启动 + 冒烟:后端 HTTP 200、前端 HTTP 200,日志就绪标志齐全(见上)。
- 今日无代码改动,未新增《功能测试报告》;DeepSeek 外发风险为静态代码核查结论,未做运行期报文抓包。
- 报文级验证沿用 9-14 的结论(见《功能测试报告_接口鉴权与AI数据脱敏加固_2026-09-14.md》),本次未复测。
三、遗留问题与待办
- AI 外发脱敏补齐(今日评估发现,约 20 行改动):system prompt 里的企业名与解释原文先过
DesensitizeService,返回时 unmaskAll 还原;用户输入加关键字过滤。待用户确认后实施。
- 保密数据部署路线需用户与业务/网安确认:内网私有化模型,还是云端 + 完整脱敏 + 协议。
- 9-14 遗留项继续挂账:4 张明细报表模板扩列、审核比对基准缺失保护、导入校验增强、
sys_role 权限落地、3D 验证码生产开启、backend.log 历史明文清理。
- 仓库根目录有 122 个未跟踪临时文件(
_*.py、_*.txt、_*.ps1、_*.sql 等)未被 .gitignore 覆盖,建议统一忽略或清理(动之前先经用户确认)。
四、明天计划
- 拿明早自检产出的问题清单,与用户逐条过一遍、定优先级。
- 落地 AI 外发脱敏补齐(估半天),完成后写《功能测试报告》,并沿用"假服务抓包"做报文级验证。
- 按与同事对齐的结论,推进 4 张明细报表模板扩列或审核比对基准缺失保护。