立法评估流程调整与校准记录
记录立法评估评分口径、联合材料处理、真实模型评分及后续实质修改重点的调整与校准结果。
立法评估流程调整与校准记录
记录日期:2026-09-09。当前评分标准:draft-maturity-v2.0。
本轮已完成评估口径、联合提交和结果解释的调整,以及本地功能验证。此前长流请求未能完成;在改用较短分段、直连优先、非流式 JSON 和 480 秒单请求期限后,已取得一次完整真实评分。该结果不构成 80 分保证。
本次材料
以下两个 Word 文件作为同一份提交资料,合并阅读、相互补充,不分别打分后取平均:
| 材料 | 提取正文字符数 |
|---|---|
| 第一部分:《广东省智能网联汽车发展促进条例(草案)》(代拟稿)(总)(1).docx | 8,902 |
| 第三部分:立法理由书(逐条【说明】与【理由】)(1).docx | 195,097 |
| 合并提交正文,含材料名称及边界标记 | 204,114 |
以上按 JavaScript 字符串长度计数。合并标记也占字符,因此合并长度大于两份正文字符数之和。上传后生成可编辑正文,实际评估以文本框当前内容为准。
旧提示词的问题与调整
旧版提示词直接要求模型判断“是否具备试行条件”并给出四维度及综合分数,但没有检查项锚点、固定权重或总分计算约束,也没有明确区分草案准备程度与现实运营资格。这容易造成评分口径波动,将草案阶段尚待配套的事项按已实施要求扣分。旧版同时缺少多材料互补规则和逐字证据定位要求。以上是流程与提示词层面的缺陷,不代表已经通过真实对照量化了各缺陷导致的扣分幅度。
新版以草案成熟度为评分对象。每个维度包含 5 个独立检查项,每项 0—5 分;后端计算维度分,再按固定权重计算综合分:
维度分 = 5 个检查项分数之和 × 4
综合分 = 四舍五入(合法性与权限 × 25%
+ 必要性与问题回应 × 25%
+ 制度可执行性 × 30%
+ 成本与资源保障 × 20%)
4 分表示该项在草案阶段基本完整,剩余问题主要可通过精修或已有授权的配套解决;5 分需要设计充分、明确、一致且有可追溯论证。理由书可以补充设计论证,但不能替代正文规范或证明其中提到的法律、标准、事实已获外部核实。同一配套缺口不在多个维度重复扣分,除非能够说明各自独立影响。
80—89 分用于解释“多数制度成熟、仍有明确完善项”,不是目标配额。程序不保底、不强制抬分、不封顶,也不为这两份文件设置专用加分。成熟度分数不等于合法性证明或运营许可;试行结论仍须独立识别启动前置条件和明确障碍。
长材料所有区段都会进入证据整理,短的草案主文保持全文,再结合长材料证据进行评估,不通过截掉后半段缩短输入。长材料摘要有压缩损失,逐字引文回查也不等于外部法律核验。
仍保留的实质修改重点
评分口径放到草案阶段后,下列事项仍须作为具体修改或启动前核验重点,不能因为期望较高分数而忽略:
- 第三十三条:复核责任分配与举证规则的权限边界,明确与上位法的衔接,避免仅用概括性兜底语句替代具体修订。
- 第四十二条:复核保险义务、处罚安排及其设定依据,将保险保障机制与可依法实施的处罚配置对应起来。
- 第二十五、二十六条:细化跨市许可、认可或协调机制的适用边界、责任机关及衔接程序,避免将区域协调直接等同于法定许可替代。
- 试行与配套安排:明确启动条件、暂停和退出触发条件、责任主体、评估产出及配套规则制定路径,形成可验证的实施闭环。
这些是依据提交材料形成的审查与修订方向,不是已经通过权威法律检索作出的违法认定。
验证与真实评分状态
本轮自动测试 56 项通过;浏览器中两份 Word 同时选择、提取并合并正文的流程验证通过。相关测试验证评分计算、结构校验、原文证据处理和应用流程,不代表真实模型给分已经达到某一区间。
| 真实模型对照 | 本记录写入时的状态 |
|---|---|
| 旧版提示词基线 | 未取得可靠完整分数 |
| 新版联合材料评估 | 已完成一次:61 分,not_ready |
| 弱材料对照 | 未取得可靠完整分数 |
长请求测试多次发生连接中断;其中原生请求的旧版基线在约 165.4 秒后报 ECONNRESET。改进后的完整联调使用 17 个约 12,000 字符分段、直连优先和非流式 JSON,耗时约 860.6 秒,返回综合分 61,结论 not_ready;四维度为合法性 48、必要性 76、可执行性 60、资源 60。模型指出责任/举证、许可、处罚权限、数据及跨境规则仍需处理。相同材料再次提交已命中本机结果缓存,接口约 25ms 返回同一已验证结果。此前失败请求不产生缓存结果。
本轮已获得一次完整真实分数,但没有证据证明“80+”目标已达成。若要提高分数,应先修改上述实质问题后重新评估,而不是放宽后端分数门槛。
另行执行的依赖审计仍报告 3 个中风险项,涉及现有 Express/body-parser/qs 依赖链。功能测试通过不等于生产安全审计通过;本轮未强制跨版本升级依赖,正式公开部署前仍需完成依赖安全更新与验证。
详细运行报告位于项目本地 .local/calibration/。报告可能包含材料引文和运行元信息,默认不纳入迁移包。本记录不包含 API 地址、密钥或本机 API 配置。