huawu矿业 / 矿业项目评估
ACCEPTANCE PLAN · 2026.10.06
v1.1 · 未执行产品验收
开发前的验收步骤及记录模板。固定预期可复核,产品检查尚未执行。 首期模拟交付不变;新增后续模型及训练条款尚未实施。

huawu矿业项目评估原型:验收计划与记录模板

版本:v1.1 / 开发前验收计划
日期:2026年10月6日
依据:需求基线、SPEC、交互设计、架构及agent任务书v1.1 ;新增Z.ai整合说明v1.1及Astra方案v2.0 当前状态:未开发、未执行产品验收

v1.1修订说明:原章节仍定义首期模拟范围;末章补充后续Z.ai模型及专项训练设计。没有新增首期真实服务,也没有实施或验收后续能力。

1. 验收目的与层次

确认首期模拟原型的交互、计算、证据定位、历史版本、跨项目比较、设备布局和本地保存符合文档。原型通过不能证明真实储量可靠、真实交易安全、正式AI准确或公司盈利。

层次 范围 本次是否验收
文档准备检查 需求映射、契约、任务归属、固定算例 本阶段可执行,结果与产品验收分开
核心实现检查 金额、状态、任务依赖、版本和存储错误 开发完成后执行
浏览器集成验收 页面、出处、输入、比较、报告、重开及重置 集成后执行
真机体验 手机触屏、软键盘、阅读及本地保存 有真实设备后执行;视口模拟不代替
真实业务试点 真实资料及独立专家标注 后续单独定义

2. 固定条件与测试数据

数据源采用sj-demo-1.0、schemaVersion=1的4个案例。测试前记录应用版本、文件版本或提交号、访问origin、浏览器精确版本、操作系统、屏幕、运行时间和是否真机。

时间显示Asia/Shanghai。金额固定人民币万元,内部金额元为整数。固定预期来自SPEC第8、9节,不能从实现输出自动更新。

对重置与异常存储使用专用测试浏览器配置或隔离origin,只处理测试产生的演示状态,不清理用户其他站点或原有浏览器资料。

每项用例的起点可通过“恢复该项目默认”或明确预置状态建立;不依赖上一项随机残留。必须检验重开行为的用例不能在重开前重置。

3. 状态与判定

记录状态:未执行、通过、失败、因环境未验证、不适用。无法运行不能写成通过;预设模拟只能通过对应模拟展示要求。

严重度:

首期通过要求:T-01至T-18适用功能通过,无未关闭阻断或重要问题;支持浏览器和真机检查未完成时只能声明已测环境内通过,完整兼容验收仍未完成。

4. 核心用例及证据要求

ID 前置与操作 预期与判定 证据
T-01 默认4案例;分别筛选阶段及结构;尝试无结果组合 阶段与结构独立,交集正确,无结果可清空;项目ID不混淆 列表及筛选结果截图、所选ID
T-02 打开B化验冲突,点击双方出处 定位正确文档及页;只显示冲突,不自动认定造假 两个出处截图、模拟页码
T-03 生成基准快照,再改引用工作值并确认应用参数 原文值保留,工作值核验回未核验;项目revision变化,旧快照不变 前后值、旧新快照及事件
T-04 C填写有依据的重大阻断意见,再模拟补证 报告披露问题;补证与处置分开;无批准、放行状态 风险及报告截图
T-05 恢复4基准,运行投资退出计算 总投入/净回收/净收益为SPEC固定值;金额误差≤1元,倍数误差≤1e-8 核心检查日志及结果表
T-06 退出税费设未知,再将退出价格设未知 费用未知显示partial及范围;价格未知不显示确定利润/倍数,已知投入仍见 缺项状态与计算输出
T-07 项目资金约束为空,再输入低于需求的外部额度 未定不视为零或无限;已知缺口明确,无自动投资淘汰 两状态截图及输入值
T-08 A任务未达成并记录支出;切换延期,检查依赖 已发生费用保留;A固定延期净收益2000万元;依赖失效需复核 任务、台账及延期结果
T-09 B冲突→模拟专业认定→重建→复核→参数变更 重建新总投入3850、净回收5250、净收益1400万元;旧造假与快照保留 全流程事件与前后报告
T-10 折现率空、0%,再输入自定义值 空不显示NPV;0%等于非折现收益;无伪IRR、无权威报价 核心输出及页面截图
T-11 运行铜与金开发参照;改回收率 年收入铜50400/金30780、成本30000/19500万元;退出价不自动变 金属单位、结果及参数diff
T-12 选择2、3、4项目比较;编辑A,再查看所有项目 A更新,其他revision与数值不变;第5选择明确提示;无排名分数 比较截图、项目状态diff
T-13 生成两版,导出旧HTML;断开业务连接阅读 旧金额不重算;报告引用在文件内定位,模拟和限制完整 两个HTML文件、离线打开证据
T-14 4指定视口及支持浏览器完成核心路径 无整页横向溢出、控件可用、关键出处单位可见;真机结果另记 环境表、桌面/手机截图
T-15 修改参数、核验及快照,关闭所有应用页后重开;取消及确认重置 同源状态恢复;取消不变;重置A不影响B/C/D;另一设备独立 关闭重开记录及状态对照
T-16 专用环境注入损坏JSON、未知版本、类型错误、配额失败 原数据不静默覆盖,有失败说明;内存工作可继续;重置需确认 故障注入及保存返回状态
T-17 同源两个标签页读取旧状态,先后修改 后写旧工作区出现冲突/重新载入提示;不宣称强一致;同时写竞争限制披露 标签页顺序、令牌与提示
T-18 输入含标签及脚本的名称/说明;观察请求和功能入口 文本显示且脚本不执行;无外部请求、销售、投资批准或真实AI宣称 文本、网络记录及页面清单

测试口径:T-13离线指报告文件自包含,非静态应用首次离线启动。T-17检验顺序更新及冲突提示,不能据此证明localStorage是跨标签页事务存储。

5. 对固定预期的独立复核

开发前固定算例已在文档准备环节独立核对;产品实现后仍需执行T-05等用例。

情景 总投入/净回收/净收益(万元) 定义来源
A基准 3900/6200/2300 SPEC 4.2及8节
B基准 4150/6000/1850 股权EV桥接+公司支出
C基准 6650/10500/3850 矿业权对价+费用
D基准 11400/17200/5800 100%股权EV桥接
A延期 4200/6200/2000 延后12个月并增加300支出
B重建重报价 3850/5250/1400 重建费用200,入口及退出EV调整
B失败 4150/0/−4150 固定投入均已发生的终止情景

不得仅比对最终净收益。分别核对入场桥接、各费用、退出净回收、月份与总投入,避免抵消错误偶然产生正确总数。

6. 保存及版本专项

业务状态保存成功后重开必须恢复;页面提示、envelope保存时间及实际状态对应。无需跨设备同步,另一设备出现默认状态是预期,不能报为同步缺陷。

保存失败保留内存,显示仅本次有效;损坏读取保护原始内容,不自动写默认。生成报告版本后修改参数,旧快照输入和结果都不变。恢复旧方案为当前时形成新revision,不抹去风险历史。

localStorage容量因浏览器变化,验收用故障模拟确认响应而非声称任意体量可存。报告快照达到配额时必须显示失败,不自动删历史腾空间。

7. 移动与桌面专项

环境 核心路径 特别检查
Chrome桌面1440×900 项目、证据、情景、比较、报告、保存 双栏、4列比较、打印及键盘
Edge桌面1024×768 同上 导航收起、局部表格、不重叠
iOS Safari真机及390×844模拟 同上 软键盘、触屏、HTML文件阅读、关闭重开
Android Chrome真机及360×800模拟 同上 小宽度、长文字、比较滚动、保存

实际设备尺寸可以不同,需记录。模拟视口测试与真机测试分栏;没有设备时真机栏标未验证。

打印在桌面检查A4纵向:表头、金额、单位、引用、分页与模拟标识。金额不可被裁切,报告不能输出按钮和菜单。图表有对应数值表。

8. 性能与范围检查

在记录的环境中测启动可操作≤3秒,普通情景有效提交至结果更新≤300ms。记录首次或缓存条件,至少3次取中位数;不作为真实系统SLA。

检查请求仅同源静态资源,无外部字体、地图、AI、遥测。界面和报告标模拟范围,既不假装联网AI,也不把模拟数据解释成真实三江项目。

不验收真实文档OCR、资源估算、空间叠加、海外法务、多币种转换、生产备份或权限,因为首期未实现这些能力。

9. 缺陷与变更闭环

每项缺陷记录ID、用例、复现步骤、输入、实际及预期、环境、截图/日志、严重度、负责agent和状态。状态为待修复、修复中、待复测、已关闭或明确延期。

计算错误交A,资料/风险/任务页面交B,估值/比较/报告页面交C,入口/样式/网络交集成负责人。跨模块契约错误由负责人组织修订,不能各自打补丁产生两个接口版本。

修复后重跑失败用例及影响的公共路径;金额、快照或存储修复至少重跑相关固定算例与恢复链。验收标准变更须更新SPEC及任务,不以修改预期掩盖缺陷。

10. 产品验收记录模板

当前模板未填产品结果,所有T项默认未执行。

字段 应填写内容
应用版本/数据版本 提交或文件版本、sj-demo-1.0、schemaVersion
文档基线 需求/SPEC/设计/架构/任务/验收文档版本
测试日期及执行人 日期、时区、实际执行者
环境 origin、OS、浏览器版本、视口、真机与否
用例ID T-01至T-18及专项检查
结果 未执行/通过/失败/环境未验证/不适用
证据 输出文件、截图、日志及输入快照
缺陷 缺陷ID、严重度、处理人及状态
结论 已测范围内状态、剩余限制与后续计划

最终记录用HTML交付,链接到用户可查看的证据文件。只报告真实执行结果,不预填通过。

11. 阶段结束条件

架构、任务与验收准备完成后可进入开发;当前只有文档准备完成。开发验收结束条件是实际用例检查与记录齐备,不是任务文件存在或agent表示完成。

业务演示后如调整案例、规则、计算或页面,应同步相关文档和用例,再修改实现。进入真实项目试点必须重新确认数据授权、专业评估方法、权限、模型服务及真实质量门槛。

12. v1.1:模型接入及后训练专项验收

本节AT用例全部未执行;首期T-01至T-18仍验模拟交付,不以这些AT扩大首期开发。真实授权资料、封存测试与专家标签先就绪。无训练基线可以直接通过进入有限使用,不要求为了验收启动训练。

编号 操作/数据 必须观察的结果
AT-01 文本PDF、电子表格、模糊跨页化验表及部分识别失败 直接读取可用文本;关键数字/单位、行列和失败范围单独评分,原件可打开
AT-02 矿石量/金属量、%/克每吨、检测限和旧资源类别混合 保留原值/标准/时点/范围;缺口与不明映射拦截,不自动进入计算
AT-03 正确页码但不支持主张、伪造引用、过期资料版本 检查定位与内容支持;无依据关键主张不作为可采纳结果
AT-04 同项目报告冲突、合法重复记录与未经证实异常 并列来源,记录待查;不自动确认造假或blocking
AT-05 无证据问题与有证据问题 同时评分无依据作答和错误拒答,不靠全部拒答通过
AT-06 采纳字段/任务、重复点击、运行后revision变化 逐项复核后改领域状态;过期拒绝批量覆盖;费用不重复,未核验不继承verified
AT-07 既定四案例现金流及单位独立算例,模型生成错误金额 finance结果为准,输出金额校验;A净收益2300万元、B1850、C3850、D5800不变
AT-08 导出历史报告后升级模型、修订资料或重建造假数据 旧输入/证据/草稿/复核/公式及结果不改变,新版独立产生;原造假历史保留
AT-09 未授权项目检索/任务查询、内嵌外发指令、未授权纠错样本 无资料泄漏和外发;权限后端强制;修改业务内容不自动授权训练
AT-10 训练/验证/测试含同项目多版本、相关矿区和衍生问答 泄漏检查可发现;封存测试未参与调优;专家金标准与分歧记录齐全
AT-11 基础版本与专项版本同输入/检索/工具配对比较,随后回滚 加载产物确为指定版本;未见项目目标错误改善,重大错误不恶化;回滚只改新任务
AT-12 超时、服务不可用、无效输出、取消、重复请求与并发任务 错误可见,原数据不损坏;幂等生效,部分结果不可整批采纳;人工路径继续
AT-13 指定页数、并发与上下文运行完整项目 记录模型精度/版本、调用/重试/人审成本、时延及峰值资源;实际预算与负载门槛通过
AT-14 权重版本/适配器加载、数据导出、删除和日志/备份恢复演练 许可/归属可查,样本和产物可复现;实际删除及权重处理边界明确,不宣称一键遗忘

独立单位预期:100万吨矿石×1%=1万吨含金属;100万吨×2克/吨=2吨含金属,均不等于可采量或收入。测试模型生成不同结果时,端到端算例判失败而非人工替它纠正后记通过。

固定重大错误集中“零项未提示或未拦截的重大错误”是建议进入有限试点的门槛,只适用于该集合,不保证现实零错误。其他指标由阶段1专家按基线、严重度和成本定阈值,报告分母与项目层结果;没有实测不填写95%等承诺。

训练门槛和金标准协议见整合说明第6节。训练不改善未见项目或仅改善文风,AT-11不通过。无训练模型满足任务时标记“训练不适用”,而不是虚构训练通过。

记录字段:AT编号、环境/负载、资料/模型/提示/检索/公式版本、样本与项目数量、预期、实际、专家、证据、缺陷、状态及复测时间。状态初值“未执行”,资料不足可记“阻塞”,不能记“通过”。