反馈自动修复运行
流程中断,未产出补丁。
演练运行运行失败
总耗时
10m 29s
2026-08-11 13:12
Token
1,092
1 次模型调用
代码改动
无补丁
工具调用
0
恢复 3 次
- RUN REF
- 9eb653893817
- 类别
- formula_parsing
- Provider
- openai_compatible
- 模型
- gpt-5.6-luna
- Graph
- agent-graph-v2
- Policy
- reproduction-policy-v1
- 扩展版本
- 0.3.0
- 基线 commit
- 89c9943f59c2
阶段 4 / 7
沙箱复现941ms重试 1 次
在隔离沙箱里生成一个会失败的测试,用来证明缺陷真实存在。断言只能从已登记的 Oracle 列表中挑选,模型不能提交可执行表达式。测试在基线上必须以预期方式失败,否则不算复现。
本阶段调用1
已收到模型响应,但未通过严格 Schema 或本地策略校验。
gpt-5.6-luna
- messages
- [{"role":"system","bytes":1233,"sha256":"7a0e1c8ce891d[REDACTED_PHONE]b1f7af0f636dbcebd25b14971cd16dccc4943455d2"},{"role":"user","bytes":699,"sha256":"0e776e8596df2d5aaabe397751cdef9b8a75b8aa7ab850bbd64cccc13b0ffc49"}]
- tool_count
- 0
- response_schema
- ReproductionPlan
- error_code
- invalid_response
- error_type
- InvalidModelResponseError
独立验证
该运行未进入验证阶段。
已收到模型响应,但未通过严格 Schema 或本地策略校验。
补丁策略检查
patch-policy-v2
该运行未产生补丁。