反馈自动修复运行

流程中断,未产出补丁。

演练运行运行失败

总耗时

10m 29s

2026-08-11 13:12

Token

1,092

1 次模型调用

代码改动

无补丁

工具调用

0

恢复 3 次

RUN REF
9eb653893817
类别
formula_parsing
Provider
openai_compatible
模型
gpt-5.6-luna
Graph
agent-graph-v2
Policy
reproduction-policy-v1
扩展版本
0.3.0
基线 commit
89c9943f59c2

阶段 4 / 7

沙箱复现941ms重试 1

在隔离沙箱里生成一个会失败的测试,用来证明缺陷真实存在。断言只能从已登记的 Oracle 列表中挑选,模型不能提交可执行表达式。测试在基线上必须以预期方式失败,否则不算复现。

本阶段调用1

  • 已收到模型响应,但未通过严格 Schema 或本地策略校验。

    gpt-5.6-luna

    messages
    [{"role":"system","bytes":1233,"sha256":"7a0e1c8ce891d[REDACTED_PHONE]b1f7af0f636dbcebd25b14971cd16dccc4943455d2"},{"role":"user","bytes":699,"sha256":"0e776e8596df2d5aaabe397751cdef9b8a75b8aa7ab850bbd64cccc13b0ffc49"}]
    tool_count
    0
    response_schema
    ReproductionPlan
    error_code
    invalid_response
    error_type
    InvalidModelResponseError

独立验证

该运行未进入验证阶段。

已收到模型响应,但未通过严格 Schema 或本地策略校验。

补丁策略检查

patch-policy-v2

该运行未产生补丁。