反馈自动修复运行

流程中断,未产出补丁。

演练运行运行失败

总耗时

49.1s

2026-08-11 13:34

Token

969

1 次模型调用

代码改动

无补丁

工具调用

0

沙箱与外部操作

RUN REF
9eb653893817
类别
backend_normalization
Provider
openai_compatible
模型
gpt-5.6-luna
Graph
agent-graph-v2
Policy
reproduction-policy-v1
扩展版本
0.3.0
基线 commit
89c9943f59c2

阶段 4 / 7

沙箱复现35.0s

在隔离沙箱里生成一个会失败的测试,用来证明缺陷真实存在。断言只能从已登记的 Oracle 列表中挑选,模型不能提交可执行表达式。测试在基线上必须以预期方式失败,否则不算复现。

本阶段调用6

  • gpt-5.6-luna

    输入 1,102 · 输出 743 tokens

    messages
    [{"role":"system","bytes":1350,"sha256":"[REDACTED_PHONE]ca2bdc58fa7403a2a705f9ab1823d522f4524b32b1bdb8254d2"},{"role":"user","bytes":816,"sha256":"97ee7dd23d8d86dfe9a9a9f4b02263e3235ddc5b763b01b220434b9340a9002b"}]
    tool_count
    0
    response_schema
    ReproductionPlan
    oracle
    {"kind":"text_absent","parameters":{"parameter_names":["minimum","style","text","validator"]}}
    hypothesis
    [REDACTED_SUMMARY]
    files_to_read
    [{"path":"backend/app/normalizer.py","end_line":240,"start_line":1},{"path":"backend/app/pandoc_runner.py","end_line":240,"start_line":1},{"path":"backend/tests/test_convert_api.py","end_line":260,"start_line":1},{"path":"backend/tests/test_normalizer.py","end_line":260,"start_line":1}]
    target_test_selector
    test_feedback_546e816b_mermaid_export
    expected_failure_kind
    assertion
    extension_sync_possible
    false
  • path
    backend/app/normalizer.py
    end_line
    240
    start_line
    1
    path
    backend/app/normalizer.py
    end_line
    240
    start_line
    1
    content_bytes
    7861
  • path
    backend/app/pandoc_runner.py
    end_line
    240
    start_line
    1
    path
    backend/app/pandoc_runner.py
    end_line
    217
    start_line
    1
    content_bytes
    7883
  • path
    backend/tests/test_convert_api.py
    end_line
    260
    start_line
    1
    path
    backend/tests/test_convert_api.py
    end_line
    92
    start_line
    1
    content_bytes
    2446
  • path
    backend/tests/test_normalizer.py
    end_line
    260
    start_line
    1
    path
    backend/tests/test_normalizer.py
    end_line
    260
    start_line
    1
    content_bytes
    7761
  • gpt-5.6-luna

    输入 9,787 · 输出 846 tokens

    messages
    [{"role":"system","bytes":1333,"sha256":"1d025203db8a31f6d9369bdbce0549dea0b9576c8d7dbab71d64bc329bf72eb4"},{"role":"user","bytes":29871,"sha256":"3f4b6690f4d4d34b1df2ce95903c8c5956c83f31ea363af73ff680c9f06d5506"}]
    tool_count
    0
    response_schema
    TestGenerationResult
    edits
    [{"mode":"full_file","path":"backend/tests/test_feedback_regressions.py"}]
    oracle
    {"kind":"text_absent","parameters":{"parameter_names":["minimum","style","text","validator"]}}
    reason
    [REDACTED_SUMMARY]
    files_needed_for_fix
    ["backend/app/normalizer.py","backend/app/pandoc_runner.py"]
    target_test_selector
    test_feedback_546e816b_mermaid_export
    expected_failure_kind
    assertion
    extension_sync_required
    false

独立验证

该运行未进入验证阶段。

已收到模型响应,但未通过严格 Schema 或本地策略校验。

补丁策略检查

patch-policy-v2

该运行未产生补丁。