反馈自动修复运行

流程中断,未产出补丁。

演练运行运行失败

总耗时

1m 16s

2026-08-11 13:38

Token

963

1 次模型调用

代码改动

无补丁

工具调用

0

沙箱与外部操作

RUN REF
6577d680a442
类别
backend_normalization
Provider
openai_compatible
模型
gpt-5.6-luna
Graph
agent-graph-v2
Policy
reproduction-policy-v1
扩展版本
0.3.0
基线 commit
89c9943f59c2

阶段 4 / 7

沙箱复现1m 01s重试 1

在隔离沙箱里生成一个会失败的测试,用来证明缺陷真实存在。断言只能从已登记的 Oracle 列表中挑选,模型不能提交可执行表达式。测试在基线上必须以预期方式失败,否则不算复现。

本阶段调用7

  • gpt-5.6-luna

    输入 1,102 · 输出 734 tokens

    messages
    [{"role":"system","bytes":1350,"sha256":"[REDACTED_PHONE]ca2bdc58fa7403a2a705f9ab1823d522f4524b32b1bdb8254d2"},{"role":"user","bytes":816,"sha256":"c7a8920f69e685a1aac8bb3a7646bd6894cb078c78d79c45c316c4924a49a50a"}]
    tool_count
    0
    response_schema
    ReproductionPlan
    oracle
    {"kind":"text_absent","parameters":{"parameter_names":["minimum","style","text","validator"]}}
    hypothesis
    [REDACTED_SUMMARY]
    files_to_read
    [{"path":"backend/app/normalizer.py","end_line":240,"start_line":1},{"path":"backend/app/pandoc_runner.py","end_line":240,"start_line":1},{"path":"backend/tests/test_normalizer.py","end_line":260,"start_line":1},{"path":"backend/tests/test_pandoc_runner.py","end_line":260,"start_line":1},{"path":"backend/tests/test_convert_api.py","end_line":320,"start_line":1}]
    target_test_selector
    test_feedback_eca0e904_mermaid_diagram_export
    expected_failure_kind
    assertion
    extension_sync_possible
    false
  • path
    backend/app/normalizer.py
    end_line
    240
    start_line
    1
    path
    backend/app/normalizer.py
    end_line
    240
    start_line
    1
    content_bytes
    7861
  • path
    backend/app/pandoc_runner.py
    end_line
    240
    start_line
    1
    path
    backend/app/pandoc_runner.py
    end_line
    217
    start_line
    1
    content_bytes
    7883
  • path
    backend/tests/test_normalizer.py
    end_line
    260
    start_line
    1
    path
    backend/tests/test_normalizer.py
    end_line
    260
    start_line
    1
    content_bytes
    7761
  • path
    backend/tests/test_pandoc_runner.py
    end_line
    260
    start_line
    1
    path
    backend/tests/test_pandoc_runner.py
    end_line
    227
    start_line
    1
    content_bytes
    8225
  • path
    backend/tests/test_convert_api.py
    end_line
    320
    start_line
    1
    path
    backend/tests/test_convert_api.py
    end_line
    92
    start_line
    1
    content_bytes
    2446
  • 已收到模型响应,但未通过严格 Schema 或本地策略校验。

    gpt-5.6-luna

    messages
    [{"role":"system","bytes":1402,"sha256":"0ff456bc4a7eee6deafbff6e663aaae[REDACTED_PHONE]aea894736b0b422f346db0"},{"role":"user","bytes":38741,"sha256":"c43c11dcfc48589a9663c1116d161ae0a3c226587ee5de7cfc2749adb8b022c7"}]
    tool_count
    0
    response_schema
    TestGenerationResult
    error_code
    invalid_response
    error_type
    InvalidModelResponseError

独立验证

该运行未进入验证阶段。

已收到模型响应,但未通过严格 Schema 或本地策略校验。

补丁策略检查

patch-policy-v2

该运行未产生补丁。