反馈自动修复运行
流程中断,未产出补丁。
演练运行运行失败
总耗时
49.1s
2026-08-11 13:34
Token
969
1 次模型调用
代码改动
无补丁
工具调用
0
沙箱与外部操作
- RUN REF
- 9eb653893817
- 类别
- backend_normalization
- Provider
- openai_compatible
- 模型
- gpt-5.6-luna
- Graph
- agent-graph-v2
- Policy
- reproduction-policy-v1
- 扩展版本
- 0.3.0
- 基线 commit
- 89c9943f59c2
阶段 4 / 7
沙箱复现35.0s
在隔离沙箱里生成一个会失败的测试,用来证明缺陷真实存在。断言只能从已登记的 Oracle 列表中挑选,模型不能提交可执行表达式。测试在基线上必须以预期方式失败,否则不算复现。
本阶段调用6
gpt-5.6-luna
输入 1,102 · 输出 743 tokens
- messages
- [{"role":"system","bytes":1350,"sha256":"[REDACTED_PHONE]ca2bdc58fa7403a2a705f9ab1823d522f4524b32b1bdb8254d2"},{"role":"user","bytes":816,"sha256":"97ee7dd23d8d86dfe9a9a9f4b02263e3235ddc5b763b01b220434b9340a9002b"}]
- tool_count
- 0
- response_schema
- ReproductionPlan
- oracle
- {"kind":"text_absent","parameters":{"parameter_names":["minimum","style","text","validator"]}}
- hypothesis
- [REDACTED_SUMMARY]
- files_to_read
- [{"path":"backend/app/normalizer.py","end_line":240,"start_line":1},{"path":"backend/app/pandoc_runner.py","end_line":240,"start_line":1},{"path":"backend/tests/test_convert_api.py","end_line":260,"start_line":1},{"path":"backend/tests/test_normalizer.py","end_line":260,"start_line":1}]
- target_test_selector
- test_feedback_546e816b_mermaid_export
- expected_failure_kind
- assertion
- extension_sync_possible
- false
- path
- backend/app/normalizer.py
- end_line
- 240
- start_line
- 1
- path
- backend/app/normalizer.py
- end_line
- 240
- start_line
- 1
- content_bytes
- 7861
- path
- backend/app/pandoc_runner.py
- end_line
- 240
- start_line
- 1
- path
- backend/app/pandoc_runner.py
- end_line
- 217
- start_line
- 1
- content_bytes
- 7883
- path
- backend/tests/test_convert_api.py
- end_line
- 260
- start_line
- 1
- path
- backend/tests/test_convert_api.py
- end_line
- 92
- start_line
- 1
- content_bytes
- 2446
- path
- backend/tests/test_normalizer.py
- end_line
- 260
- start_line
- 1
- path
- backend/tests/test_normalizer.py
- end_line
- 260
- start_line
- 1
- content_bytes
- 7761
gpt-5.6-luna
输入 9,787 · 输出 846 tokens
- messages
- [{"role":"system","bytes":1333,"sha256":"1d025203db8a31f6d9369bdbce0549dea0b9576c8d7dbab71d64bc329bf72eb4"},{"role":"user","bytes":29871,"sha256":"3f4b6690f4d4d34b1df2ce95903c8c5956c83f31ea363af73ff680c9f06d5506"}]
- tool_count
- 0
- response_schema
- TestGenerationResult
- edits
- [{"mode":"full_file","path":"backend/tests/test_feedback_regressions.py"}]
- oracle
- {"kind":"text_absent","parameters":{"parameter_names":["minimum","style","text","validator"]}}
- reason
- [REDACTED_SUMMARY]
- files_needed_for_fix
- ["backend/app/normalizer.py","backend/app/pandoc_runner.py"]
- target_test_selector
- test_feedback_546e816b_mermaid_export
- expected_failure_kind
- assertion
- extension_sync_required
- false
独立验证
该运行未进入验证阶段。
已收到模型响应,但未通过严格 Schema 或本地策略校验。
补丁策略检查
patch-policy-v2
该运行未产生补丁。