remove reasoning guard
This commit is contained in:
@@ -2,7 +2,7 @@
|
||||
|
||||
日期:2026-08-23
|
||||
范围:OpenCodeGo / `deepseek-v4-flash`,OpenAI 兼容 `/chat/completions`
|
||||
状态:实验性研究,未集成到主项目
|
||||
状态:实验性研究,未集成到主项目;主项目曾短暂集成推理保护,后因实测影响输出质量而移除(详见 `PLAN_ai_analysis_v2.md`)
|
||||
|
||||
## 摘要
|
||||
|
||||
@@ -10,7 +10,7 @@
|
||||
|
||||
结论是:**仅发送 `reasoning_content` 或“上一轮思维链”并不稳定;成功率最高的方案是伪造一段 tool call 历史,并把续写要求、输出格式和需要引用的内容放入 tool 结果中。**
|
||||
|
||||
与本研究相关的代码在 `AiV2.Tests/Program.cs` 中,默认不会执行。
|
||||
与本研究相关的实验代码已从 `AiV2.Tests/Program.cs` 中移除,不再保留可执行实验入口。
|
||||
|
||||
## 目标
|
||||
|
||||
@@ -232,9 +232,11 @@ system
|
||||
- 不要假设 `reasoning_content` 的末尾内容一定能被模型召回。
|
||||
- 增加原始响应/请求日志,以便区分“模型未看到”和“模型看到了但没引用”。
|
||||
|
||||
## 主项目集成状态(2026-08-23)
|
||||
## 主项目集成状态(2026-08-23,历史记录;该功能已全部移除)
|
||||
|
||||
- 主项目已落地模型级“推理保护”实验开关,默认关闭,仅在 `IsStream=true` 的模型上生效。
|
||||
> 以下内容是当时的集成状态,不代表当前代码。当前主项目已移除推理保护及所有相关代码/测试。
|
||||
|
||||
- 主项目曾落地模型级“推理保护”实验开关,默认关闭,仅在 `IsStream=true` 的模型上生效。
|
||||
- 累计推理 token 达到阈值后停止读取当前 SSE 响应,保留部分推理和正文;最多发起一次续写。
|
||||
- 续写采用本报告推荐的伪造 tool call 历史:`assistant(reasoning_content + tool_calls)` → `tool(tool_call_id + 收尾指令)`。
|
||||
- 首请求不携带 `tools`,只有续写请求注入 `tools` 与 `tool_choice=none`;缓存命中为 best-effort。
|
||||
@@ -248,9 +250,7 @@ system
|
||||
|
||||
## 专用测试状态
|
||||
|
||||
- 测试代码:`AiV2.Tests/Program.cs` 中的 `OpenCodeGoFakeToolCallTests`。
|
||||
- 默认行为:不执行。
|
||||
- 启用条件:`ARR_AI_E2E=1` 且 `ARR_AI_E2E_TOOL=1`。
|
||||
- 输出:Markdown 报告,路径通过 `ARR_AI_TOOL_REPORT_PATH` 指定。
|
||||
- 原测试代码:`AiV2.Tests/Program.cs` 中的 `OpenCodeGoFakeToolCallTests`。
|
||||
- 现状:已随推理保护一起移除,不再保留可执行实验入口。
|
||||
|
||||
主项目中的实验性 `ChatMessage` 扩展、`AiReasoningContinuationSettings`、UI 开关、回传/降级逻辑和 tool call 历史构造均已移除。
|
||||
|
||||
Reference in New Issue
Block a user