# xenon - Doramagic AI Context Pack

> 定位：安装前体验与判断资产。它帮助宿主 AI 有一个好的开始，但不代表已经安装、执行或验证目标项目。

## 充分原则

- **充分原则，不是压缩原则**：AI Context Pack 应该充分到让宿主 AI 在开工前理解项目价值、能力边界、使用入口、风险和证据来源；它可以分层组织，但不以最短摘要为目标。
- **压缩策略**：只压缩噪声和重复内容，不压缩会影响判断和开工质量的上下文。

## 给宿主 AI 的使用方式

你正在读取 Doramagic 为 xenon 编译的 AI Context Pack。请把它当作开工前上下文：帮助用户理解适合谁、能做什么、如何开始、哪些必须安装后验证、风险在哪里。不要声称你已经安装、运行或执行了目标项目。

## Claim 消费规则

- **事实来源**：Repo Evidence + Claim/Evidence Graph；Human Wiki 只提供显著性、术语和叙事结构。
- **事实最低状态**：`supported`
- `supported`：可以作为项目事实使用，但回答中必须引用 claim_id 和证据路径。
- `weak`：只能作为低置信度线索，必须要求用户继续核实。
- `inferred`：只能用于风险提示或待确认问题，不能包装成项目事实。
- `unverified`：不得作为事实使用，应明确说证据不足。
- `contradicted`：必须展示冲突来源，不得替用户强行选择一个版本。

## 它最适合谁

- **正在使用 Claude/Codex/Cursor/Gemini 等宿主 AI 的开发者**：README 或插件配置提到多个宿主 AI。 证据：`README.md` Claim：`clm_0002` supported 0.86

## 它能做什么

- **命令行启动或安装流程**（需要安装后验证）：项目文档中存在可执行命令，真实使用需要在本地或宿主环境中运行这些命令。 证据：`README.md` Claim：`clm_0001` supported 0.86

## 怎么开始

- `pip install -U "git+https://gitee.com/xianyu-sheng123/Xenon.git@v0.7.3"` 证据：`README.md` Claim：`clm_0003` supported 0.86
- `pip install -U "git+https://github.com/xianyu-sheng/Xenon.git@v0.7.3"` 证据：`README.md` Claim：`clm_0004` supported 0.86
- `git clone https://gitee.com/xianyu-sheng123/Xenon.git` 证据：`README.md` Claim：`clm_0005` supported 0.86
- `pip install -e ".[dev]"` 证据：`README.md` Claim：`clm_0006` supported 0.86

## 继续前判断卡

- **当前建议**：先做角色匹配试用
- **为什么**：这个项目更像角色库，核心风险是选错角色或把角色文案当执行能力；先用 Prompt Preview 试角色匹配，再决定是否沙盒导入。

### 30 秒判断

- **现在怎么做**：先做角色匹配试用
- **最小安全下一步**：先用 Prompt Preview 试角色匹配；满意后再隔离导入
- **先别相信**：角色质量和任务匹配不能直接相信。
- **继续会触碰**：角色选择偏差、命令执行、宿主 AI 配置

### 现在可以相信

- **适合人群线索：正在使用 Claude/Codex/Cursor/Gemini 等宿主 AI 的开发者**（supported）：有 supported claim 或项目证据支撑，但仍不等于真实安装效果。 证据：`README.md` Claim：`clm_0002` supported 0.86
- **能力存在：命令行启动或安装流程**（supported）：可以相信项目包含这类能力线索；是否适合你的具体任务仍要试用或安装后验证。 证据：`README.md` Claim：`clm_0001` supported 0.86
- **存在 Quick Start / 安装命令线索**（supported）：可以相信项目文档出现过启动或安装入口；不要因此直接在主力环境运行。 证据：`README.md` Claim：`clm_0003` supported 0.86

### 现在还不能相信

- **角色质量和任务匹配不能直接相信。**（unverified）：角色库证明有很多角色，不证明每个角色都适合你的具体任务，也不证明角色能产生高质量结果。
- **不能把角色文案当成真实执行能力。**（unverified）：安装前只能判断角色描述和任务画像是否匹配，不能证明它能在宿主 AI 里完成任务。
- **真实输出质量不能在安装前相信。**（unverified）：Prompt Preview 只能展示引导方式，不能证明真实项目中的结果质量。
- **宿主 AI 版本兼容性不能在安装前相信。**（unverified）：Claude、Cursor、Codex、Gemini 等宿主加载规则和版本差异必须在真实环境验证。
- **不会污染现有宿主 AI 行为，不能直接相信。**（inferred）：Skill、plugin、AGENTS/CLAUDE/GEMINI 指令可能改变宿主 AI 的默认行为。 证据：`CLAUDE.md`
- **可安全回滚不能默认相信。**（unverified）：除非项目明确提供卸载和恢复说明，否则必须先在隔离环境验证。
- **真实安装后是否与用户当前宿主 AI 版本兼容？**（unverified）：兼容性只能通过实际宿主环境验证。
- **项目输出质量是否满足用户具体任务？**（unverified）：安装前预览只能展示流程和边界，不能替代真实评测。

### 继续会触碰什么

- **角色选择偏差**：用户对任务应该由哪个专家角色处理的判断。 原因：选错角色会让 AI 从错误专业视角回答，浪费时间或误导决策。
- **命令执行**：包管理器、网络下载、本地插件目录、项目配置或用户主目录。 原因：运行第一条命令就可能产生环境改动；必须先判断是否值得跑。 证据：`README.md`
- **宿主 AI 配置**：Claude/Codex/Cursor/Gemini/OpenCode 等宿主的 plugin、Skill 或规则加载配置。 原因：宿主配置会改变 AI 后续工作方式，可能和用户已有规则冲突。 证据：`CLAUDE.md`
- **本地环境或项目文件**：安装结果、插件缓存、项目配置或本地依赖目录。 原因：安装前无法证明写入范围和回滚方式，需要隔离验证。 证据：`README.md`
- **宿主 AI 上下文**：AI Context Pack、Prompt Preview、Skill 路由、风险规则和项目事实。 原因：导入上下文会影响宿主 AI 后续判断，必须避免把未验证项包装成事实。

### 最小安全下一步

- **先跑 Prompt Preview**：先用交互式试用验证任务画像和角色匹配，不要先导入整套角色库。（适用：任何项目都适用，尤其是输出质量未知时。）
- **只在隔离目录或测试账号试装**：避免安装命令污染主力宿主 AI、真实项目或用户主目录。（适用：存在命令执行、插件配置或本地写入线索时。）
- **先备份宿主 AI 配置**：Skill、plugin、规则文件可能改变 Claude/Cursor/Codex 的默认行为。（适用：存在插件 manifest、Skill 或宿主规则入口时。）
- **安装后只验证一个最小任务**：先验证加载、兼容、输出质量和回滚，再决定是否深用。（适用：准备从试用进入真实工作流时。）

### 退出方式

- **保留安装前状态**：记录原始宿主配置和项目状态，后续才能判断是否可恢复。
- **准备移除宿主 plugin / Skill / 规则入口**：如果试装后行为异常，可以把宿主 AI 恢复到试装前状态。
- **保留原始角色选择记录**：如果输出偏题，可以回到任务画像阶段重新选择角色，而不是继续沿着错误角色推进。
- **记录安装命令和写入路径**：没有明确卸载说明时，至少要知道哪些目录或配置需要手动清理。
- **如果没有回滚路径，不进入主力环境**：不可回滚是继续前阻断项，不应靠信任或运气继续。

## 哪些只能预览

- 解释项目适合谁和能做什么
- 基于项目文档演示典型对话流程
- 帮助用户判断是否值得安装或继续研究

## 哪些必须安装后验证

- 真实安装 Skill、插件或 CLI
- 执行脚本、修改本地文件或访问外部服务
- 验证真实输出质量、性能和兼容性

## 边界与风险判断卡

- **把安装前预览误认为真实运行**：用户可能高估项目已经完成的配置、权限和兼容性验证。 处理方式：明确区分 prompt_preview_can_do 与 runtime_required。 Claim：`clm_0007` inferred 0.45
- **命令执行会修改本地环境**：安装命令可能写入用户主目录、宿主插件目录或项目配置。 处理方式：先在隔离环境或测试账号中运行。 证据：`README.md` Claim：`clm_0008` supported 0.86
- **待确认**：真实安装后是否与用户当前宿主 AI 版本兼容？。原因：兼容性只能通过实际宿主环境验证。
- **待确认**：项目输出质量是否满足用户具体任务？。原因：安装前预览只能展示流程和边界，不能替代真实评测。
- **待确认**：安装命令是否需要网络、权限或全局写入？。原因：这影响企业环境和个人环境的安装风险。

## 开工前工作上下文

### 加载顺序

- 先读取 how_to_use.host_ai_instruction，建立安装前判断资产的边界。
- 读取 claim_graph_summary，确认事实来自 Claim/Evidence Graph，而不是 Human Wiki 叙事。
- 再读取 intended_users、capabilities 和 quick_start_candidates，判断用户是否匹配。
- 需要执行具体任务时，优先查 role_skill_index，再查 evidence_index。
- 遇到真实安装、文件修改、网络访问、性能或兼容性问题时，转入 risk_card 和 boundaries.runtime_required。

### 任务路由

- **命令行启动或安装流程**：先说明这是安装后验证能力，再给出安装前检查清单。 边界：必须真实安装或运行后验证。 证据：`README.md` Claim：`clm_0001` supported 0.86

### 上下文规模

- 文件总数：337
- 重要文件覆盖：40/337
- 证据索引条目：77
- 角色 / Skill 条目：37

### 证据不足时的处理

- **missing_evidence**：说明证据不足，要求用户提供目标文件、README 段落或安装后验证记录；不要补全事实。
- **out_of_scope_request**：说明该任务超出当前 AI Context Pack 证据范围，并建议用户先查看 Human Manual 或真实安装后验证。
- **runtime_request**：给出安装前检查清单和命令来源，但不要替用户执行命令或声称已执行。
- **source_conflict**：同时展示冲突来源，标记为待核实，不要强行选择一个版本。

## Prompt Recipes

### 适配判断

- 目标：判断这个项目是否适合用户当前任务。
- 预期输出：适配结论、关键理由、证据引用、安装前可预览内容、必须安装后验证内容、下一步建议。

```text
请基于 xenon 的 AI Context Pack，先问我 3 个必要问题，然后判断它是否适合我的任务。回答必须包含：适合谁、能做什么、不能做什么、是否值得安装、证据来自哪里。所有项目事实必须引用 evidence_refs、source_paths 或 claim_id。
```

### 安装前体验

- 目标：让用户在安装前感受核心工作流，同时避免把预览包装成真实能力或营销承诺。
- 预期输出：一段带边界标签的体验剧本、安装后验证清单和谨慎建议；不含真实运行承诺或强营销表述。

```text
请把 xenon 当作安装前体验资产，而不是已安装工具或真实运行环境。

请严格输出四段：
1. 先问我 3 个必要问题。
2. 给出一段“体验剧本”：用 [安装前可预览]、[必须安装后验证]、[证据不足] 三种标签展示它可能如何引导工作流。
3. 给出安装后验证清单：列出哪些能力只有真实安装、真实宿主加载、真实项目运行后才能确认。
4. 给出谨慎建议：只能说“值得继续研究/试装”“先补充信息后再判断”或“不建议继续”，不得替项目背书。

硬性边界：
- 不要声称已经安装、运行、执行测试、修改文件或产生真实结果。
- 不要写“自动适配”“确保通过”“完美适配”“强烈建议安装”等承诺性表达。
- 如果描述安装后的工作方式，必须使用“如果安装成功且宿主正确加载 Skill，它可能会……”这种条件句。
- 体验剧本只能写成“示例台词/假设流程”：使用“可能会询问/可能会建议/可能会展示”，不要写“已写入、已生成、已通过、正在运行、正在生成”。
- Prompt Preview 不负责给安装命令；如用户准备试装，只能提示先阅读 Quick Start 和 Risk Card，并在隔离环境验证。
- 所有项目事实必须来自 supported claim、evidence_refs 或 source_paths；inferred/unverified 只能作风险或待确认项。

```

### 角色 / Skill 选择

- 目标：从项目里的角色或 Skill 中挑选最匹配的资产。
- 预期输出：候选角色或 Skill 列表，每项包含适用场景、证据路径、风险边界和是否需要安装后验证。

```text
请读取 role_skill_index，根据我的目标任务推荐 3-5 个最相关的角色或 Skill。每个推荐都要说明适用场景、可能输出、风险边界和 evidence_refs。
```

### 风险预检

- 目标：安装或引入前识别环境、权限、规则冲突和质量风险。
- 预期输出：环境、权限、依赖、许可、宿主冲突、质量风险和未知项的检查清单。

```text
请基于 risk_card、boundaries 和 quick_start_candidates，给我一份安装前风险预检清单。不要替我执行命令，只说明我应该检查什么、为什么检查、失败会有什么影响。
```

### 宿主 AI 开工指令

- 目标：把项目上下文转成一次对话开始前的宿主 AI 指令。
- 预期输出：一段边界明确、证据引用明确、适合复制给宿主 AI 的开工前指令。

```text
请基于 xenon 的 AI Context Pack，生成一段我可以粘贴给宿主 AI 的开工前指令。这段指令必须遵守 not_runtime=true，不能声称项目已经安装、运行或产生真实结果。
```

## 角色 / Skill 索引

- 共索引 37 个角色 / Skill / 项目文档条目。

- **快速开始**（project_doc）：面向实验、学习和社区协作的可扩展终端 AI 编程 Agent 试验场。 激活提示：当用户需要理解项目结构、安装方式或边界时参考。 证据：`README.md`
- **SWE-bench Lite engine-matrix smoke partial**（project_doc）：SWE-bench Lite engine-matrix smoke partial 激活提示：当用户需要理解项目结构、安装方式或边界时参考。 证据：`evals/reports/official/swebench-lite/2026-07-28-engine-matrix-smoke/README.md`
- **Official SWE-bench Lite smoke**（project_doc）：This is an official evaluator run, not Xenon's internal fixture score. 激活提示：当用户需要理解项目结构、安装方式或边界时参考。 证据：`evals/reports/official/swebench-lite/2026-07-28-react-smoke/README.md`
- **Root-fix official runtime smoke**（project_doc）：This is one infrastructure acceptance run, not a SWE-bench Lite score and not an all-engine matrix result. 激活提示：当用户需要理解项目结构、安装方式或边界时参考。 证据：`evals/reports/official/swebench-lite/2026-07-28-rootfix-react/README.md`
- **Archived Code Preview calibration — not a benchmark result**（project_doc）：Archived Code Preview calibration — not a benchmark result 激活提示：当用户需要理解项目结构、安装方式或边界时参考。 证据：`evals/reports/official/swebench-lite/2026-07-29-engine-matrix-code-preview/README.md`
- **Xenon SWE-bench Lite engine matrix — DeepSeek official V4 Pro**（project_doc）：Xenon SWE-bench Lite engine matrix — DeepSeek official V4 Pro 激活提示：当用户需要理解项目结构、安装方式或边界时参考。 证据：`evals/reports/official/swebench-lite/2026-07-29-engine-matrix-deepseek-official-v4-pro/README.md`
- **Archived infrastructure calibration — not a benchmark result**（project_doc）：Archived infrastructure calibration — not a benchmark result 激活提示：当用户需要理解项目结构、安装方式或边界时参考。 证据：`evals/reports/official/swebench-lite/2026-07-29-engine-matrix/README.md`
- **Xenon SWE-bench Lite seven-engine calibration — combined-engine root fix**（project_doc）：Xenon SWE-bench Lite seven-engine calibration — combined-engine root fix 激活提示：当用户需要理解项目结构、安装方式或边界时参考。 证据：`evals/reports/official/swebench-lite/2026-07-29-seven-engine-combined-rootfix-deepseek-official-v4-pro/README.md`
- **Xenon official SWE-bench Lite calibration — three instances, seven engines**（project_doc）：Xenon official SWE-bench Lite calibration — three instances, seven engines 激活提示：当用户需要理解项目结构、安装方式或边界时参考。 证据：`evals/reports/official/swebench-lite/2026-07-29-three-instance-seven-engine-deepseek-official-v4-pro/README.md`
- **CLAUDE.md — Xenon 项目规范**（project_doc）：当发现一个 bug 时， 不要 只修复眼前的症状。必须追溯数据流全链路， 找到系统性根因，然后 一次性修复所有同类问题 。 激活提示：当用户需要理解项目结构、安装方式或边界时参考。 证据：`CLAUDE.md`
- **Xenon Agent Skills**（project_doc）：Xenon 同时支持标准目录式 Agent Skill 和早期的 YAML 配方。标准技能可直接复用 Claude Code、Codex、Ark CLI 等生态常见的 SKILL.md 结构；旧技能无需迁移。 激活提示：当用户需要理解项目结构、安装方式或边界时参考。 证据：`docs/AGENT_SKILLS.md`
- **Xenon 架构设计**（project_doc）：设计哲学：让开发者可靠、透明、低成本地使用 DeepSeek。 核心抽象围绕缓存经济效益、工具权限、用户治理记忆和失败恢复设计。 激活提示：当用户需要理解项目结构、安装方式或边界时参考。 证据：`docs/ARCHITECTURE.md`
- **DeepSeek 收录准备与兼容性证据**（project_doc）：本文用于维护向 DeepSeek 官方 GitHub 组织的 awesome-deepseek-agent https://github.com/deepseek-ai/awesome-deepseek-agent 提交的 Xenon 集成指南 PR 301 https://github.com/deepseek-ai/awesome-deepseek-agent/pull/301 。 进入该清单表示“被官方仓库收录为社区集成”，不等同于“DeepSeek 官方指定工具”。 激活提示：当用户需要理解项目结构、安装方式或边界时参考。 证据：`docs/DEEPSEEK_INTEGRATION.md`
- **Xenon — Quick Start Guide**（project_doc）：A local-first AI coding assistant with 8 reasoning paradigms, 20+ built-in tools, and DeepSeek cache cost optimization. 激活提示：当用户需要理解项目结构、安装方式或边界时参考。 证据：`docs/GUIDE.md`
- **Xenon 外部集成 CLI**（project_doc）：Xenon 为 Ark CLI、安装脚本和其他 Agent 管理器提供独立于交互式 REPL 的稳定命令。 这些命令不启动模型、不探测网络；传入 --json 后，stdout 只输出一个 JSON 对象， 错误说明和普通日志不会混入结构化结果。 激活提示：当用户需要理解项目结构、安装方式或边界时参考。 证据：`docs/INTEGRATIONS.md`
- **Xenon 操作手册**（project_doc）：1. 安装与配置 1-安装与配置 2. 快速开始 2-快速开始 3. 交互模式 REPL 3-交互模式-repl 4. 斜杠命令参考 4-斜杠命令参考 5. 批量执行模式 5-批量执行模式 6. YAML 工作流配置 6-yaml-工作流配置 7. 思考范式说明 7-思考范式说明 8. 常见用法示例 8-常见用法示例 9. 故障排除 9-故障排除 激活提示：当用户需要理解项目结构、安装方式或边界时参考。 证据：`docs/OPERATION_GUIDE.md`
- **DeepSeek 缓存最佳实践指南**（project_doc）：让每一次 API 调用都尽可能命中缓存。本文价格按 DeepSeek 中文官方文档于 2026-07-21 核对。 激活提示：当用户需要理解项目结构、安装方式或边界时参考。 证据：`docs/deepseek-guide.md`
- **贡献指南**（project_doc）：感谢你关注 Xenon。Xenon 是一个面向终端和编程任务的开源 AI Agent 工作区，欢迎提交问题、文档改进和代码贡献。 激活提示：当用户需要理解项目结构、安装方式或边界时参考。 证据：`CONTRIBUTING.md`
- **Volcengine Ark Provider**（project_doc）：Xenon exposes Volcengine Ark as the stable provider identity ark . It uses the official OpenAI-compatible data plane for text chat, streaming, structured outputs, and native function calling. 激活提示：当用户需要理解项目结构、安装方式或边界时参考。 证据：`docs/ARK_PROVIDER.md`
- **Xenon 整体代码审查：死代码与 Bug**（project_doc）：本次审查覆盖 xenon/engine 、 xenon/repl 、 xenon/utils 及对应测试，重点追踪 用户反馈的长任务中断、格式重试异常和 Ctrl+O 无响应。 激活提示：当用户需要理解项目结构、安装方式或边界时参考。 证据：`docs/CODE_AUDIT_2026-07-29.md`
- **Xenon vs Aider / Claude Code / OpenCode / Crush**（project_doc）：Xenon vs Aider / Claude Code / OpenCode / Crush 激活提示：当用户需要理解项目结构、安装方式或边界时参考。 证据：`docs/COMPARISON.md`
- **Xenon 评测结果**（project_doc）：真实模型跑 ReAct 多轮闭环（方案 C 修复后），按 实际执行 的工具评分（ expected tools ⊆ executed 且 final answer 非空）。 数据生成：2026-07-08 10:10 UTC，DeepSeek-V4-Pro via 火山方舟。 不 美化、不补全——这是真证据。 基线状态： 本文记录的是历史 v0.7.2/v2 跑测，不是 v0.7.3 当前成功率。 v0.7.3 的真实评测需要在明确的供应商凭证、模型、费用和隔离工作目录下重新执行； 在重跑前，不应把 45.0% 当作当前版本指标。 激活提示：当用户需要理解项目结构、安装方式或边界时参考。 证据：`docs/EVAL_RESULTS.md`
- **Gitee 国内社区入口**（project_doc）：Xenon 采用“GitHub 主仓库 + Gitee 国内镜像”的协作方式： 激活提示：当用户需要理解项目结构、安装方式或边界时参考。 证据：`docs/GITEE.md`
- **Xenon v0.7.3**（project_doc）：Xenon v0.7.3 是一个面向 DeepSeek 的终端 AI 编程工作区，提供多模型对话、工具执行、自动路由、持久记忆和会话恢复。 激活提示：当用户需要理解项目结构、安装方式或边界时参考。 证据：`docs/GITEE_RELEASE_v0.7.3.md`
- **llms.txt-first documentation retrieval**（project_doc）：llms.txt-first documentation retrieval 激活提示：当用户需要理解项目结构、安装方式或边界时参考。 证据：`docs/LLMS_TXT_RETRIEVAL.md`
- **Xenon Memory System v2**（project_doc）：Status: production-oriented local backend implemented in Xenon 0.6.x. 激活提示：当用户需要理解项目结构、安装方式或边界时参考。 证据：`docs/MEMORY_SYSTEM_SPEC.md`
- **Xenon 发布验收清单**（project_doc）：这份清单用于在创建 GitHub Release 或提交外部生态收录前，重复验证当前版本。除非特别注明，真实供应商测试不进入默认 CI。 激活提示：当用户需要理解项目结构、安装方式或边界时参考。 证据：`docs/RELEASE_ACCEPTANCE.md`
- **Xenon TUI 设计与操作说明**（project_doc）：TUI 是 Xenon 的展示与交互层，不改变底层的模型路由、7 种推理引擎、工具执行管线或上下文管理方式。v0.7.0 减少边框和辅助信息对正文的干扰，并修复折叠详情重绘导致的界面错位，让输入、回复和运行状态具有稳定的视觉位置。 激活提示：当用户需要理解项目结构、安装方式或边界时参考。 证据：`docs/TUI.md`
- **Xenon 完整审查报告（2026-07-27）**（project_doc）：Xenon 当前不应被判定为“通用任务正确率只有 45%”。现有 45% 和 55% 两次真实跑测是评测框架的工具闭环代理分数，不是端到端正确率；它们不能直接代表日常使用成功率，也不能与用户实际体验作一一对应。 激活提示：当用户需要理解项目结构、安装方式或边界时参考。 证据：`docs/XENON_AUDIT_2026-07-27.md`
- **Xenon 外部 Benchmark 运行边界**（project_doc）：外部 benchmark 与 Xenon 内部回归评测是两层结果，不能互相替代。 激活提示：当用户需要理解项目结构、安装方式或边界时参考。 证据：`docs/XENON_BENCHMARK_CATALOG.md`
- **Xenon 评测闭环**（project_doc）：- ReAct / 工具评测： evals/tasks.yaml 。模型在隔离 fixture 中完成自然语言任务；工具成功必须由 ToolExecuteResult.success 和终态确认，不能只按工具名计数。 - Xenon REPL 命令评测： evals/repl tasks.yaml 。通过真实 REPL command dispatcher 执行 /help 、 /mode 等斜杠命令，单独报告结果断言。 激活提示：当用户需要理解项目结构、安装方式或边界时参考。 证据：`docs/XENON_EVAL_PROTOCOL.md`
- **Xenon 差距分析与改进建议**（project_doc）：历史审计快照，不代表当前版本状态。 本文基于 2026-07-03 的旧代码生成，其中多项缺口已在 v0.7.0 修复。当前 DeepSeek 兼容性、官方收录准备与剩余风险请以 DeepSeek 集成与收录准备 DEEPSEEK INTEGRATION.md 和 CHANGELOG ../CHANGELOG.md 为准。 激活提示：当用户需要理解项目结构、安装方式或边界时参考。 证据：`docs/差距分析与改进建议.md`
- **从零构建 AI Agent：6 个让我重新理解"智能体"的工程决策**（project_doc）：19K 行 Python，12 家模型商，7 种推理范式，1000+ 测试。这不是一篇"我做了个 AI 编程助手"的软文——这是我在构建过程中遇到的 6 个非直觉工程问题，以及为什么标准答案不总是对的。 激活提示：当用户需要理解项目结构、安装方式或边界时参考。 证据：`docs/articles/01-six-engineering-decisions.md`
- **Xenon 发布物料**（project_doc）：文章： docs/articles/01-six-engineering-decisions.md 激活提示：当用户需要理解项目结构、安装方式或边界时参考。 证据：`docs/articles/PUBLISHING_PLAN.md`
- **Xenon Star Core v2 — visual proposal**（project_doc）：Xenon Star Core v2 — visual proposal 激活提示：当用户需要理解项目结构、安装方式或边界时参考。 证据：`docs/assets/xenon-star-core-v2.md`
- **REPL 真实任务端到端测试报告**（project_doc）：测试对象： xenon/repl/repl.py （未提交改动： repl.py:718/784/1052 query 路由修复） 测试范围：A-N 14 类场景 + coordinator 关注点 1-7 + 已知可疑点 1-7 测试入口： tests/test repl real tasks.py （共 84 个测试， 80 通过 / 4 失败 ） 测试环境： XENON ASSUME YES=1 （conftest 自动）， engine.base.chat completion + utils.llm client.chat completion stream 全 mock 报告日期：2026-07-07 仓库分支： ubutnu （v0.2.0 之后） 激活提示：当用户需要理解项目结构、安装方式或边界时参考。 证据：`docs/reports/v0.2.2/REAL_TASK_TEST_REPORT.md`
- **修复验证报告 Verification Report**（project_doc）：日期 : 2026-07-08 分支 : ubutnu 验证者 : 独立验证 agent（不依赖修复 agent 自我报告） 验证范围 : 7 个 commit 修复的 6 个 bug + commit 质量 + 测试基线 激活提示：当用户需要理解项目结构、安装方式或边界时参考。 证据：`docs/reports/v0.2.2/VERIFICATION_REPORT.md`

## 证据索引

- 共索引 77 条证据。

- **快速开始**（documentation）：面向实验、学习和社区协作的可扩展终端 AI 编程 Agent 试验场。 证据：`README.md`
- **SWE-bench Lite engine-matrix smoke partial**（documentation）：SWE-bench Lite engine-matrix smoke partial 证据：`evals/reports/official/swebench-lite/2026-07-28-engine-matrix-smoke/README.md`
- **Official SWE-bench Lite smoke**（documentation）：This is an official evaluator run, not Xenon's internal fixture score. 证据：`evals/reports/official/swebench-lite/2026-07-28-react-smoke/README.md`
- **Root-fix official runtime smoke**（documentation）：This is one infrastructure acceptance run, not a SWE-bench Lite score and not an all-engine matrix result. 证据：`evals/reports/official/swebench-lite/2026-07-28-rootfix-react/README.md`
- **Archived Code Preview calibration — not a benchmark result**（documentation）：Archived Code Preview calibration — not a benchmark result 证据：`evals/reports/official/swebench-lite/2026-07-29-engine-matrix-code-preview/README.md`
- **Xenon SWE-bench Lite engine matrix — DeepSeek official V4 Pro**（documentation）：Xenon SWE-bench Lite engine matrix — DeepSeek official V4 Pro 证据：`evals/reports/official/swebench-lite/2026-07-29-engine-matrix-deepseek-official-v4-pro/README.md`
- **Archived infrastructure calibration — not a benchmark result**（documentation）：Archived infrastructure calibration — not a benchmark result 证据：`evals/reports/official/swebench-lite/2026-07-29-engine-matrix/README.md`
- **Xenon SWE-bench Lite seven-engine calibration — combined-engine root fix**（documentation）：Xenon SWE-bench Lite seven-engine calibration — combined-engine root fix 证据：`evals/reports/official/swebench-lite/2026-07-29-seven-engine-combined-rootfix-deepseek-official-v4-pro/README.md`
- **Xenon official SWE-bench Lite calibration — three instances, seven engines**（documentation）：Xenon official SWE-bench Lite calibration — three instances, seven engines 证据：`evals/reports/official/swebench-lite/2026-07-29-three-instance-seven-engine-deepseek-official-v4-pro/README.md`
- **CLAUDE.md — Xenon 项目规范**（documentation）：当发现一个 bug 时， 不要 只修复眼前的症状。必须追溯数据流全链路， 找到系统性根因，然后 一次性修复所有同类问题 。 证据：`CLAUDE.md`
- **Xenon Agent Skills**（documentation）：Xenon 同时支持标准目录式 Agent Skill 和早期的 YAML 配方。标准技能可直接复用 Claude Code、Codex、Ark CLI 等生态常见的 SKILL.md 结构；旧技能无需迁移。 证据：`docs/AGENT_SKILLS.md`
- **Xenon 架构设计**（documentation）：设计哲学：让开发者可靠、透明、低成本地使用 DeepSeek。 核心抽象围绕缓存经济效益、工具权限、用户治理记忆和失败恢复设计。 证据：`docs/ARCHITECTURE.md`
- **DeepSeek 收录准备与兼容性证据**（documentation）：本文用于维护向 DeepSeek 官方 GitHub 组织的 awesome-deepseek-agent https://github.com/deepseek-ai/awesome-deepseek-agent 提交的 Xenon 集成指南 PR 301 https://github.com/deepseek-ai/awesome-deepseek-agent/pull/301 。 进入该清单表示“被官方仓库收录为社区集成”，不等同于“DeepSeek 官方指定工具”。 证据：`docs/DEEPSEEK_INTEGRATION.md`
- **Xenon — Quick Start Guide**（documentation）：A local-first AI coding assistant with 8 reasoning paradigms, 20+ built-in tools, and DeepSeek cache cost optimization. 证据：`docs/GUIDE.md`
- **Xenon 外部集成 CLI**（documentation）：Xenon 为 Ark CLI、安装脚本和其他 Agent 管理器提供独立于交互式 REPL 的稳定命令。 这些命令不启动模型、不探测网络；传入 --json 后，stdout 只输出一个 JSON 对象， 错误说明和普通日志不会混入结构化结果。 证据：`docs/INTEGRATIONS.md`
- **Xenon 操作手册**（documentation）：1. 安装与配置 1-安装与配置 2. 快速开始 2-快速开始 3. 交互模式 REPL 3-交互模式-repl 4. 斜杠命令参考 4-斜杠命令参考 5. 批量执行模式 5-批量执行模式 6. YAML 工作流配置 6-yaml-工作流配置 7. 思考范式说明 7-思考范式说明 8. 常见用法示例 8-常见用法示例 9. 故障排除 9-故障排除 证据：`docs/OPERATION_GUIDE.md`
- **DeepSeek 缓存最佳实践指南**（documentation）：让每一次 API 调用都尽可能命中缓存。本文价格按 DeepSeek 中文官方文档于 2026-07-21 核对。 证据：`docs/deepseek-guide.md`
- **贡献指南**（documentation）：感谢你关注 Xenon。Xenon 是一个面向终端和编程任务的开源 AI Agent 工作区，欢迎提交问题、文档改进和代码贡献。 证据：`CONTRIBUTING.md`
- **License**（source_file）：Permission is hereby granted, free of charge, to any person obtaining a copy of this software and associated documentation files the "Software" , to deal in the Software without restriction, including without limitation the rights to use, copy, modify, merge, publish, distribute, sublicense, and/or sell copies of the Software, and to permit persons to whom the Software is furnished to do so, subject to the following conditions: 证据：`LICENSE`
- **Volcengine Ark Provider**（documentation）：Xenon exposes Volcengine Ark as the stable provider identity ark . It uses the official OpenAI-compatible data plane for text chat, streaming, structured outputs, and native function calling. 证据：`docs/ARK_PROVIDER.md`
- **Xenon 整体代码审查：死代码与 Bug**（documentation）：本次审查覆盖 xenon/engine 、 xenon/repl 、 xenon/utils 及对应测试，重点追踪 用户反馈的长任务中断、格式重试异常和 Ctrl+O 无响应。 证据：`docs/CODE_AUDIT_2026-07-29.md`
- **Xenon vs Aider / Claude Code / OpenCode / Crush**（documentation）：Xenon vs Aider / Claude Code / OpenCode / Crush 证据：`docs/COMPARISON.md`
- **Xenon 评测结果**（documentation）：真实模型跑 ReAct 多轮闭环（方案 C 修复后），按 实际执行 的工具评分（ expected tools ⊆ executed 且 final answer 非空）。 数据生成：2026-07-08 10:10 UTC，DeepSeek-V4-Pro via 火山方舟。 不 美化、不补全——这是真证据。 基线状态： 本文记录的是历史 v0.7.2/v2 跑测，不是 v0.7.3 当前成功率。 v0.7.3 的真实评测需要在明确的供应商凭证、模型、费用和隔离工作目录下重新执行； 在重跑前，不应把 45.0% 当作当前版本指标。 证据：`docs/EVAL_RESULTS.md`
- **Gitee 国内社区入口**（documentation）：Xenon 采用“GitHub 主仓库 + Gitee 国内镜像”的协作方式： 证据：`docs/GITEE.md`
- **Xenon v0.7.3**（documentation）：Xenon v0.7.3 是一个面向 DeepSeek 的终端 AI 编程工作区，提供多模型对话、工具执行、自动路由、持久记忆和会话恢复。 证据：`docs/GITEE_RELEASE_v0.7.3.md`
- **llms.txt-first documentation retrieval**（documentation）：llms.txt-first documentation retrieval 证据：`docs/LLMS_TXT_RETRIEVAL.md`
- **Xenon Memory System v2**（documentation）：Status: production-oriented local backend implemented in Xenon 0.6.x. 证据：`docs/MEMORY_SYSTEM_SPEC.md`
- **Xenon 发布验收清单**（documentation）：这份清单用于在创建 GitHub Release 或提交外部生态收录前，重复验证当前版本。除非特别注明，真实供应商测试不进入默认 CI。 证据：`docs/RELEASE_ACCEPTANCE.md`
- **Xenon TUI 设计与操作说明**（documentation）：TUI 是 Xenon 的展示与交互层，不改变底层的模型路由、7 种推理引擎、工具执行管线或上下文管理方式。v0.7.0 减少边框和辅助信息对正文的干扰，并修复折叠详情重绘导致的界面错位，让输入、回复和运行状态具有稳定的视觉位置。 证据：`docs/TUI.md`
- **Xenon 完整审查报告（2026-07-27）**（documentation）：Xenon 当前不应被判定为“通用任务正确率只有 45%”。现有 45% 和 55% 两次真实跑测是评测框架的工具闭环代理分数，不是端到端正确率；它们不能直接代表日常使用成功率，也不能与用户实际体验作一一对应。 证据：`docs/XENON_AUDIT_2026-07-27.md`
- **Xenon 外部 Benchmark 运行边界**（documentation）：外部 benchmark 与 Xenon 内部回归评测是两层结果，不能互相替代。 证据：`docs/XENON_BENCHMARK_CATALOG.md`
- **Xenon 评测闭环**（documentation）：- ReAct / 工具评测： evals/tasks.yaml 。模型在隔离 fixture 中完成自然语言任务；工具成功必须由 ToolExecuteResult.success 和终态确认，不能只按工具名计数。 - Xenon REPL 命令评测： evals/repl tasks.yaml 。通过真实 REPL command dispatcher 执行 /help 、 /mode 等斜杠命令，单独报告结果断言。 证据：`docs/XENON_EVAL_PROTOCOL.md`
- **Xenon 差距分析与改进建议**（documentation）：历史审计快照，不代表当前版本状态。 本文基于 2026-07-03 的旧代码生成，其中多项缺口已在 v0.7.0 修复。当前 DeepSeek 兼容性、官方收录准备与剩余风险请以 DeepSeek 集成与收录准备 DEEPSEEK INTEGRATION.md 和 CHANGELOG ../CHANGELOG.md 为准。 证据：`docs/差距分析与改进建议.md`
- **从零构建 AI Agent：6 个让我重新理解"智能体"的工程决策**（documentation）：19K 行 Python，12 家模型商，7 种推理范式，1000+ 测试。这不是一篇"我做了个 AI 编程助手"的软文——这是我在构建过程中遇到的 6 个非直觉工程问题，以及为什么标准答案不总是对的。 证据：`docs/articles/01-six-engineering-decisions.md`
- **Xenon 发布物料**（documentation）：文章： docs/articles/01-six-engineering-decisions.md 证据：`docs/articles/PUBLISHING_PLAN.md`
- **Xenon Star Core v2 — visual proposal**（documentation）：Xenon Star Core v2 — visual proposal 证据：`docs/assets/xenon-star-core-v2.md`
- **REPL 真实任务端到端测试报告**（documentation）：测试对象： xenon/repl/repl.py （未提交改动： repl.py:718/784/1052 query 路由修复） 测试范围：A-N 14 类场景 + coordinator 关注点 1-7 + 已知可疑点 1-7 测试入口： tests/test repl real tasks.py （共 84 个测试， 80 通过 / 4 失败 ） 测试环境： XENON ASSUME YES=1 （conftest 自动）， engine.base.chat completion + utils.llm client.chat completion stream 全 mock 报告日期：2026-07-07 仓库分支： ubutnu （v0.2.0 之后） 证据：`docs/reports/v0.2.2/REAL_TASK_TEST_REPORT.md`
- **修复验证报告 Verification Report**（documentation）：日期 : 2026-07-08 分支 : ubutnu 验证者 : 独立验证 agent（不依赖修复 agent 自我报告） 验证范围 : 7 个 commit 修复的 6 个 bug + commit 质量 + 测试基线 证据：`docs/reports/v0.2.2/VERIFICATION_REPORT.md`
- **Mock Agent**（source_file）：def estimate tokens text: str - int ⋮---- ascii words = len part for part in text.split if part cjk chars = sum 1 for ch in text if "\u4e00" dict str, Any ⋮---- expected tools = list task.get "expected tools", prompt = str task.get "prompt", "" token count = estimate tokens prompt + 80 + len expected tools 12 证据：`evals/mock_agent.py`
- **Ruff 0.16 changes the default rule set and turns the existing warning**（source_file）：build-system requires = "setuptools =77.0", "wheel" build-backend = "setuptools.build meta" 证据：`pyproject.toml`
- **Init**（source_file）：version = "0.7.3" 证据：`xenon/__init__.py`
- **Integration Cli**（source_file）：MCP NAME RE = re.compile r"^ A-Za-z0-9 A-Za-z0-9 .- {0,63}$" CONFIG BYTES = 256 1024 ⋮---- class IntegrationUsageError ValueError ⋮---- """The requested integration command has invalid CLI syntax.""" ⋮---- class ArgumentParser argparse.ArgumentParser ⋮---- """ArgumentParser that reports errors through Xenon's JSON contract.""" ⋮---- def error self, message: str - None ⋮---- @dataclass frozen=True class IntegrationContext ⋮---- """Filesystem boundaries used by the non-interactive CLI.""" ⋮---- home: Path project root: Path None credentials path: Path ⋮---- resolved home = home or Path.home .expanduser .resolve resolved project = ⋮---- context = IntegrationContext.resolve ⋮---- def manager co… 证据：`xenon/integration_cli.py`
- **配置日志**（source_file）：kernel32 = ctypes.windll.kernel32 ⋮---- console = Console ⋮---- class DimNetworkFormatter logging.Formatter ⋮---- DIM LOGGERS = "httpx", "httpcore", "openai" ⋮---- def format self, record: logging.LogRecord - str ⋮---- rendered = super .format record ⋮---- def cli - None ⋮---- exit code = run integration cli sys.argv 1: ⋮---- parser = argparse.ArgumentParser ⋮---- args = parser.parse args ⋮---- 配置日志 log level = logging.DEBUG if args.verbose else logging.INFO log handler = logging.StreamHandler ⋮---- cmd = args.command or workflow ⋮---- workflow = args.workflow path ⋮---- sub = args.workflow path ⋮---- def cmd chat args: argparse.Namespace - None ⋮---- def cmd models import args: argparse.Na… 证据：`xenon/main.py`
- **F6: 协作式中断标志，外部调 interrupt 后 run 在下一轮退出**（source_file）：logger = logging.getLogger name ⋮---- class BaseEngine ABC ⋮---- observation truncate: int = 2000 ⋮---- model id = getattr config, "model id", "" ⋮---- self.model pool = model pool v0.4.0 self.auto router = auto router v0.4.0 Step 13 self.permission gate = permission gate v0.5.0 F6: 协作式中断标志，外部调 interrupt 后 run 在下一轮退出 ⋮---- F4: 本次 run 注入的 ContextManager（run 起点设置，供 history messages 消费） ⋮---- Last run's verified tool trace, exposed to the REPL for cross-turn persistence. Engines without tools leave it as None. ⋮---- P3-Q2: 链路追踪 ID——每次 run 起点生成，贯穿该 run 内所有 call llm 调用与 fallback；调试多模型失败时可把散落日志串成一条链（§8.8.4）。 ⋮---- Native function-calling 的协议消息。pending 供当前工具执行轮消费； last provider messages 供 REPL 按原协… 证据：`xenon/engine/base.py`
- **Circuit Breaker**（source_file）：class CircuitBreaker ⋮---- CLOSED = "closed" OPEN = "open" HALF OPEN = "half open" ⋮---- def allow self - bool ⋮---- def record success self - None ⋮---- def record failure self - None ⋮---- def open self, , doubled: bool - None ⋮---- class BreakerRegistry ⋮---- def init self, breaker kwargs - None ⋮---- def get self, tool name: str - CircuitBreaker ⋮---- b = self. breakers.get tool name ⋮---- b = CircuitBreaker self. breaker kwargs ⋮---- def reset self - None ⋮---- GLOBAL BREAKERS = BreakerRegistry 证据：`xenon/engine/circuit_breaker.py`
- **A reviewer score cannot certify a write task when no mutating tool**（source_file）：logger = logging.getLogger name ⋮---- TEST STEP = re.compile r"测试 验证 回归 test verify check lint", re.IGNORECASE SUMMARY STEP = re.compile r"总结 汇总 报告 说明 summary report", re.IGNORECASE INSPECT STEP = re.compile IMPLEMENT STEP = re.compile PATH IN TEXT = re.compile ⋮---- def isolated ctx ctx: AgentContext - AgentContext ⋮---- """Copy durable conversation/checkpoint links, never phase-local store state.""" ⋮---- fresh = AgentContext ⋮---- def merge tracker target: ToolExecutionTracker, source: ToolExecutionTracker None - None ⋮---- def step kind task: str - str ⋮---- def planned paths step: dict str, Any - set str ⋮---- paths = set PATH IN TEXT.findall str step.get "task", "" params = step.get "… 证据：`xenon/engine/combined_engines.py`
- **Plan Dag**（source_file）：logger = logging.getLogger name ⋮---- class PlanDAGCycleError ValueError ⋮---- def canon value: Any - Any ⋮---- s = value.strip ⋮---- class PlanDAG ⋮---- def init self, steps: list dict str, Any - None ⋮---- def build self - None ⋮---- known: set Any = set ⋮---- sid = canon s.get "id" ⋮---- raw deps = s.get "depends on" or ⋮---- raw deps = raw deps norm: list Any = seen: set Any = set ⋮---- cd = canon d ⋮---- @property def has edges self - bool ⋮---- @property def step ids self - list Any ⋮---- def dependency map self - dict Any, list Any ⋮---- def step self, sid: Any - dict str, Any ⋮---- def waves self - list list Any ⋮---- in deg = {sid: len self. deps sid for sid in self. ids} dependent… 证据：`xenon/engine/plan_dag.py`
- **Phase 2: Execution**（source_file）：logger = logging.getLogger name ⋮---- @dataclass frozen=True class StepOutcome ⋮---- content: str success: bool error: str None = None ⋮---- PLAN SYSTEM PROMPT = """你是一个任务规划专家。将用户任务分解为可执行的原子步骤。 ⋮---- EXECUTE PROMPT = """你正在执行一个任务计划的第 {step id} 步（共 {total steps} 步）。 ⋮---- MINI REACT PROMPT = """你正在执行任务计划的第 {step id} 步（共 {total steps} 步），采用 ReAct（思考-行动-观察）模式，最多 {max rounds} 轮。 ⋮---- class PlanExecuteEngine BaseEngine ⋮---- @staticmethod def build plan prompt - str ⋮---- shell name = "PowerShell" shell examples = "如 mkdir, copy, Get-ChildItem" shell avoid = "ls, cat, mkdir -p 等 Linux 命令" ⋮---- shell name = "bash" shell examples = "如 ls, cat, mkdir -p, grep, find" shell avoid = "PowerShell 命令（如… 证据：`xenon/engine/plan_execute_engine.py`
- **F1: 工具执行门面（7 阶段流水线：校验/断路器/重试/封装）**（source_file）：logger = logging.getLogger name ⋮---- REACT SYSTEM PROMPT = """你是一个 ReAct 模式的 AI 编程助手。你通过 思考-行动-观察 的循环来解决问题。 ⋮---- BUILTIN TOOLS = { ⋮---- class ReActEngine BaseEngine ⋮---- F1: 工具执行门面（7 阶段流水线：校验/断路器/重试/封装） Bind the engine's shared policy at construction time. Relying on a later graph-wide bind execution policy call left directly-created engines with an unbounded tool executor. ⋮---- F2: 空洞回答检测器（无状态，实例共享） ⋮---- F5: DeepSeek V4 的思考模式工具协议已经单元测试和真实 API 闭环验证，因此在它作为主模型时自动开启原生 function calling。 其他模型仍保持关闭，调用方也可显式传入 True/False 覆盖。 ⋮---- primary = model priority 0 .lower if model priority else "" V4's native function-calling protocol is a model capability, not an endpoint-prefix capability. Ark and… 证据：`xenon/engine/react_engine.py`
- **§8.23.4/10 / E4：版本回退——跟踪历史最佳（按 score）输出。**（source_file）：logger = logging.getLogger name ⋮---- EXECUTOR PROMPT = """你是一个专业的代码和技术执行者。请根据用户的需求生成高质量的输出。 ⋮---- REVIEWER PROMPT = """你是一个严格的质量审查员。请审查执行者的输出，判断是否满足用户需求。 ⋮---- class ReflectionEngine BaseEngine ⋮---- feedback = "" ⋮---- self. ctx mgr = ctx mgr F4 self. begin run P3-Q2: 链路追踪 ⋮---- §8.23.4/10 / E4：版本回退——跟踪历史最佳（按 score）输出。 若后续修正轮把输出改得更差（reviewer 误判越改越差，§8.23.10）， 最终返回最佳版本而非最后一轮。max rounds 耗尽且最佳未通过时标注。 best output: str None = None best score: int = -1 output: str = "" ⋮---- Execute（§8.23.8：执行失败兜底，返回已生成的部分输出而非冒泡） ⋮---- output = self. execute user input, feedback, context except Exception as e: noqa: BLE001 — 生成失败不应炸掉整个 reflection ⋮---- Review（§8.23.11：reviewer 用独立模型） review = self. review user… 证据：`xenon/engine/reflection_engine.py`
- **Scheduler**（source_file）：logger = logging.getLogger name ⋮---- class DAGScheduler ⋮---- def run self, context: AgentContext None = None - dict str, Any 证据：`xenon/engine/scheduler.py`
- **Tool Runtime**（source_file）：@dataclass frozen=True, slots=True class ToolRuntime ⋮---- workspace root: Path command prefix: tuple str, ... = backend workdir: str None = None command prelude: str = "" ⋮---- def post init self - None ⋮---- def translate path self, value: Any - Any ⋮---- backend = Path self.backend workdir candidate = Path value ⋮---- relative = candidate.relative to backend ⋮---- def bind tool runtime engine: Any, runtime: ToolRuntime - None ⋮---- executor = getattr node, " tool executor", None 证据：`xenon/engine/tool_runtime.py`
- **只显示关键参数**（source_file）：logger = logging.getLogger name ⋮---- @dataclass class ToolCall ⋮---- tool name: str params: dict str, Any success: bool result summary: str error: str None = None state: str = "" attempts: int = 1 elapsed seconds: float = 0.0 ⋮---- @dataclass class ToolExecutionTracker ⋮---- """追踪工具执行状态，供引擎验证。 用法: tracker = ToolExecutionTracker tracker.record "write file", {"file path": "x.py"}, True, "写入 100 字节" tracker.has executions tracker.execution summary 记录一次工具调用。""" call = ToolCall ⋮---- status = "成功" if success else "失败" ⋮---- def has executions self - bool ⋮---- """是否有任何工具被实际执行过。""" ⋮---- def has successful executions self - bool ⋮---- """是否有成功执行的工具调用。""" ⋮---- def successful tools self - list st… 证据：`xenon/engine/tool_tracker.py`
- **Init**（source_file）：all = "MCPClient", "MCPRegistry" 证据：`xenon/mcp/__init__.py`
- **Client**（source_file）：logger = logging.getLogger name ⋮---- class MCPClient ⋮---- transport = StdioTransport command, args, env ⋮---- transport = SSETransport url, headers, timeout=request timeout ⋮---- def initialize self - dict str, Any ⋮---- result = self. request "initialize", { ⋮---- def list tools self - list dict str, Any ⋮---- result = self. request "tools/list" ⋮---- def call tool self, name: str, arguments: dict str, Any None = None - dict str, Any ⋮---- params = {"name": name} ⋮---- result = self. request "tools/call", params ⋮---- def list resources self - list dict str, Any ⋮---- result = self. request "resources/list" ⋮---- def read resource self, uri: str - dict str, Any ⋮---- result = self. reque… 证据：`xenon/mcp/client.py`
- **先连接所有惰性服务器**（source_file）：logger = logging.getLogger name ⋮---- class MCPRegistry ⋮---- def init self - None ⋮---- client = MCPClient.from command command, args, env, name=name ⋮---- client = MCPClient.from url url, headers=headers, name=name ⋮---- """仅存储服务器配置，不立即连接（惰性模式）。 首次 discover tools 或 ensure connected name 时才真正启动子进程。 """ ⋮---- def ensure connected self, name: str None = None - None ⋮---- """确保指定或全部惰性服务器已连接。 Args: name: 服务器名，为 None 时连接全部惰性服务器 """ ⋮---- return 已连接或不存在 ⋮---- names to connect = name if name else list self. pending configs.keys ⋮---- cfg = self. pending configs.pop n, None ⋮---- def has pending servers self - bool ⋮---- """是否有尚未连接的惰性服务器。""" ⋮---- def get pending server names self - list str ⋮----… 证据：`xenon/mcp/registry.py`
- **等待响应（匹配 id），带墙钟 deadline 与行数上限**（source_file）：logger = logging.getLogger name ⋮---- class MCPTransport ⋮---- def send self, message: dict str, Any - None ⋮---- def receive self - dict str, Any ⋮---- def close self - None ⋮---- class StdioTransport MCPTransport ⋮---- def init self, command: str, args: list str None = None, env: dict str, str None = None - None ⋮---- def start self - None ⋮---- cmd = self.command + self.args ⋮---- child env = dict os.environ ⋮---- """发送 JSON-RPC 消息。""" ⋮---- data = json.dumps message + "\n" ⋮---- def receive self, timeout: float = 30.0 - dict str, Any ⋮---- """接收 JSON-RPC 消息（带墙钟超时，避免 readline 无限阻塞）。""" ⋮---- deadline = time.monotonic + timeout line = self. readline with timeout deadline ⋮---- stderr = se… 证据：`xenon/mcp/transport.py`
- **Init**（source_file）：all = 证据：`xenon/memory/__init__.py`
- **Backend**（source_file）：T = TypeVar " T" ⋮---- class MemoryBackend Protocol ⋮---- scope: MemoryScope root: Path ⋮---- def list records self, , include archived: bool = False - list MemoryRecord : ... def save records self, records: list MemoryRecord , , render: bool = True - None: ... ⋮---- def archive records self, records: list MemoryRecord - None: ... def destination for self, kind: MemoryKind - Path: ... ⋮---- KIND FILES = { ⋮---- class JsonMarkdownBackend ⋮---- VERSION = 2 ⋮---- def init self, root: Path, scope: MemoryScope, , private: bool = True - None ⋮---- @property def mode self - int ⋮---- def destination for self, kind: MemoryKind - Path ⋮---- def list records self, , include archived: bool = False - l… 证据：`xenon/memory/backend.py`
- **Candidate**（source_file）：SECRET PATTERNS = ⋮---- class MemoryCandidateDetector ⋮---- """Detect candidates without ever persisting them by itself.""" ⋮---- EXPLICIT PATTERNS = REFERENCE PATTERN = re.compile ⋮---- AUTO SIGNALS: tuple tuple re.Pattern str , str, MemoryKind , ... = ⋮---- def parse explicit self, text: str - MemoryProposal None ⋮---- """Parse an unambiguous user-authorized memory command.""" ⋮---- match = pattern.match text ⋮---- body = self. clean body match.group "body" body = self. remove scope words body ⋮---- def propose self, text: str - MemoryProposal None ⋮---- clean = text.strip ⋮---- def parse reference self, text: str - MemoryProposal None ⋮---- @staticmethod def contains secret text: str - b… 证据：`xenon/memory/candidate.py`
- 其余 17 条证据见 `AI_CONTEXT_PACK.json` 或 `EVIDENCE_INDEX.json`。

## 宿主 AI 必须遵守的规则

- **把本资产当作开工前上下文，而不是运行环境。**：AI Context Pack 只包含证据化项目理解，不包含目标项目的可执行状态。 证据：`README.md`, `evals/reports/official/swebench-lite/2026-07-28-engine-matrix-smoke/README.md`, `evals/reports/official/swebench-lite/2026-07-28-react-smoke/README.md`
- **回答用户时区分可预览内容与必须安装后才能验证的内容。**：安装前体验的消费者价值来自降低误装和误判，而不是伪装成真实运行。 证据：`README.md`, `evals/reports/official/swebench-lite/2026-07-28-engine-matrix-smoke/README.md`, `evals/reports/official/swebench-lite/2026-07-28-react-smoke/README.md`

## 用户开工前应该回答的问题

- 你准备在哪个宿主 AI 或本地环境中使用它？
- 你只是想先体验工作流，还是准备真实安装？
- 你最在意的是安装成本、输出质量、还是和现有规则的冲突？

## 验收标准

- 所有能力声明都能回指到 evidence_refs 中的文件路径。
- AI_CONTEXT_PACK.md 没有把预览包装成真实运行。
- 用户能在 3 分钟内看懂适合谁、能做什么、如何开始和风险边界。

---

## Doramagic Context Augmentation

下面内容用于强化 Repomix/AI Context Pack 主体。Human Manual 只提供阅读骨架；踩坑日志会被转成宿主 AI 必须遵守的工作约束。

## Human Manual 骨架

使用规则：这里只是项目阅读路线和显著性信号，不是事实权威。具体事实仍必须回到 repo evidence / Claim Graph。

宿主 AI 硬性规则：
- 不得把页标题、章节顺序、摘要或 importance 当作项目事实证据。
- 解释 Human Manual 骨架时，必须明确说它只是阅读路线/显著性信号。
- 能力、安装、兼容性、运行状态和风险判断必须引用 repo evidence、source path 或 Claim Graph。

- **项目概览与快速开始**：importance `high`
  - source_paths: README.md, docs/GUIDE.md, docs/OPERATION_GUIDE.md, pyproject.toml, xenon/main.py
- **系统架构总览**：importance `high`
  - source_paths: docs/ARCHITECTURE.md, xenon/engine/base.py, xenon/nodes/base.py, xenon/repl/session.py, xenon/__init__.py
- **执行引擎与推理范式**：importance `high`
  - source_paths: xenon/engine/react_engine.py, xenon/engine/plan_execute_engine.py, xenon/engine/reflection_engine.py, xenon/engine/combined_engines.py, xenon/engine/plan_dag.py
- **Cache Rails 与提示词缓存**：importance `high`
  - source_paths: xenon/utils/deepseek_cache.py, xenon/utils/cache_telemetry.py, xenon/utils/prompt_compiler.py, xenon/utils/token_estimate.py, docs/deepseek-guide.md
- **用户治理记忆系统**：importance `high`
  - source_paths: xenon/memory/service.py, xenon/memory/models.py, xenon/memory/registry.py, xenon/memory/retrieval.py, xenon/memory/candidate.py
- **终端交互界面与命令系统**：importance `medium`
  - source_paths: xenon/repl/repl.py, xenon/repl/commands.py, xenon/repl/status_bar.py, xenon/repl/input_buffer.py, xenon/repl/shortcut_manager.py
- **MCP 与 Agent Skills 生态**：importance `high`
  - source_paths: xenon/mcp/client.py, xenon/mcp/registry.py, xenon/mcp/transport.py, xenon/integration_cli.py, docs/AGENT_SKILLS.md
- **工具系统、安全与模型路由**：importance `high`
  - source_paths: xenon/nodes/tool_registry.py, xenon/nodes/tool_node.py, xenon/nodes/tool_executor.py, xenon/engine/tool_runtime.py, xenon/engine/circuit_breaker.py

## Repo Inspection Evidence / 源码检查证据

- repo_clone_verified: true
- repo_inspection_verified: true
- repo_commit: `4a90024c6d15b2d909903cdcbb59066b42017d75`
- inspected_files: `README.md`, `pyproject.toml`, `docs/AGENT_SKILLS.md`, `docs/ARCHITECTURE.md`, `docs/ARK_PROVIDER.md`, `docs/CODE_AUDIT_2026-07-29.md`, `docs/COMPARISON.md`, `docs/DEEPSEEK_INTEGRATION.md`, `docs/EVAL_RESULTS.md`, `docs/GITEE.md`, `docs/GITEE_RELEASE_v0.7.3.md`, `docs/GUIDE.md`, `docs/INTEGRATIONS.md`, `docs/LLMS_TXT_RETRIEVAL.md`, `docs/MEMORY_SYSTEM_SPEC.md`, `docs/OPERATION_GUIDE.md`, `docs/RELEASE_ACCEPTANCE.md`, `docs/TUI.md`, `docs/XENON_AUDIT_2026-07-27.md`, `docs/XENON_BENCHMARK_CATALOG.md`

宿主 AI 硬性规则：
- 没有 repo_clone_verified=true 时，不得声称已经读过源码。
- 没有 repo_inspection_verified=true 时，不得把 README/docs/package 文件判断写成事实。
- 没有 quick_start_verified=true 时，不得声称 Quick Start 已跑通。

## Doramagic Pitfall Constraints / 踩坑约束

这些规则来自 Doramagic 发现、验证或编译过程中的项目专属坑点。宿主 AI 必须把它们当作工作约束，而不是普通说明文字。

### Constraint 1: 可能修改宿主 AI 配置

- Trigger: 项目面向 Claude/Cursor/Codex/Gemini/OpenCode 等宿主，或安装命令涉及用户配置目录。
- Host AI rule: 列出会写入的配置文件、目录和卸载/回滚步骤。
- Why it matters: 安装可能改变本机 AI 工具行为，用户需要知道写入位置和回滚方法。
- Evidence: capability.host_targets | https://github.com/xianyu-sheng/Xenon | host_targets=mcp_host, claude, chatgpt, claude_code
- Hard boundary: 不要把这个坑点包装成已解决、已验证或可忽略，除非后续验证证据明确证明它已经关闭。

### Constraint 2: 能力判断依赖假设

- Trigger: README/documentation is current enough for a first validation pass.
- Host AI rule: 将假设转成下游验证清单。
- Why it matters: 假设不成立时，用户拿不到承诺的能力。
- Evidence: capability.assumptions | https://github.com/xianyu-sheng/Xenon | README/documentation is current enough for a first validation pass.
- Hard boundary: 不要把这个坑点包装成已解决、已验证或可忽略，除非后续验证证据明确证明它已经关闭。

### Constraint 3: 维护活跃度未知

- Trigger: 未记录 last_activity_observed。
- Host AI rule: 补 GitHub 最近 commit、release、issue/PR 响应信号。
- Why it matters: 新项目、停更项目和活跃项目会被混在一起，推荐信任度下降。
- Evidence: evidence.maintainer_signals | https://github.com/xianyu-sheng/Xenon | last_activity_observed missing
- Hard boundary: 不要把这个坑点包装成已解决、已验证或可忽略，除非后续验证证据明确证明它已经关闭。

- Trigger: no_demo
- Evidence: downstream_validation.risk_items | https://github.com/xianyu-sheng/Xenon | no_demo; severity=medium
- Hard boundary: 不要把这个坑点包装成已解决、已验证或可忽略，除非后续验证证据明确证明它已经关闭。

### Constraint 5: 存在评分风险

- Trigger: no_demo
- Why it matters: 风险会影响是否适合普通用户安装。
- Evidence: risks.scoring_risks | https://github.com/xianyu-sheng/Xenon | no_demo; severity=medium
- Hard boundary: 不要把这个坑点包装成已解决、已验证或可忽略，除非后续验证证据明确证明它已经关闭。

### Constraint 6: issue/PR 响应质量未知

- Trigger: issue_or_pr_quality=unknown。
- Host AI rule: 抽样最近 issue/PR，判断是否长期无人处理。
- Why it matters: 用户无法判断遇到问题后是否有人维护。
- Evidence: evidence.maintainer_signals | https://github.com/xianyu-sheng/Xenon | issue_or_pr_quality=unknown
- Hard boundary: 不要把这个坑点包装成已解决、已验证或可忽略，除非后续验证证据明确证明它已经关闭。

### Constraint 7: 发布节奏不明确

- Trigger: release_recency=unknown。
- Host AI rule: 确认最近 release/tag 和 README 安装命令是否一致。
- Why it matters: 安装命令和文档可能落后于代码，用户踩坑概率升高。
- Evidence: evidence.maintainer_signals | https://github.com/xianyu-sheng/Xenon | release_recency=unknown
- Hard boundary: 不要把这个坑点包装成已解决、已验证或可忽略，除非后续验证证据明确证明它已经关闭。
