用途与实际影响
这项功能怎样使用
为什么需要它
“支持 Qwen”或“支持 DeepSeek”太模糊:别名、版本、计费线路和协议不同,实际行为和费用都可能不同。产品只开放经过明确设计的组合。
举个实际例子
“这次用我明确选择的Qwen3.8 Max服务,失败就说明原因,不换成便宜型号、本地模型或另一个套餐。”配置同时绑定模型、服务地域、协议和推理设置;技术层列出各配置档的精确身份。
最后我会得到什么
启动前知道确切模型、服务线路、费用类别和实际思考档位;若长任务经历对话压缩,AI 须先留好已完成工作和限制,之后再从原项目恢复。工具会给出这项要求,但不能宣称模型已经照做。
正常时
配置档、模型和真实启动身份一致时,说明这一次选中的路线。
发现问题时
模型或服务换版、旧证据失效时指出该路线需重新确认。
入口不可用或证据不足时
未登记版本、已退役配置或请求要覆盖选定模型时拒绝,不自动换到别家。
从哪里开始
在 aicli profile list/show 中选择明确 Profile;若要换模型,先核对该 Profile 的服务地域、协议和档位。
需要准备什么
- 模型的具体版本或 Profile 名
- 服务与费用限制
- 项目目录
从开始到拿到结果
- 1
核对模型背后的服务
系统检查具体版本、收费线路和请求目的地;只知道模型简称还不能确定这次在用谁。
- 2
预览后核对真实身份
启动前检查配置档;长任务如果经历对话压缩,先保存已完成工作和限制,再从原项目继续。
- 3
拿到这一条线路的结果
说明实际用了哪个模型和服务;配置档列在目录里不等于它现在能连通,跨服务使用要开新任务。
技术实现与依据
这里保留实现、关键条件、精确入口、历史记录和验证结果。
23个公开Profile;云端、本地、桌面与程序化证据分别说明关键规则与设计选择
Codex、Claude Code、Open Interpreter 的协议和权限不同,不能只换模型名。
Qwen Code / OpenCode 当前公开本地路线是 machine-only(仅程序化运行)。
Open Interpreter 只支持当前 Rust 0.0.21+ 世代;旧 Python 0.4.x 会由 Doctor 识别并拒绝,云端 Key 还会从它的 Shell(命令执行环境)工具环境中排除。
DeepSeek Flash当前使用支持图像的deepseek-flash稳定ID;V4 Pro只保留独立CLI(命令行工具) Profile。GLM-5.3与Flash、Qwen0902和四个本地模型各自绑定准确目录,不把品牌名当身份。
本模块用到的名词
- Responses(响应式模型协议)
- 当前 Codex 第三方 Provider 使用的上游协议;普通 Chat Completions 不能只改 URL 伪装成它。
- requested/effective effort(请求/有效思考档)
- 用户选择的统一档位与供应商实际接受的档位;例如 Qwen 的 max 映射 xhigh。
- machine-only(仅程序化运行)
- 可由 aicli run 调用,但不作为日常交互式 start 入口。
专业定义
五类 CLI(命令行工具) 共用一个入口,但不会被抹平成同一种能力。
解决什么
防止模糊品牌名掩盖实际请求路径,或失败时把另一个模型的输出冒充用户原先选择。
当前怎样实现
- 已发布data/providers有25个Manifest(配置清单),其中2个内部模板不公开,以下23个是当前可选入口。配置状态、源码实现、安装、实际进程、Live(真实调用)和恢复证据分别判断;9月3日旧配置数量不是今天的现场。
- Codex第三方入口绑定Responses(响应式模型协议)、Provider、精确模型目录和数据去向,冲突或fallback(后备路线)在计划生成前拒绝。DeepSeek Flash使用官方稳定ID;它随上游更新,不以网页中的V4.1标签人为冻结服务版本。
- ContextManagement.ps1的Get-AiCliThirdPartyContinuityPolicy只覆盖第三方codex/claude/opencode;codex+openai、claude+anthropic及其他引擎返回null。Add-AiCliThirdPartyContinuityPolicy实际把aicli.third-party-continuity.v1附到LaunchPlan.continuityPolicy和notes:mode=loss-aware、manualCompaction=defer-until-window-pressure、oneMilestonePerSession=true,提示会话聚焦内聚里程碑、等窗口压力再考虑手动压缩。它没有自动写checkpoint(续作检查点)或运行压缩的执行器。
- preCompactionCheckpoint要求目标和验收、约束/授权/owner、规则与关键文件、changed-files-and-dirty-ownership、决定及理由、tests-and-live-gaps、阻塞风险和下一步写到existing-project-state。postCompactionRead重读AGENTS.md或CLAUDE.md、已有状态、git status(Git 状态命令)和git diff;summaryIsHint=true、restoreFromSource=true、secondFactSource=false。摘要只提供找回原件的线索,不另建状态库。
- 两个Qwen云端Codex目录的context_window/max_context_window均为983616,effective_context_window_percent=95,auto_compact_token_limit=885254、scope=total,即最大窗口90%。3.7固定06-08,3.8固定qwen3.8-max-0902;max映射xhigh。GLM两条目录固定1048576上下文、943718自动压缩阈值,使用中国区编码套餐Responses接口。
- OpenCode当前主入口与27B兼容入口都使用qwen3.8-27b:256k,context/input=262144、output=32768;reserve=20000、preserveRecent=16384、tailTurns=4和prune=false仍用于一次性运行配置。缺模型元数据时不猜容量。
- 第三方Claude只为已知modelMetadata设置CLAUDE_CODE_MAX_CONTEXT_TOKENS与CLAUDE_CODE_AUTO_COMPACT_WINDOW;清除提前百分比覆盖与DISABLE_AUTO_COMPACT/DISABLE_COMPACT,不禁用溢出保护。未知模型还会清除继承的窗口与压缩控制,保留Claude自身默认。Codex exact resume证明同一任务身份,和这份有损压缩后的项目连续性策略分别验收。
- codex-official|Codex/OpenAI/gpt-5.6-sol默认Profile,官方登录、high;原生交互与程序化恢复。这个模板默认不代表系统或本轮网页任务的永久型号上限;没有本轮全量Live。
- codex-qwen3-7-max-paygo|qwen3.7-max-2026-06-08,北京Workspace按量Responses;max→xhigh。交互和程序化身份明确;旧回执仅按原日期保存,本轮未发Qwen请求。
- codex-qwen3-8-max-paygo|qwen3.8-max-0902,北京Workspace按量Responses,max→xhigh。旧qwen3.8-max泛名不再作为当前模型身份;本轮未发真实请求。
- codex-glm-5-3|glm-5.3,中国区编码套餐,https://open.bigmodel.cn/api/v1,Responses,max,文本模型。Owner9月18日已完成该类桌面父任务与Luna High同一后台子会话的真实闭环,不外推为所有CLI(命令行工具)任务通过。
- codex-glm-5-3-flash|glm-5.3-flash,同一中国区套餐与Responses端点,max,支持图像。它是独立模型入口,不能借GLM-5.3父任务验收当作自己的Live。
- codex-deepseek-flash|deepseek-flash,https://api.deepseek.com,Responses,max,支持图像,当前官方标识为V4.1 Flash。Owner9月18日已完成DeepSeek桌面父任务与同一Luna High子会话的3轮往返;不是全部用法的保证。
- codex-deepseek-v4-pro|deepseek-v4-pro,DeepSeek Responses,max,不支持图像;只保留独立CLI(命令行工具) Profile,不进入当前桌面主菜单,也不由OpenClaw导入。
- codex-ollama-main|qwen3.8-27b:256k,LocalGpuBroker(本地 GPU 调度器) 127.0.0.1:32100/v1,max、256K。官方27B Q4_K_M;9月15日真实桌面与CLI(命令行工具)画面按原日期保留,网页没有再跑GPU任务。
- codex-ollama-review|qwen3.6-35b:256k,受管Broker(代理服务),max、256K,原生输出窗口8192。它是显式交叉入口;AICLI桌面接入不证明Toolkit该路线已经通过自己的Agent验收。
- codex-ollama-qwen3-8-27b|与主入口相同的qwen3.8-27b:256k明确兼容Profile,不是另一模型,也不借旧2026-08-14 artifact回执变成新调用。
- codex-ollama-qwen3-6-35b-abliterated|qwen3.6-35b-abliterated:256k,受管Broker(代理服务)、max、256K,不支持图像;显式选择,不是普通35B失败后的备用。
- codex-ollama-qwen3-8-27b-abliterated|qwen3.8-27b-abliterated:256k,受管Broker(代理服务)、max、256K,支持图像;独立权重身份与观察证据。
- codex-spark-xhigh|gpt-5.3-codex-spark,官方登录、xhigh,不支持图像。历史专项文件任务2/9与步骤硬停按原条件保留,不作为默认或自动推荐;本轮未重验。
- claude-official|Claude Code/Anthropic官方登录,不固定用户上游模型;Profile默认high。一次性运行不等于Codex精确恢复;2.1.270与历史401分别保留原日期,本轮未验证登录。
- claude-custom|用户明确选择的Anthropic Messages模型与端点,API Key;没有默认模型,不支持任意Codex协议。必须按该配置自己验证,旧未配置观察不代表今天永久不可用。
- claude-ollama|通用qwen3:8b、127.0.0.1:11434模板;9月14日该默认端点不可达。本轮未启动它,不能把这一结果写成所有受管本地模型离线。
- claude-ollama-main|qwen3.8-27b:256k、受管Broker(代理服务) 127.0.0.1:32100;模型窗口262144、输出32768。配置已统一不表示Claude工具和当前任务验收完成。
- claude-chatgpt-ccp|第三方raine claude-code-proxy、gpt-5.6-sol、high、代理OAuth(账号授权协议);9月14日安装但未运行,旧Profile未配置。不是OpenAI/Anthropic官方通道,本轮未登录或验收。
- claude-chatgpt-cliproxy|第三方CLIProxyAPI、gpt-5.6-sol、high、代理OAuth(账号授权协议);9月14日安装未运行,旧Profile已配置。代理状态和账号授权单独判断,不自动接管另一通道。
- oi-ollama|当前Rust Open Interpreter,qwen3-coder:30b、127.0.0.1:11434/v1;一次性运行,不支持Codex精确恢复;旧Rust0.0.40观察及通用端点限制保留原日期。
- qwen-code-ollama-main|Qwen Code、qwen3.8-27b:256k、受管Broker(代理服务);machine-only(仅程序化运行),不是交互式start入口;模型元数据不代替该CLI(命令行工具)实际图片或工具能力。
- opencode-ollama-main|OpenCode、qwen3.8-27b:256k、受管Broker(代理服务);machine-only,262144上下文、32768输出。配置同步不等于当前路线已经完成真实任务。
- opencode-ollama-qwen3-8-27b|同一27B的明确兼容Profile,machine-only,窗口与主入口一致;历史pure配置回读不升级为新的Live。
- 已退出当前模板的codex-deepseek、claude-deepseek、oi-deepseek不再列为可选入口;旧V4 Flash及旧Qwen泛名不自动迁移为一次已验证的新身份。OpenClaw现在只导入codex-deepseek-flash。
执行流程
- 1
从23个公开Profile按引擎、模型、数据去向和证据日期选择;只有需要的第三方入口才配置SecretRef。
- 2
生成精确模型目录与启动计划,检查模型、Provider、有效effort(思考等级);官方OpenAI/Anthropic原生路线不附第三方压缩策略。
- 3
第三方codex/claude/opencode接近窗口压力时,上层AI先把目标与验收、授权/owner、规则关键文件、改动与dirty归属、决定理由、测试/Live缺口、阻塞风险和下一步写到项目已有状态。
- 4
压缩后把摘要当线索,重新读AGENTS.md或CLAUDE.md、已有项目状态、git status(Git 状态命令)与git diff;状态缺失或矛盾时先核对原文件,不把摘要升级为第二事实源。
- 5
继续原目标并验收实际产物;启动计划附策略只证明配置已携带要求,真实压缩前落盘、压缩后恢复和长任务结果需要独立运行证据。
边界
- continuityPolicy是启动计划实际携带的工作要求,不是自动保存checkpoint(续作检查点)、无损摘要或长任务已成功的证明。官方OpenAI Codex/Anthropic Claude不受这份第三方策略改写。
- 不宣称23个Profile当前全部Live可用;两个桌面父子链、图片声明与各CLI(命令行工具)任务分别验收。
- 不开放任意自定义 Codex Provider 为公共一键模板。
- 不支持旧 Python Open Interpreter 0.4.x,也不把 Rust 版的权限语义套到其他 CLI(命令行工具)。
- 不因上游文档出现新模型就自动扩大产品范围。
失败与恢复
- 模型、Provider 或 endpoint 漂移
- 指纹与计划拒绝,要求重新配置和验收。
- 旧 Qwen3.7 或 fallback(后备路线) 参数
- 命中退役门并停止,不重路由到 06-08 或 Qwen3.8。
- 检测到旧 Python Open Interpreter 0.4.x
- Doctor 标为不支持,并给出当前 Rust 安装方向;不走旧参数兼容层。
- 不同引擎能力不等价
- 在对应适配器保留实际权限、工具和恢复边界,不伪装统一。
真实入口
E:\Projects\Tools\ai-cli-profile-manager\src\AiCliProfileManager\Private\ContextManagement.ps1第三方连续性计划、压缩前后项目状态与Claude窗口边界
E:\Projects\Tools\ai-cli-profile-manager\tests\Unit\ContextManagement.Tests.ps1七项合成策略与原生基线回归
E:\Projects\Tools\ai-cli-profile-manager\data\providers无执行能力的 Provider Manifest(清单)
E:\Projects\Tools\ai-cli-profile-manager\data\model-catalogs精确 Codex 模型目录
E:\Projects\Tools\ai-cli-profile-manager\src\AiCliProfileManager\Private\ManifestService.ps1公开过滤、schema(数据结构) 与退役门
E:\Projects\Tools\ai-cli-profile-manager\docs\compatibility\VERIFIED-COMPATIBILITY.md按指纹分层的最后验证矩阵
如何验证
- 2026-09-08T08:55Z原生ContextManagement.Tests.ps1七项合成回归通过,覆盖实际LaunchPlan附策略、原生基线不变、Claude已知/未知处理与OpenCode限制传入。没有创建模型run或触发真实压缩。
- 9月18日从已发布main读取25份模板、23个公开入口及准确模型目录;没有把旧安装态Profile数量当作当前现场。
- 全量回归覆盖 exact Qwen/DeepSeek、本地模型、hidden 模板与模型覆盖拒绝。
- 官方资料核对确认 Responses、自定义 Provider 与上游新增项;没有把新增项写成 AICLI 已实现。
与其他模块的关系
本模块回答能选什么、第三方窗口怎样配置,以及压缩前后怎样靠项目状态继续;配置档模块负责启动,验证模块分别核对真实模型与长任务行为。
