CACB Agent 能力基准 · 功能说明

三类 executor 的实际身份、谱系与接入证据

同一道任务可以交给宿主里的原生 AI 助手、本机指定模型,或指定云端服务。先确认这一轮真正由谁执行、用了哪条连接、在哪个独立工作区留下结果;执行者自报的名字不能代替实际执行证据。

当前情况:已有核对谁实际执行、用哪条路线和留下哪些结果的机制;部分历史执行证据仍不完整,不能借别次记录补齐。

项目快照核对于 ;具体测试保留各自日期,页面不实时探测运行状态。

复制 AI 续作说明带着这个项目,交给 AI 接着做

写下接下来想做什么。这里会把你的目标、本页事实和来源整理在一起,复制给 Astra 或 Gemini 后,就不用重新介绍项目了。

整理续作说明

只在当前网页整理,不会发起 AI 任务。

用途与实际影响

这项功能怎样使用

为什么需要它

一次结果写着某个模型名,仍可能由另一配置或旧任务产生。必须让执行者、任务和真实文件互相对得上。

举个实际例子

一个云端任务把文件做完了,实际执行来源却和我指定的不一样。页面会保留文件供排查,同时明确写“身份不合格、不能参加比较”;内容看着正确,也不能借另一条路线的证明蒙混过关。

最后我会得到什么

对一份已有尝试,可以核对实际执行者、执行路线、留下的文件和是否真正结束;对不上时留下排查材料,并明确不能拿它参加正式比较。

正常时

实际模型、执行路线、这次任务和文件都能互相对应,且能确认执行和清理结束时,才把这份结果送去比较。

发现问题时

声明的模型、服务、任务或清理结果对不上时,写明矛盾发生在哪一层并保留文件供排查;不借另一条路线的记录补证。

入口不可用或证据不足时

宿主或云端服务不给必要的执行、结束证明时,标明证据不足;参与者自述和旧配置不能代替本次结果。

从哪里开始

在 CACB 项目的 AI 对话中问:这一次工程题的结果真由哪条路线和哪个实际配置产生?

需要准备什么

  • 要核对的某次尝试或产物

从开始到拿到结果

  1. 1

    读取这次尝试的真实记录

    从宿主任务与隔离工作区核对原生、本机或云端路线及实际模型身份,不采信执行者自报。

  2. 2

    对照实际执行与结束证据

    核对启动者、真实模型、任务、工作区、留下的文件和终态;云端任务还要知道服务端是否确实结束。

  3. 3

    决定能否用于比较

    全部对上才把这次结果交给客观检查;有矛盾就保留诊断材料并说明哪个环节不可信。