把一件可验收的小任务交给明确模型

LLM Backend(模型后端) Toolkit

主 AI 正在处理一件事,其中一部分适合交给另一个明确模型,例如整理长材料、检查分类结果或在指定目录尝试修代码。这个工具按当前登记路线调用本地或已授权的外部模型,保存输入、进度和结果;主 AI 可以继续其他工作,再独立判断取回结果是否可用。它不决定总目标,不冒充原生子代理,也不在失败时偷偷换模型。

项目状态
支持零写入诊断与精确取消;配置和真实任务验收分开
快照边界
只把范围明确且结果可独立验收的任务交出去。已配置、预检正常、真实调用和结果可用分别证明;读取状态不重新提交,取消受理不等于已停止。
观察时间
复制 AI 续作说明带着这个项目,交给 AI 接着做

写下接下来想做什么。这里会把你的目标、本页事实和来源整理在一起,复制给 Astra 或 Gemini 后,就不用重新介绍项目了。

整理续作说明

只在当前网页整理,不会发起 AI 任务。

用途与结果

最快了解这个项目

为什么需要它

直接把所有材料塞进主对话会挤占上下文;另开一个模型窗口又容易忘记它用了什么资料、是否真的完成。这里保留明确的任务编号、输入依据、结果和失败原因,让额外模型承担一件可验收的事。它自己不决定总目标,也不会因为某个模型不可用就偷偷换一个。

举个实际例子

帮我从这份几十页的公开技术说明中找出升级步骤和失败后的恢复办法,给我一张带原文位置的表。主 AI 选好资料和模型后提交任务,先继续做其他部分;稍后取回表格、引用行号、输入摘要和文件位置。模型失败会返回具体原因,主 AI 再决定修正请求、重试或亲自处理。

最后我会得到什么

得到短结果、可打开的完整本地文件和模型/输入/执行回执。只看状态可用纯只读入口,确需停止可通过命令请求精确取消,等进程树和GPU释放才算完成。桌面观察台仍只展示公开工作进度,不新增输入、停止或审批按钮,也不代替主AI验收。

正常时

所选模型按指定资料完成任务,交回回答或文件;主 AI 再核对它是否真的解决原问题。

发现问题时

回答不符、文件已改变、额度不足或等待超时时,留下原因和已有结果,不自动改用另一模型。

入口不可用或证据不足时

本地模型、登录凭据、显卡资源或获准云端服务缺失时,只说明这条路线暂不能做;配置存在本身不是完成证明。

从哪里开始

在已接入 LLM Backend(模型后端) Toolkit 的主 AI 对话中交代一件具体模型工作:给什么材料、要什么结果、是否只在本机处理。提交后保存任务编号,之后可查进度;电脑上的观察台显示可公开的处理过程。

需要准备什么

  • 本次问题和要处理的文件
  • 本地、指定模型或已允许云端的边界
  • 期望输出及是否需要工具、图片或录音

从开始到拿到结果

  1. 1
    先核对模型和材料能否走这条路线

    系统根据本地或已允许云端的要求检查当前模型、文件来源和需要的工具,条件不符先说明。

  2. 2
    提交并保持可追踪

    后台任务固定输入并给出任务号,主 AI 可以继续其他事。

  3. 3
    查询或取消精确任务

    用任务号查看进度和结果;取消后还要核对执行与资源清理。

  4. 4
    验收实际内容

    交回模型输出、产物和适用边界;配置存在、进程活着或草稿出现都不等于工作完成。

从这些需求了解功能

从一个实际问题看它怎样处理、交回什么;当前能做到哪一步和仍有哪些限制,也写在对应说明中。

01模型与路线这件工作用哪个模型?失败时别替我换。先按这次材料和本地或云端限制选定明确模型;不能用就告知原因,不自动换成另一家。查看使用步骤与完整说明02任务与输入把这份资料交给本地模型,做好了我再来取。提交后保存任务编号,回来只读查进度,完成时取回答和文件;若取消还要确认执行与显卡确实停止。查看使用步骤与完整说明03材料与续问材料太长,只找和恢复步骤有关的段落;然后接着问一次。选取有行号的片段,保留指定文字;续问携带前轮任务编号、结果状态与短预览,不自动附带完整回执。查看使用步骤与完整说明04智能体执行在这个目录里尝试修复代码,最后把测试结果交回来。用已登记的编程工具在指定目录实际改文件并跑检查,再交回修改和未通过的测试;一段文字答复不算完成。这份受控本地工作单能开始或取消了吗?先查目标模型、目录和工具是否已就绪;取消必须确认原进程已经停,不把“收到取消”当成结束。查看使用步骤与完整说明05媒体处理先识别这张扫描页的文字,再归纳要点。精确文字先交 LocalOCR,释放 GPU 后再调用模型。查看使用步骤与完整说明06调用观察台我想看看额外模型在做什么,有没有真的回答完。观察台显示公开进度、失败草稿和最终答复,缺失信息留空。查看使用步骤与完整说明07探测与验证这个模型刚换过,先用一个小例子看看能不能按要求输出。选一件固定小题真正运行,并独立核对答案;结论只属于这次模型和测试,不自动改变默认。查看使用步骤与完整说明

这件工作交给哪个已登记模型

先决定材料留在本机还是明确发给外部服务,再选择模型。下面说明入口分工,不替代当前任务的效果验收,也不是更大就更好的排名。

01
先在本机处理材料、图片或一项明确任务

Qwen3.8 27B;当前默认本地模型。

给出该任务的回答或文件,主AI再核对原材料与验收条件。

本地配置允许先预检再有界使用;本轮没有重新验证模型权重或真实任务效果。

02
拿另一套本地结果做对照

Qwen3.6 35B;明确选择的交叉检查模型。

独立回答同一问题,帮助发现分歧;不是自动替换27B。

不会自动兜底;与27B相同的结论也不能当作正确性证明。

03
明确选用已登记的修改版模型

Qwen3.8 27B 去限制版、Qwen3.6 35B 去限制版。

使用所选版本自身的回答行为,不把它悄悄换回普通版。

两个版本都需明确选择;35B修改版不支持视觉,名字不代表质量更好或任何任务都适合。

04
明确允许把这一份材料交给云端

Qwen3.7 Flash 或 DeepSeek Flash;直接调用路线。

在获准的外部服务取得回答,返回准确模型与结果。

两条路线都没有因此获得工具型Agent验收;本地失败不自动上传,不凭配置存在声称额度或调用成功。

05
考虑额外的官方编码模型候选

GPT-5.3 Codex Spark;保留的显式候选。

可以先查看其历史证据与当前接入条件,再决定是否另做有界验证。

旧任务曾达到步数上限而未完成,不作为默认推荐;本轮未做新的云端调用。

项目指标与相关入口查看规模、覆盖范围和关联能力

当前项目指标

默认调用
本地 Qwen3.8 27B
任务方式
异步提交 · 按需取结果
模型选择
显式选择 · 不自动换道
工作过程
桌面只读观察台

它负责

  • 接收一件具体工作,保存本次材料、任务编号、结果和失败原因。
  • 在已有模型路线之间按明确限制选用,整理长材料并显示安全的公开进度。
  • 把需要编程工具、显卡、文字识别或录音转写的部分交给各自现有工具处理。

它不负责

  • 它不替主 AI 决定长期目标或接受最终结果。
  • 模型失败不自动换另一家,也不把未获准的材料送到云端。
  • 不收集所有 Codex 或第三方聊天窗口的历史。
  • 私人材料、隐藏推理、识别正文和密钥不发布到网站。

产品思想与设计核心

01

主 AI 掌握目标和验收

额外模型只做分配给它的工作。结果是待核对的材料,不因工具返回成功就自动成为最终结论。

02

一条路失败,不改送别处

默认只选已登记的本地模型。其他模型须明确选择;若要把这次材料交给外部服务,还要得到本次允许外发的明确要求。

03

长结果留在文件里,聊天里给要点

长材料先按问题选相关片段,长输出留成本地完整文件。答复说明哪些材料被省略或缩短,不把估算节省量说成真实账单。

04

没看到最终答复就说还没有

观察台只展示真的收到的公开进度;程序还在、配置可用或只有草稿都不证明工作完成。

它实际读取什么,又把什么交回来

输入来自本次明确提交的任务和文件,不会扫描整个电脑或偷听其他模型窗口。

01
本次请求与 UTF-8 文本文件

这次写明的目标、限制和选中的文本文件;需要核对时再看文件内容是否改变。

挑出相关段落并给出处;所选模型只接收这次任务需要的材料。

02
选中的图片或音频

一般图片、需要精确文字的扫描件,或指定录音。

按选择使用模型原生视觉、LocalOCR 或 ChineseASR;专项识别结果用于本次后续处理,原始私人内容不进入公开观察事件。

03
当前模型与编程工具设置

核对实际模型、服务地点、使用权限和可用证据。

判断能否走这条已经实现的路线;缺少条件时说清原因,不猜另一条可用。

04
本次后台工作的公开状态

只读取已产生的进度、答复、工具活动和用量信息。

任务编号可用于查看或精确取消;累计用量、当前进度和最终结果分别显示。

项目怎样演化到现在

额外模型的结果可以追溯

从直接调用发展为有编号的任务,保留输入、结果文件与失败原因;主任务仍负责最终采用。

长任务能观察和接续

只读观察台显示真实进度,材料和后续提问有明确来源;界面不接管审批、输入或停止业务。

看状态不再顺手改变任务

零调用诊断、纯只读任务查询和精确取消分开;缓存只收完整且身份对应的成功结果,任务受理、执行结束和资源释放分别核对。

阶段依据
  • 2026-09-18 · 看状态不再顺手改变任务e0d0051