能力入口 · 宿主集成能力
可编辑 Word 文书与逐页验收
制作真正可编辑、版面可靠的 Word 文档:保留需要的样式、表格、页眉页脚、修订与批注,并逐页检查裁切、重叠和字体,避免把能打开的文件当成可交付成品。
宿主已集成 / 本轮未跑真实文档先看怎么用
你不需要记住 Skill 名,直接说需求就行
什么时候用
- 创建或局部编辑Word/DOCX,并保留原模板与可编辑结构
- 整理批注、修订与清洁版,或比较两个文档版本
- 维护目录、编号、脚注、交叉引用、公式、节布局、合并文档或表格转换
- 制作Word表单内容控件,或按要求限制编辑
- 检查可访问性,按需处理文本遮盖、元数据或水印
- 把已验收DOCX导入原生Google Docs;每个有意义编辑批次都逐页验收
可以直接这样说
“把这份协议改成可继续编辑的 Word,保留原来的表格和批注,分页有问题也一起修好。”AI 先核对原结构与修改范围,编辑后逐页检查,再交回最终文件。
最后会得到什么
我会得到一个可继续编辑的 Word,最后一轮每一页都已检查;若目标是原生 Google Docs,则从同一份已验收 DOCX 正式导入。
不适合这样用
- 只需要普通纯文本回答
- 只读 PDF 而不处理 Word 文档
- 只抽出文字或检查文件内部结构,就说整页版面已经通过
- 用户只要最终 DOCX 时交付内部 PNG 或调试 PDF
正常时
文档内容、结构与最后一轮全部页面都检查通过时,交付要求的最终 Word 或 Google 文档。
发现问题时
出现裁切、重叠、样式变化或表格断裂时,回到源文件修复并重新检查全部页面。
入口不可用或证据不足时
正式制作或渲染环境不可用时,保留可编辑文件并说明缺口;没完成逐页检查就不声称视觉通过。
从哪里开始
在当前 AI 对话提出新建、修改、审阅或比较 Word 文档;可以交现有 DOCX、模板或参考。若目标是原生 Google 文档,明确目标格式与写入位置。
需要准备什么
- 文档内容或现有 DOCX、读者、用途和想改的范围
- 模板、审阅版、表单字段、可编辑性或目标格式等会改变产物的要求
为什么需要这个能力
DOCX 的文字提取和内部结构都可能正常,但真实页面仍会出现表格断裂、字体丢失、段落挤压或页眉错位。每次有意义的编辑后把文档转成页面图逐页看,才能发现用户打开和打印时会遇到的问题。
新建文档,或只改需要改的部分
按这份参考写一份可编辑的 Word,只改现有文档中的相关段落。
提供内容或现有 Word,说明读者、用途、改动范围;有模板或参考就交给 AI。
AI 先读原结构和样式,尽量只改必要文字与表格。新文档会先讲清主题和读者要做什么;没有指定外观且模板选择可用时,可以选择模板。每次重要修改后都生成全部页面图检查。
你会得到能继续编辑的 Word,最后一轮每页都核过字体、裁切、表格与跨页。
模板选择取消或不可用时仍可继续;参考样例不会变成凭空编造的事实。能打开文件或抽出文字不等于版面通过。
审阅、比较和整理版本
比较这两版,保留批注;再给我一份要求的清洁版。
给出明确的旧版、新版,以及批注和修订哪些要保留、哪些要接受或移除。
AI 检查正文差异和审阅记录,需要时逐页比较视觉变化;批注还会检查它指向哪里。只有你明确要清洁版时,才按要求处理修订和批注。
你会得到具体改动说明,以及保留审阅痕迹或整理完成的 Word;需要单独差异文件时才另交付。
页面图可能看不到批注,因此不能据图说批注不存在。比较外观也不能代替判断业务或法律含义;最终文件仍需逐页核对。
保留可导航、可继续修改的文档结构
把目录、脚注、引用和表格整理好,公式仍要能编辑。
给出选中文档及需要保留的章节、引用、公式、合并顺序或表格转换目标。
AI 按用途维护标题层级、目录、编号、脚注、内部跳转和交叉引用;需要时把表格与电子表格互转。明确要求可编辑公式时保留 Word 的原生公式结构。
你会得到能导航、引用仍对应正文且可以继续修改的文件;表格转换按要求另给目标文件。
目录和页码可能需要更新后才显示新位置,AI 会分别查内部关系和最终页面。若原生公式路线不可用会说明;改用图片公式时会明确它不能在 Word 里像公式那样编辑。
制作能填写的表单并限定编辑范围
让对方只填这些字段,其他内容不要改。
现有文档、真实字段内容,以及允许别人修改的范围。
AI 把需要填写的地方做成 Word 真正可操作的字段;你要求限制编辑时,再设置只读、只允许批注或只填表单的范围。
你会得到可填写且编辑范围符合请求的 Word,并检查字段内容和页面效果。
画一张空白表格不等于可填写表单;限制编辑也不等于加密文件或授权密码访问。
改善辅助阅读与文档可用性
帮我看看这份 Word 对使用屏幕阅读器的人是否容易读。
一份文档及其实际读者和使用方式。
AI 检查标题层级、图片说明、真正的表头和链接文字,按实际含义修正,随后重新检查页面。
你会得到已发现的问题、确实修好的部分,以及仍需要人判断的图片或结构含义。
自动检查不等于整份文档已通过所有无障碍标准;文件名不能代替图片说明,错误表头也不能机械标记。
按明确目的制作可转交的副本
给我一份遮住指定姓名并去掉作者信息的副本。
精确原文、要处理的文字或模式,以及是否还要清理元数据或增删水印。
AI 保留原件,在副本里处理明确指定的文字、作者信息或水印,再搜索文字并逐页检查外观。
你会得到按本次范围处理的最终 Word,并知道还有哪些对象未覆盖。
文字处理不能自动清除图片、图表、嵌入文件或旧修订里藏着的同样内容;不能据一次搜索宣称全部隐藏信息已清除。
交付原生 Google 文档
把这份 Word 变成可继续在线编辑的 Google 文档。
已确认内容或参考 Word,以及明确的在线文档目标和写入授权。
AI 先制作并逐页检查同一份本地 Word,清理可能带到在线文档里的标题边框,再通过现有 Google Drive 导入为原生文档。
你会得到实际创建的 Google 文档;本地制作、视觉检查和在线导入分别有结果。
导入能力不可用时只交代这个缺口,不能把本地 Word 说成已经在线创建。内部页面图和调试 PDF 不会当额外成品交付。
失败时会怎样恢复
渲染发现裁切、重叠或表格断裂
系统反应:文档不交付。
恢复方式:修复样式、几何或分页后重新渲染全部页面,直到最后一轮逐页通过。
文档无法完成正式页面检查
系统反应:可以保留当前可编辑文件,但不能说版面已经验收。
恢复方式:修复这项任务使用的宿主文档渲染环境,再把最后一轮所有页面重新检查;不临时换用另一套 Office 冒充通过。
导入 Google 文档后标题多出边框
系统反应:先停在本地文件,不把有明显版面缺陷的版本交到线上。
恢复方式:清理标题的格式残留,再用清理后的文件逐页检查并重新导入。
技术身份与验证证据
Skill · documents · 成熟度 A-(基本稳定,仍有明确边界)
这个 Skill 用到的名词
- DOCX
- 保留段落、样式、表格、页眉页脚、修订、批注和表单结构的 Office 文档格式。
- Render QA(渲染验收)
- 把每一页渲染成 PNG 后在 100% 视图检查裁切、重叠、字体、表格、页眉页脚和大空白。
- OOXML(Word 文档内部结构)
- DOCX 压缩包内用于表示样式、关系、修订、批注和字段的 XML;结构检查不能替代真实页面目检。
- Tracked changes(修订痕迹)
- 以插入和删除记录保留谁改了什么;交付清洁版前是否接受修订由任务要求决定。
- Native Google Docs import(原生 Google 文档导入)
- 先把本地 DOCX 完整验收,再通过正式 Drive 导入生成原生 Google Docs;不从空白网页重新拼文档。
专业定义
创建、编辑、修订或批注 DOCX时,先按文档用途选结构和样式,再把成品渲染为逐页图片检查裁切、重叠、字体、表格与页眉页脚;只有最后一轮逐页目检通过才交付可编辑文书。
执行参考
下面保留 AI 和工具实际使用的参数、步骤与依赖。日常使用可以直接提出需求,不需要先手工准备这些协议。
输入
- 目标内容、受众、用途与输出格式
- 可选模板、参考 DOCX 或必须保留的原结构
- 需要修订、批注、表单或 Google Docs 导入时的精确要求
输出
- 可编辑 DOCX
- 需要时的修订、批注、表单或原生 Google Docs 成品
- 内部逐页 PNG 目检与结构检查结果
执行顺序
- 1
有模板或参考时保留原结构与风格;新文档无明确视觉方向时仅在选择器可用且本人未拒绝时提供模板,取消/缺失/失败就继续
- 2
先让标题和开篇清楚说明主题、用途、读者行动与事实依据,不用模板示例虚构作者经历
- 3
发现宿主 workspace 依赖
- 4
按模板或文档类型固定结构与样式 token
- 5
创建或做最小局部编辑
- 6
渲染全部页面为 PNG
- 7
逐页检查并修复后重新渲染
- 8
只交付用户要求的最终文档
- 9
普通编辑用python-docx;修订、批注、超链接或字段需要时用包内OOXML工具,修改后仍重新渲染
- 10
目录、页码、SEQ/REF/PAGEREF等域可能有陈旧显示,分别检查逻辑引用与最终渲染;合并文档、节布局和表格跨页由对应任务入口处理
- 11
用户要求原生可编辑公式时保留OMML;未要求原生/可编辑,且满足“无可靠OMML路径”或“复杂展示公式需要更稳定跨渲染保真”任一条件时,可用MathJax高分辨率图像;明确它不是原生公式,并保留原表示方式和实际验收
操作边界
- bundle(随宿主发布的能力包)版本只记录本次观察,不作为未来准入
- 每个有意义的编辑批次后重新渲染并逐页检查
- Google Docs 新文档先生成并验收本地 DOCX,再走原生导入
- 渲染失败先按 packaged renderer 日志诊断;尚未完成逐页目检就如实保留缺口
- 只用 workspace dependency loader 返回的运行时与 bundle LibreOffice;不因为 bundled 渲染失败就切到本机另一份 Office
- Google Docs 定向 DOCX 导入前先清除 Word 标题边框残留并回验;原生导入能力与外部写入授权仍独立成立
- 用户只要 DOCX 时只交付所需最终文件,逐页 PNG 与调试 PDF 留在内部
- 批注常不出现在无界面PDF导出中,必须额外核对comments.xml、锚点、关系和内容类型;单靠页面图不能证明批注存在
- 接受修订、删除批注、去元数据、加编辑限制或压平公式都按实际要求执行,不为美观丢失原文、审阅历史或可编辑性
依赖
- Codex bundled workspace dependencies
- 宿主当前 documents capability(文档能力)
文档包的使用前提和设计选择
使用宿主workspace依赖入口返回的Node/Python与包目录;builder写在可写工作区,不放受管依赖目录。只使用该包的LibreOffice绝对路径,不能因失败换用本人桌面安装。源码路径与26.904.11930只是本次来源身份,不是未来版本门。
新文档无模板、参考或视觉方向且list_artifact_templates可用、本人未拒绝时提供一次选择;选择取消/失败/缺失继续。模板模式按template-distill.md与template-create.md保存原模板及task-local artifact.md,不套通用设计覆盖模板。
无更具体要求时,新建为Letter 8.5×11英寸纵向,正文约11–12pt。标题/副标题/各级标题与页眉用黑色;Word Title样式不带下划线、底边框或装饰线。表格按比较/记录用途设置宽度、浅灰D9D9D9边框与真实表头,不固定会裁切的行高;保留真实内容优先于页数或装饰。
首次真正create/edit authoring前只运行一次mark_artifact_operation_started;只读不运行。该记录不是内容或页面验收。
# 开始制作的宿主记录
node container_tools/mark_artifact_operation_started.mjs --operation-kind create --expected-output-count 1 --output-format docx# 最后一轮完整渲染
python render_docx.py <input.docx> --output_dir <本次页面目录>审阅、结构与可编辑公式
普通局部编辑使用python-docx;修订、批注、关系、超链接与字段使用包内OOXML工具并重新渲染。批注检查comments.xml、锚点、rels及content-types;PNG不可靠显示全部批注。
包内tasks分别拥有multi_doc_merge、style_lint_normalize、forms_content_controls、captions_crossrefs、footnotes_endnotes、navigation_internal_links、fields_update与toc_workflow。对应scripts含content_controls.py、captions_and_crossrefs.py、insert_ref_fields.py、internal_nav.py、fields_materialize.py、flatten_ref_fields.py;xlsx_to_docx_table.py与docx_table_to_csv.py按tasks/tables_spreadsheets.md处理表格互转。完整参数在同一宿主包,不用System概述冒充参考。
用户要求native/editable或现有文档已用原生公式时,优先经过测试的OMML,并核对Word与LibreOffice。未要求原生/可编辑,并且“没有可靠OMML路径”或“复杂展示公式需要更稳定跨渲染表现”至少一项成立时,可用MathJax→SVG→高分辨率透明PNG;如实说明图像不可原生编辑,不留原始LaTeX或以普通文字冒充结构公式。
# 移除批注的清洁副本
python scripts/comments_strip.py <input.docx> --out <无批注副本.docx># 接受修订的清洁副本
python scripts/accept_tracked_changes.py <input.docx> --mode accept --out <接受修订副本.docx># 逐页版本差异
python scripts/render_and_diff.py <旧版.docx> <新版.docx> --outdir <差异目录>可访问性、转交副本与编辑范围
a11y_audit检查标题级别、图片descr、表头标记与链接文字;高严重度问题可使其非零退出。自动alt from_filename只提供基线,不代替描述实际图片;first_row只有真实表头才能启用。它不是完整 WCAG 合规证明,仍需按文档实际语义复核。
redact_docx.py在单个w:p内匹配并默认使用等长遮盖,副本处理,模式必须精确;默认涉及页眉页脚和脚注尾注,批注需显式include_comments。图片文字、嵌入对象、图表与删除修订仍须另查,不能用文本节点遮盖保证全清。
privacy_scrub.py清理作者、rsid和相应元数据;set_protection.py按请求设置read-only/comments/forms;watermark_add.py与watermark_audit_remove.py处理水印。每种都按任务明确目的操作,不把它们组成每个Word的强制流水线,最终仍重新渲染检查。
# 可访问性报告
python scripts/a11y_audit.py <input.docx> --out_json <report.json># 确认表头后的定向修正
python scripts/a11y_audit.py <input.docx> --fix_table_headers first_row --out <新副本.docx># 精确文本遮盖
python scripts/redact_docx.py <input.docx> --output <新副本.docx> --pattern <精确模式>Google导入、最终交付与真实状态
Google Docs目标先运行google_docs_title_sanitize.py生成sanitized.docx,再--check;用这一份完成渲染与原生导入。正式Google Drive import_document的upload_mode=native_google_docs;没有插件或导入动作时单独报告该依赖未完成。
render_docx.py生成全部page-N.png,最后一轮逐页100%检查,不能抽样交付;包含公式、脚注、表格跨页、字体、间距与页眉页脚。LibreOffice stderr不单独判失败,要看实际页面/PDF与日志;渲染存在也不证明文字与事实正确。
只交请求的最终制品;内部PNG和调试PDF不主动变成交付。当前宿主能力可发现、源码SHA已核,但本网页任务没有运行真实文档创建、渲染、导入、可访问性修复或其他操作,业务E2E(端到端验证)保持Unknown(未验证)。
# 导入前标题清理
python scripts/google_docs_title_sanitize.py <input.docx> --out <sanitized.docx># 标题清理回验
python scripts/google_docs_title_sanitize.py <sanitized.docx> --check验证状态
源码、安装、供应检查、当前任务、新任务和真实使用分别列出;一层通过不自动提升另一层。
- Source(源码)
- 当前宿主规范源文件已读取并核对 SHA-256;版本只是观察,不作未来准入
- Install(安装)
- 宿主已集成;按稳定能力发现,不以 bundle 版本准入
- Transaction(供应事务)
- 宿主集成能力不经过个人 Skill 安装事务
- Current task(当前任务)
- 本轮未创建或编辑真实 DOCX
- Fresh task(全新任务)
- Fresh task(全新任务)回执 Unknown(未知)
- End to end(端到端)
- 真实文档创建、渲染与逐页验收 E2E(端到端验证) 本轮 Unknown(未验证)
本任务正常能力清单与当前宿主源文件可发现;没有创建、修改或渲染真实制品,Current(当前状态)/Fresh/E2E 保持 Unknown(未验证)
证据时间与来源
- Observed at(观察时间)
- 2026-09-07:宿主当前 bundle 26.904.11930 的真实源文件与本任务能力清单
- Source commit(来源提交)
- 不适用:宿主集成能力不绑定项目 Git 提交
- Supply command(供应验证命令)
Codex workspace dependency loader(工作区依赖发现入口)- Evidence basis(证据来源)
- 宿主集成 documents capability(文档能力)的源码身份只由结构化来源字段记录;宿主版本不成为准入,本轮没有真实文档 E2E(端到端验证)。
Canonical source(唯一维护源)
host:documents这是稳定的宿主能力身份;宿主更新后仍按能力发现,不以版本化缓存路径准入。
E:\Data\AppData\Codex\plugins\cache\openai-primary-runtime\documents\26.904.11930\skills\documents\SKILL.md这是本次观察到的 bundle(宿主能力包)源码位置,只用于记录本轮 bytes / SHA 快照。
