docx

数据 社区
  • 作者仓库星标 0
  • 许可证 Proprietary. LICENSE.txt has complete terms
  • 作者更新于 2026年8月22日 01:10
解读按原文结构重写,命令、链接、术语均保留;右侧可核对作者原始 SKILL.md

作者的方法

原文先按任务分工具:新建文档写 docx(npm)脚本,读取正文用 pandoc -t markdown,编辑现有文件则走 unzip → word/document.xml → zip。作者明确指出 docx-js 不能打开既有文档,因此没有把三类任务硬塞进同一个库。

创建与验收

  • 创建:直接 require('docx'),只有加载失败才安装依赖。原文集中提醒 A4 默认纸张、DXA 表格双宽度、ShadingType.CLEAR、编号列表、ImageRun.type 和 TOC 的 outlineLevel 等易错点。
  • 验收:先把 DOCX 转成 PDF,再用 pdftoppm 查看每页;编辑后的文件还要运行 scripts/office/validate.py --original 做 XSD 与原文件对照校验。

编辑、修订与评论

  • 外部 DOCX 先解包并删除符号链接,再用 merge_runs.py 合并被 Word 拆散的相邻 runs;修改 document.xml 时不能格式化整份 XML。
  • 修订必须正确使用 <w:ins><w:del><w:delText>,删除段落还涉及段落标记;--author 校验用于发现没有被修订标记包住的改动。
  • 评论不是只写一个节点:comment.py 会生成六类关联文件,但仍需把 range 与 reference 标记放进 document.xml,否则评论不会显示。

流狐判断:这套方法适合需要保留 DOCX 结构并能检查结果的任务;如果只是读正文,停在 pandoc 即可,不必进入 OOXML 层。

流狐档案 作者与许可取自来源;运行、权限和网络为流狐检测或估算
流狐分类
数据
作者声明 Agent
未找到明确声明;不据此推断已兼容或已测试
静态检查
94 / 100 · 启发式扫描,不代表运行安全
作者 / 版本 / 许可
@anthropics · Proprietary. LICENSE.txt has complete terms
流狐 Token 估算
低消耗
流狐接入估算
即装即用
是否需要外部 API Key
未发现要求
检测到的系统要求
macOS · Linux · Windows
底层运行要求
Python
检测到的文件与系统行为
  • 只读
  • 允许写入 / 修改
检测到的网络行为
仅限本地
安装命令数
无(仅作为资料)

档案由构建时根据 SKILL.md 与安装命令自动衍生,可能与作者实际意图存在差异。

需要注意: 未限定 allowed-tools,默认拥有全部工具权限。

输出预览 docx.preview
# Verify the output

python scripts/office/soffice.py --headless --convert-to pdf output.docx
pdftoppm -jpeg -r 100 output.pdf page
ls page-*.jpg   # then Read the images

讨论

基于 GitHub Discussions。登录 GitHub 即可参与讨论、点赞、订阅更新。