芯片文档选型:AsciiDoc 还是 DITA?一份打了九轮的 PK 实录

📅 2026/7/22 13:49:54
芯片文档选型:AsciiDoc 还是 DITA?一份打了九轮的 PK 实录
前几天有位做芯片文档的同行找我聊天。他说他们公司正在从 Word 往结构化文档转型大概几百人的芯片设计公司几百款量产型号在跑手册类型从 datasheet 到 user guide 到 application note 一大堆中英文都有。文档团队三五个人研发团队倒是三百人往上。然后他丢给我一个问题让我当场破防大龙你说我们是上 AsciiDoc 还是上 DITA这问题要是十年前问答案基本是板上钉钉——大厂、重结构化、多语言、多产品线那肯定 DITA 啊想什么呢。但今天这问题变得有意思了。因为两个东西都在进化DITA 那边出了 LwDITA轻量级 DITA研发可以只写 Markdown 就行AsciiDoc 这边有了 Antora 和 docToolchain内容重用能力也支棱起来了。再加上 Oxygen XML Editor 的 AI Positron 和 Claude Code 这类 AI Agent 的崛起两边都有新牌可打。所以我决定不拍脑袋认认真真 PK 一轮。九大维度逐一拆解。第一轮研发团队接入先说一个反直觉的结论这一轮两边打平了。你可能觉得AsciiDoc 是类 Markdown 语法工程师肯定更喜欢啊。但问题是DITA 现在有个叫 LwDITA 的东西研发人员直接写标准 Markdown (.md) 就行零 DITA 知识要求。人家照样在 VS Code 里写照样走 GitLab PR和写代码的流程完全一致。复杂表格怎么办两边都是同一个策略Excel 维护 脚本自动转换。研发不用手写任何表格语法零学习成本。区别其实只有一个AsciiDoc 方案下研发写的 .adoc 会贯穿文档全流程团队之间边界更模糊全员参与DITA 方案下研发只写 .md所有结构化组装和发布的事交给文档团队在 Oxygen 端处理。这不是技术能力的差异是组织分工偏好的差异。比分5 : 5第二轮Word 文档转换这一轮就比较扎心了。芯片行业积累了几百份 Word 手册要转结构化转换工具的成熟度直接决定你要加多少班。AsciiDoc 这边用的是 Pandoc 自定义脚本。Pandoc 是开源神器没错但遇到芯片手册里那些跨行跨列的复杂表格基本就是基础转换 OK复杂表格崩给你看。你得做好大量人工调整的准备还得自己写脚本做样式映射。DITA 这边呢Oxygen 自带一个叫Batch Documents Converter的插件免费的专为 Word→DITA 设计。支持 Word 样式可视化映射能自动把多级标题拆成 DITA 主题并生成 DITA MapOMML 公式自动转 MathML嵌入图片自动提取并引用。你说这一轮怎么打比分3.5 : 4.5DITA 胜第三轮费用永久 License聊钱总是最有意思的。AsciiDoc 的工具链全部免费VS Code 免费、AsciiDoc 插件免费、Asciidoctor 和 asciidoctor-pdf 免费开源、Antora 免费、docToolchain 免费。CI/CD 部署也是零许可费。但注意免费不代表不要钱。AsciiDoc 的开箱即用程度比较低——Word 转换脚本要自己写、翻译管道要自己搭、PDF 模板要自己定制、质量检查工具要自己配置。这些定制开发的服务费用加起来可能超过 DITA 方案的工具许可费。这一点很多人容易忽略。DITA Oxygen 这边桌面端的定价大概是命名用户约 1000 1000-1200美元/用户浮动用户约3000-3500美元/用户。5 个人的团队桌面端大约是5000-6000美元的一次性投入。真正的隐性成本在 CI/CD 上。如果你要把 DITA 发布挂到 GitLab CI/CD 上做自动化批量编译必须额外购买Oxygen Publishing Engine的服务器授权——按 CPU 核心数计价几千到上万美元不等。asciidoctor-pdf 可免费部署在 CI/CD 上零许可费。所以这一轮的实际差距是零成本 vs 桌面端几千美金 服务器端几千到上万美金的一次性投入。每年还有 10%~15% 的维护费。比分4 : 2.5AsciiDoc 优势重新拉大第四轮版本管理GitLab 一族表示这轮你们都不用吵。两边都是纯文本格式都能完美走 Git diff PR review 流程。AsciiDoc 的纯文本 diff 天然清晰PR 审查体验极好。Oxygen 这边内置了 Git 客户端 可视化 XML Diff 工具在 XML 结构层面的对比做得更细。总的来说差距在缩小。比分5 : 4.5AsciiDoc 小胜第五轮翻译/本地化CAT 工具这一轮可以称得上是买定离手的轮次。如果你的翻译量很大CAT 工具是你的核心基础设施那这一轮的结论非常简单DITA XML 直接被 CAT 工具原生支持。翻译流程一步到位DITA XML → CAT 工具翻译 → DITA XML。没有格式转换损失翻译记忆匹配率一贯稳定。AsciiDoc 呢以使用YiCAT做翻译为例得绕路AsciiDoc → DocBook XML → 进 CAT 翻译 → DocBook XML → 回转为 AsciiDoc。多了一步转换就多一分风险——数学公式在 DocBook↔AsciiDoc 的转换中已知有问题标签丢失、结构变化都是可能的。如果你的 CAT 翻译量一年几十万字这一轮基本就能决定选型方向了。比分2.5 : 5DITA 完胜第六轮PDF 发布芯片手册的 PDF 排版要求有多高懂的都懂。AsciiDoc 用 asciidoctor-pdf开源免费能在 CI/CD 上免费用。但坦白说团队经验有限尚不能确定它能完全胜任芯片手册的高精度排版要求。简单表格 OK复杂的跨行跨列就需要不少手动处理了。DITA 这边Oxygen Chemistry 作为标配引擎可满足大部分需求。如果精度要求达到芯片数据手册级别还可以配Antenna House Formatter——业界公认的顶级排版引擎在芯片、航空、汽车行业有广泛应用。对超复杂表格嵌套、跨页保持等的支持业界最强。但别忘了这一轮的代价Desktop Chemistry 只限桌面单机使用。要做 CI/CD 自动化批量发布得掏钱买服务器授权。比分3 : 5DITA 胜第七轮内容重用多产品线这是 DITA 的祖传优势——DITA 从设计之初就以大规模内容重用为核心目标。几十个产品型号、几百个变体、每份手册都要写一次多处用——DITA 的Map Topic DITAVAL 条件发布三位一体架构在这种场景下优势突出。重用粒度可以精细到段落甚至单词级别conref、conkeyref 机制。AsciiDoc 配合 Antora 也能做组件化管理和条件发布但需要更多的架构设计和规范约束。一句话总结DITA 是天生干这活的AsciiDoc 是后天练出来的。比分3.5 : 5DITA 胜第八轮质量控制DITA 这边XML Schema/DTD 强校验 Schematron 规则检查 Terminology Checker 术语管理——三件套齐全。你可以写一条规则说所有芯片型号必须标注工作温度范围Schematron 自动检查合规性。这玩意儿在企业级文档质量管控中特别好用。AsciiDoc 这边可以用 Vale 做术语和风格检查开源社区广泛使用效果也不错。但没有 XML 层面的强 Schema 约束结构层面的错误只能在 PR 审查时人工发现。AI 校对方面两边都可以做。Oxygen AI Positron 内置了 Proofread 功能一键检查逻辑一致性和语法拼写AsciiDoc 这边可以配置 Claude Code 做 AI 审校再加 Vale 规则检查也能形成双重保障。比分3.5 : 4.5DITA 胜第九轮AI 大模型集成这轮最有意思也是变化最快的一轮。今天的大模型对 AsciiDoc 和 DITA XML 的理解能力已经基本拉平。几十万 Token 上下文窗口的时代大模型看 XML 标签和看纯文本一样顺畅。但有个反直觉的观察DITA XML 因为有强 Schema 约束AI 反而能进行更精准的结构化推理幻觉率反而低于松散的纯文本。Oxygen 的 AI Positron 提供了大量开箱即用的 DITA 感知 AI 代理扩写草稿、拆分主题、生成主题层级、自动通过 DTD/Schema 验证……是一套完整的 AI 辅助闭环。AsciiDoc 这边Claude Code / CodeX 等通用 AI Agent 生态更灵活适合研发团队自定义工作流。而且纯文本格式在 AI Agent 的工作流编排上确实更自由。总的来说DITA 在深度结构化 AI 辅助上略占优势AsciiDoc 在灵活性和可定制性上更胜一筹。比分4 : 5DITA 略胜九轮战罢总分维度权重AsciiDocDITA研发接入—55Word 转换—3.54.5费用—42.5版本管理—54.5CAT 翻译★2.55PDF 发布—35内容重用★3.55质量控制—3.54.5AI 集成—45DITA Oxygen 以 41:34 的总分胜出。关键胜负手是三个点CAT 翻译、内容重用、PDF 输出质量。如果你这三项需求都很重那 DITA 基本是必然选择。但 AsciiDoc 的优势也不容小觑零许可成本、AI Agent 生态更灵活、版本管理体验好。如果你们团队研发驱动为主翻译量不大预算有限AsciiDoc 是一个值得认真考虑的选项。那到底怎么选渐进式路径。第一步1-2个月PoC 验证。选 2-3 份典型芯片数据手册分别用两个方案走通全流程——Word 转换 → 编辑 → CAT 翻译 → PDF 输出。对比实际效果和团队体验而不是纸上谈兵。第二步3-6个月团队建设与转换。如果选 DITA培训团队、建立文档架构、建设 Git CI/CD 流水线。第三步6-12个月全面推广。新产品直接用新方案建立内容重用库。文档工具选型说到底没有银弹。别人的最佳实践不一定适合你因为你们的团队规模不一样、文档类型不一样、翻译量不一样、预算不一样、研发文化不一样。有一点我想对所有文档工程师说不管选哪个从 Word 走向结构化文档这件事本身是一定要做的。因为只有结构化文档才能真正把 AI 的能力接进来。你今天纠结的是 AsciiDoc 还是 DITA明天你会发现真正重要的是你的文档能不能被 AI 理解、能不能在 CI/CD 里自动化流转、能不能跨团队高效复用。这就是大龙想跟你们说的。本报告基于公开资料调研编写具体价格以厂商最新报价为准。如果你觉得这篇文章有帮助欢迎转发给正在做文档选型的同行。有什么想法评论区聊。