制作指南 · Guide

数学译本制作指南

从原书处理、AI 翻译到 LaTeX 排版与最终校对,这里整理了一套推荐的数学译本制作流程与排版规范。我们不要求所有译本风格完全一致,但遵循基本规范能使译本更准确、统一,也更方便维护。

一、数学译本制作规范

1. 忠于原文

数学翻译首先是翻译。

除明显的识别错误或原书笔误外,不应自行补充原书没有的解释、证明或例子,也不应仅仅为了让中文读起来更加自然,就改变原句的数学含义。

2. 数学正确优先于语言流畅

译文可以在语言上稍显生硬,但量词、逻辑关系、假设条件、否定关系以及公式含义不能发生变化。

当“更自然的中文表达”与“精确保留原意”发生冲突时,应以后者为先。

3. 术语保持统一

同一本译著中,同一个数学概念原则上只使用一种中文译名。

已有成熟译法的术语,优先使用通行译名;尚无稳定中文译法的术语,可以参考本站术语表,并在首次出现时保留英文原词。

4. 保留原书的数学结构

章节、定义、定理、命题、推论、引理、公式、脚注、图片、参考文献以及它们之间的关系,都应尽可能与对应版次原书保持一致。

特别是定理、公式等编号,最终显示结果应与对应版次原书一致。

5. 使用真正的交叉引用

目录中的章节应支持点击跳转;正文中对章节、定理、命题、公式、图片和参考文献的引用,也应尽可能使用 LaTeX 的交叉引用机制。

例如,原书写作:

By Theorem 3.4 ...

不可直接写成:

根据定理 3.4……

而应使用类似:

根据定理~\ref{thm:xxx}……

公式同理:

由式~\eqref{eq:xxx}……

不应为了保持原书编号而直接将编号写死。必要时可以调整计数器、定理环境或编号机制,使最终显示编号与原书一致。


二、排版规范

1. 首页信息

译本首页应至少包含:

  • 原书书名;
  • 原作者;
  • 对应原书的出版时间、出版社、出版版次;
  • 译者;
  • 翻译所使用的主要模型;
  • 译本版本或最后更新时间。

2. 术语索引

建议在译本末尾加入术语索引,收录书中主要数学术语,并列出:

  • 中文术语;
  • 对应英文术语;
  • 第一次出现的页码。

3. 中文字体

本站推荐的基本排版为:

  • 正文与例环境:宋体;
  • 新定义或首次强调的数学术语:楷体;
  • 定义、定理、命题、推论、引理、注等环境:仿宋。

第一次正式定义一个新概念时,可以写作:

\emph{概型}(scheme)

同一术语在后文普通行文中再次出现时,不需要反复使用楷体,也不必再次附注英文。

4. 英文字体

英文与西文数学排版使用有衬线字体,本站模板默认采用 Computer Modern 系列。

5. 标点

中文正文原则上使用中文标点符号;句子末尾统一使用半角英文句点 .。

数学公式内部的标点按照数学排版需要处理。


三、本站 LaTeX 模板

为了减少重复配置,数译提供了一份可以直接使用的中文数学译本 LaTeX 模板。

下载 mathtranslations-translation-template.zip

你也可以使用自己的模板,只要最终译本满足上述基本规范即可。本站模板还提供:

  • “注”和“例”等环境结束时自动显示 ◇;
  • 长证明支持跳转回其引用位置;
  • 提供习题环境,且习题与参考答案可互相跳转;
  • 已配置目录、定理、公式与文献的超链接;
  • 已配置推荐的中英文字体与基本版式。

建议将模板与原书、MinerU 提取文件放在同一工作目录中,再交由大模型进行翻译和重排。如果使用下文的数学翻译 Skill,则无需手动下载和放置模板,skill 会自动提供。


数学译本制作流程

原书 PDF → MinerU 提取 → Markdown 初稿 → 大模型翻译与 LaTeX 重排 → 编译检查 → 对照原书校对 → 发布

第一步:准备原书

尽量保留原始 PDF。原书始终是译本内容的最高依据。

MinerU 或其他工具提取出的 Markdown、LaTeX 都只是工作底稿,不能代替原书。遇到以下情况时,应直接回到 PDF 检查:

  • 公式识别异常、上下标丢失或数学符号混淆;
  • 脚注位置异常、定理或公式编号错误;
  • 图片、交换图缺失,或段落顺序异常;
  • 参考文献识别错误。

第二步:使用 MinerU 提取原书

MinerU 是一款开源的文档解析工具,可以将 PDF 中的大部分正文结构、公式和图片信息提取为 Markdown 等格式。

MinerU 官方工具:https://mineru.net/OpenSourceTools/Extractor

我们推荐将 Markdown 作为交给大模型的工作底稿,用来提取正文、数学公式、章节层级、定理环境、表格、图片位置和文献脚注。

第三步:准备 LaTeX 模板

下载本站提供的 mathtranslations-translation-template.zip,解压后放入工作目录。

在开始翻译前,一个典型的工作目录结构如下:

原书.pdf
原书.md
mathtranslations-translation-template.tex
图片/

第四步:交给大模型翻译与重排

建议使用能够直接读取和修改工作目录文件的 Agent。将原书 PDF、MinerU Markdown 与模板放入同一目录后,可参考以下提示词开始工作:

这里是我要翻译并重新进行 LaTeX 排版的数学书原文件,以及 MinerU 提取的 Markdown 文件。

请根据原书和 MinerU 提取的 Markdown 完成中文翻译与 LaTeX 重排。

【优先级】
1. 原书是正文内容、数学公式、章节结构和编号的最高依据。
2. MinerU 生成的 Markdown 仅作为文字、公式和结构提取的工作底稿;如与原书冲突,以原书为准。
3. mathtranslations-translation-template.tex 是排版规范的最高依据。若现有 LaTeX 排版与模板冲突,以模板为准。

【翻译要求】
- 忠于原文,不自行增加、删除或改写正文内容。
- 数学正确性优先于语言润色。
- 保留原书的章节、定理、定义、命题、推论、引理、例子、公式、脚注和参考文献关系。
- 数学术语在全文中保持一致。
- 新定义的术语在首次出现时使用 \emph{} 标记,并在必要时附注英文原词。
- 对没有稳定中文译名的术语,必要时在首次出现时保留英文。
- 中文正文除句末使用半角英文句点外,其余原则上使用中文标点。
- 不改变数学符号、变量名以及公式含义。

【LaTeX 要求】
- 实现完整的交叉引用。
- 定理、公式、章节、图片等引用应使用 \label、\ref、\eqref 等机制,不要直接写死编号。
- 最终显示的章节、定理和公式编号应与对应版次原书一致。
- 必要时可以修改定理环境、计数器、宏和编号机制,使编号与原书一致,但不得因此改变正文内容。
- 保证最终文档可以正常编译。
- 不应为了绕过编译错误而删除正文、公式、引用或数学结构。
- 对于插图(原书 PDF 质量较好、图片清晰的情形),优先进行截图处理;比较简单的插图统一使用 tikz 绘制;交换图统一使用 tikz-cd 绘制。
- 行间公式统一使用 align、aligned 或 align* 环境,不要出现多个 \[ \] 并列的情形。
- 有序列表一律使用 enumerate 环境,不要手动编号。
- 中文双引号的前引号应当使用 ``,因为 '' 显示的是后引号。

【排版要求】
排版以 mathtranslations-translation-template.tex 为准。
超链接颜色遵循原模板:
- 普通内部链接:MidnightBlue
- 文献引用:BrickRed
- 网址:MidnightBlue
- 目录中的标题与页码均可点击
- 不显示链接边框

前言、序言或引言结束后,应与正文第一章保持适当的视觉间距,不要过于紧凑。
封面右下角出版社信息下方增加:
译者 翻译及重排
字号略大于出版社信息。

如果模板要求与原书内容发生无法自动解决的实质冲突,不要擅自修改正文,先指出问题。

【校对要求】
完成排版并成功编译后,至少进行三轮检查。
第一轮:数学检查(对照原书检查公式、变量、上下标、数学符号、量词、假设、结论、否定关系)
第二轮:术语检查(检查全文术语是否统一,尤其是同一个英文术语在不同章节中的译法)
第三轮:排版检查(检查章节、定理、公式编号、交叉引用、目录、页眉页脚、脚注、图片、文献与超链接)

发现问题后直接修正,并重新编译检查。

第五步:编译与校对

大模型完成初稿并不意味着翻译已经结束。至少需要进行三类检查:

  • 数学检查:逐段对照原书,重点检查公式、符号、变量、上下标、量词、条件和结论。
  • 术语检查:检查全文术语是否统一,结合本站术语表对关键术语进行统一。
  • 排版检查:检查定理与公式编号、交叉引用、目录、脚注、图片、参考文献和超链接是否正常。

第六步:发布与继续维护

完成检查后,可以将译本的 PDF 与 TeX 工程上传到数译。

译本并不需要在第一次发布时就达到“最终版本”。发现错误后,可以继续修订并发布新的版本;旧版本仍然会被保留,勘误和讨论也可以继续围绕具体版本进行。

一个好的译本不是一次生成出来的,而是在翻译、阅读、校对和修订中逐渐完善的。


使用数学翻译 Skill 加速流程

本站维护了一套专门的数学翻译 Agent Skill,将上述工作流打包为可复用的自动化指令。安装后,只需把原书 PDF、MinerU 提取的 Markdown 和图片交给 Agent,调用 skill 即可自动完成:术语表建立、中文 LaTeX 生成、编译检查、术语一致性校验与交叉引用审计。

1. 安装 Skill

安装只需一次,而且这一步本身就可以交给 Agent——把仓库地址发给它,让它自己下载安装:

帮我把数学翻译 skill 下载安装到你的 skills 目录,仓库地址:https://github.com/libinyam/mathtranslations-skill

装好后,Agent 就能识别 $mathtranslations 指令,并使用 skill 内置的工作流、模板与审计脚本。如果你的 Agent 不方便自行安装,再手动获取也不迟:在终端执行 git clone https://github.com/libinyam/mathtranslations-skill.git,或在 GitHub 仓库页面下载 ZIP 解压,把仓库放进 skills 目录即可。

2. 翻译一本书

日常使用就是和带图形界面的 Agent 正常对话:把材料放进同一个文件夹(或直接拖进对话窗口),用平时说话的方式交代任务。文件夹里只需要原书和 MinerU 提取的产物:

工作目录/
  原书.pdf
  原书.md
  图片/

不需要自己下载 LaTeX 模板——skill 自带最新版的 MathTranslations 模板和封面图标,Agent 开始排版时会自动复制进项目。不必手动放一份旧模板进去:skill 会优先采用你放的文件,反而可能用过期版本。

然后在对话框里说清楚你要什么,比如:

用 $mathtranslations 把这本书翻译成中文 LaTeX 译本,编译通过后把结果和需要我确认的地方告诉我

Agent 会先建立术语表,再逐章翻译、按数译模板排版、编译检查,完成后报告编译结果、术语一致性问题以及需要人工复核的疑点。

如果你的 Agent 不认识 $mathtranslations 这种快捷写法,直接点名让它读 skill 文件也可以:

按 mathtranslations 这个 skill 的流程来:先读它的 SKILL.md,然后把这本书翻译成中文 LaTeX,做完编译和校对

3. 审校已有译稿

已经有一份中文 LaTeX 译本、想让它对照原书复核一遍?同样一句话的事:

用 $mathtranslations 对照原书 PDF 把这个译本复核一遍,术语不一致、引用和排版的问题都修掉

Agent 会逐节比对译文与原书,检查术语、交叉引用和编译警告,改完后把修改清单列给你确认。

4. 运行审计

skill 自带审计脚本,用来查重复标签、未定义引用、缺失图片、模板漂移这类肉眼难发现的问题。翻译和审校流程结束前,Agent 会自动运行它;如果你想单独复查某个项目(比如发布之前),直接让 Agent 再跑一遍:

用 $mathtranslations 的审计脚本,严格模式检查这个项目,把发现的问题列出来