Guide
数学译本制作指南
制作规范
了解本站推荐的翻译、术语与排版规范。
制作流程
从 PDF 提取、AI 翻译到校对发布。
LaTeX 模板
MathTranslations-Translation-Template.zip · 直接下载
从原书处理、AI 翻译到 LaTeX 排版与最终校对,这里整理了一套我们推荐的数学译本制作流程与排版规范。
我们不要求所有译本拥有完全相同的风格,但希望通过一些基本规范,使译本更加准确、统一,也更方便阅读与后续维护。
一、数学译本制作规范
1. 忠于原文
数学翻译首先是翻译。
除明显的识别错误或原书笔误外,不应自行补充原书没有的解释、证明或例子,也不应仅仅为了让中文读起来更加自然,就改变原句的数学含义。
2. 数学正确优先于语言流畅
译文可以在语言上稍显生硬,但量词、逻辑关系、假设条件、否定关系以及公式含义不能发生变化。
当“更自然的中文表达”与“精确保留原意”发生冲突时,应以后者为先。
3. 术语保持统一
同一本译著中,同一个数学概念原则上只使用一种中文译名。
已有成熟译法的术语,优先使用通行译名;尚无稳定中文译法的术语,可以参考本站术语表,并在首次出现时保留英文原词。
4. 保留原书的数学结构
章节、定义、定理、命题、推论、引理、公式、脚注、图片、参考文献以及它们之间的关系,都应尽可能与对应版次原书保持一致。
特别是定理、公式等编号,最终显示结果应与对应版次原书一致。
5. 使用真正的交叉引用
目录中的章节应支持点击跳转;正文中对章节、定理、命题、公式、图片和参考文献的引用,也应尽可能使用 LaTeX 的交叉引用机制。
例如,原书写作:
By Theorem 3.4 ...
不可直接写成:
根据定理 3.4……
而应使用类似:
根据定理~\ref{thm:xxx}……
公式同理:
由式~\eqref{eq:xxx}……
不应为了保持原书编号而直接将编号写死。必要时可以调整计数器、定理环境或编号机制,使最终显示编号与原书一致。
二、排版规范
1. 首页信息
译本首页应至少包含:
- 原书书名;
- 原作者;
- 对应原书的出版时间、出版社、出版版次;
- 译者;
- 翻译所使用的主要模型;
- 译本版本或最后更新时间。
2. 术语索引
建议在译本末尾加入术语索引,收录书中主要数学术语,并列出:
- 中文术语;
- 对应英文术语;
- 第一次出现的页码。
3. 中文字体
本站推荐的基本排版为:
- 正文:宋体;
- 新定义或首次强调的数学术语:楷体;
- 定义、定理、命题、推论、引理、注、例等环境:仿宋。
第一次正式定义一个新概念时,可以写作:
\emph{概型}(scheme)
同一术语在后文普通行文中再次出现时,不需要反复使用楷体,也不必再次附注英文。
4. 英文字体
英文与西文数学排版使用有衬线字体,本站模板默认采用 Computer Modern 系列。
5. 标点
中文正文原则上使用中文标点符号;句子末尾统一使用半角英文句点 .。
数学公式内部的标点按照数学排版需要处理。
三、本站模板
为了减少重复配置,数译提供了一份可以直接使用的中文数学译本 LaTeX 模板。
下载 MathTranslations-Translation-Template.zip
你也可以使用自己的模板,只要最终译本满足上述基本规范即可。
本站模板在这些基本规范之外,还提供:
- “注”和“例”等环境结束时自动显示
◇; - 长证明支持跳转回其引用位置;
- 提供习题环境;
- 习题可以跳转至对应参考答案;
- 参考答案可以跳转回对应习题;
- 已配置目录、定理、公式与文献的超链接;
- 已配置推荐的中英文字体与基本版式。
建议将模板与原书、MinerU 提取文件放在同一工作目录中,再交由大模型进行翻译和重排。
数学译本制作流程
下面是一套我们推荐的大模型辅助数学书翻译流程:
原书 PDF → MinerU → Markdown 初稿 → 大模型翻译与 LaTeX 重排 → 编译检查 → 对照原书校对 → 发布
这并不是唯一的翻译方法,但比较适合目前的大模型工作流。
第一步:准备原书
尽量保留原始 PDF。
原书始终是译本内容的最高依据。
MinerU 或其他工具提取出的 Markdown、LaTeX 都只是工作底稿,不能代替原书。
遇到以下情况时,应直接回到 PDF 检查:
- 公式识别异常;
- 上下标丢失;
- 数学符号混淆;
- 脚注位置异常;
- 定理或公式编号错误;
- 图片、交换图缺失;
- 段落顺序异常;
- 参考文献识别错误。
第二步:使用 MinerU 提取原书
MinerU 是一款开源的文档解析工具,可以将 PDF 中的大部分正文结构、公式和图片信息提取为 Markdown 等格式。
MinerU:
https://mineru.net/OpenSourceTools/Extractor
我们目前更推荐将 Markdown 作为交给大模型的工作底稿。
MinerU 的主要作用并不是生成一份可以直接发布的 TeX,而是帮助大模型取得:
- 正文内容;
- 数学公式;
- 章节层级;
- 定理环境;
- 表格;
- 图片位置;
- 文献与脚注信息。
提取完成后,仍然需要以原始 PDF 为依据重新检查和整理。
第三步:准备 LaTeX 模板
下载本站提供的 MathTranslations-Translation-Template.zip,解压后放入工作目录。
你也可以使用自己的 LaTeX 模板,但建议至少满足前文的《数学译本制作规范》。
在开始翻译前,一个典型的工作目录可以包含:
原书.pdf
原书.md
MathTranslations-Translation-Template.tex
图片/
第四步:交给大模型翻译与重排
建议使用能够直接读取和修改工作目录文件的 Agent。
本站不限定具体的大模型或 Agent。将原书 PDF、MinerU 提取的 Markdown 与模板放入同一工作目录后,可以参考下面的提示词开始工作。
推荐提示词
这里是我要翻译并重新进行 LaTeX 排版的数学书原文件,以及 MinerU 提取的 Markdown 文件。
请根据原书和 MinerU 提取的 Markdown 完成中文翻译与 LaTeX 重排。
【优先级】
1. 原书是正文内容、数学公式、章节结构和编号的最高依据。
2. MinerU 生成的 Markdown 仅作为文字、公式和结构提取的工作底稿;如与原书冲突,以原书为准。
3. MathTranslations-Translation-Template.tex 是排版规范的最高依据。若现有 LaTeX 排版与模板冲突,以模板为准。
【翻译要求】
- 忠于原文,不自行增加、删除或改写正文内容。
- 数学正确性优先于语言润色。
- 保留原书的章节、定理、定义、命题、推论、引理、例子、公式、脚注和参考文献关系。
- 数学术语在全文中保持一致。
- 新定义的术语在首次出现时使用 \emph{} 标记,并在必要时附注英文原词。
- 对没有稳定中文译名的术语,必要时在首次出现时保留英文。
- 中文正文除句末使用半角英文句点外,其余原则上使用中文标点。
- 不改变数学符号、变量名以及公式含义。
【LaTeX 要求】
- 实现完整的交叉引用。
- 定理、公式、章节、图片等引用应使用 \label、\ref、\eqref 等机制,不要直接写死编号。
- 最终显示的章节、定理和公式编号应与对应版次原书一致。
- 必要时可以修改定理环境、计数器、宏和编号机制,使编号与原书一致,但不得因此改变正文内容。
- 保证最终文档可以正常编译。
- 不应为了绕过编译错误而删除正文、公式、引用或数学结构。
【排版要求】
排版以 MathTranslations-Translation-Template.tex 为准。
超链接颜色遵循原模板:
- 普通内部链接:MidnightBlue
- 文献引用:BrickRed
- 网址:MidnightBlue
- 目录中的标题与页码均可点击
- 不显示链接边框
前言、序言或引言结束后,应与正文第一章保持适当的视觉间距,不要过于紧凑。
封面右下角出版社信息下方增加:
译者 翻译及重排
字号略大于出版社信息。
如果模板要求与原书内容发生无法自动解决的实质冲突,不要擅自修改正文,先指出问题。
【校对要求】
完成排版并成功编译后,至少进行三轮检查。
第一轮:数学检查
重点对照原书检查:
- 公式;
- 变量;
- 上下标;
- 数学符号;
- 量词;
- 假设;
- 结论;
- 否定关系。
第二轮:术语检查
检查全文数学术语是否统一,尤其注意同一个英文术语是否在不同章节中被翻译成了不同中文。
第三轮:排版检查
检查:
- 章节编号;
- 定理编号;
- 公式编号;
- 交叉引用;
- 目录;
- 页眉页脚;
- 脚注;
- 图片;
- 参考文献;
- 超链接。
发现问题后直接修正,并重新编译检查。
第五步:编译与校对
大模型完成初稿并不意味着翻译已经结束。
至少需要进行三类检查:
数学检查
逐段对照原书,重点检查公式、符号、变量、上下标、量词、条件和结论。
术语检查
检查全文术语是否统一,尤其关注同一个英文术语在不同章节中的译法。
可以结合本站术语表进行统一。
排版检查
检查定理与公式编号、交叉引用、目录、脚注、图片、参考文献和超链接是否正常。
第六步:发布与继续维护
完成检查后,可以将译本的 PDF 与 TeX 工程上传到数译。
译本并不需要在第一次发布时就达到“最终版本”。发现错误后,可以继续修订并发布新的版本;旧版本仍然会被保留,勘误和讨论也可以继续围绕具体版本进行。
一个好的译本不是一次生成出来的,而是在翻译、阅读、校对和修订中逐渐完善的。