← 返回目录

第 16 讲 论文:从中文稿到投稿件

【可执行状态】现在就能做(分节写、逐节交付;不要一次要整篇)

【本讲对应资产】research-assistant 引擎(8 个工具);本讲关键工具 paper_draft(写章节草稿)、docx_polish(Word 排版)、translate_pdf(中英互译辅助);上游回接第 14 讲的 lit_card 与 term_table

【本讲原理来源】L3 第 20 课《Function Calling 深度解析》——本讲落在“工具的输出边界”这一条上:工具只做它被设计来做的那一段


引子:一篇八千字的稿子,为什么卡在第一句

先问一个具体的问题:你的论文,卡在哪里?

多数人卡的不是“不会写”,而是“写不动”——素材都齐了,数据在表里,文献卡片在抽屉里,可坐到电脑前,光标就在标题那一行闪。写标题、删标题、写引言第一句、删掉重写,两个半小时过去,文档里五百字,其中三百字你并不打算留。

更难受的是,就算正文写完了,后面还压着一关:图题在下还是表题在上、标题层级乱、表格没边框、图片被拉宽变形、页码从封面开始算。内容是自己的,格式却像别人的。

这一讲练两件事:先把章节一节一节写出来,再把稿子排成投稿件。 而且要先说清一件事——这条链上有一个坑,是踩过的,必须写在前面。

一、场景

赵老师(化名)的教改论文,材料其实都齐了:她这学期在两个班上了同一门课,一个班用她设计的课堂做法,一个班照旧;两个班的课堂练习数据、学生作品、期末成绩她都有;第 14 讲那三篇文献的精读卡也在抽屉里。投稿目标是一家教研刊物,中文稿,八千字左右。

她的困境是“写不动”三个字:

晚上八点坐下,泡好茶,打开空白文档,写标题,删标题,写引言第一句,删掉重写。到十点半,文档里五百字,其中有三百字她不打算留。第二天下班回来再看,昨天写的思路接不上,于是又从引言开始重写一遍。好比一个人反复磨同一把刀,刀刃越磨越亮,可菜一直没切。

就算写完了,还有一轮:图题在下还是表题在上、标题三级层级乱、表格没边框、图片拉伸变形、页码从封面开始算——排版一小时,改到怀疑人生。

二、原理一页:写作拆成三段,机器只干中间半段

2.1 三段:素材 → 章节 → 用词

paper_draft 的参数一共六个,正好把写作拆成三段:

参数意思谁负责
topic(必填)题目你(讲清题目与范围)
venue(必填)投给谁(刊物/场合)你(投哪里决定口吻、篇幅、要不要英文摘要)
materials(必填)素材:自有成果/应用案例/数据/文献要点你(这是全篇最重的一件事,见下条)
section章节:选题依据/研究内容/创新之处/摘要/引言/方法/讨论 等你(一次说一节)
words字数你
terms术语表(约束用词)第 14 讲 term_table 的产物

工具的输出说明里有一句很短但很重的话:输出中文草稿,不编造数据。 这句话有两层意思,第二层更要注意:

2.2 materials 是这一讲的命门

把素材给具体,草稿才有内容。赵老师应该给的不是“AI 赋能教学”,而是:

一句经验:素材里含糊的东西,草稿里会含糊地被写出来。 你不写清“两个班人数分别是多少”,它就只好写“两个班”——比如你给了“两个班共 87 人”,它才写得出“实验班 44 人、对照班 43 人”这样的句子。这不是它的错,是素材的颗粒度就这样。

2.3 术语表当闸门用

terms 传第 14 讲那张术语表(英中定译 + 频次),作用是约束用词。它解决的是本读本反复强调的一件事:同一篇稿子里一个概念只能有一个说法。这一步不做,后面改了又改,最后还是得靠人工全篇替换。好比先把门框尺寸定死,后面的门板才不用一块一块削。

2.4 必须如实说的短板(本讲第一条纪律)

paper_draft 有一个真实的限制,写在这里,不许粉饰:

一次把整篇逐节连着跑,会在第 3 节之后卡住。 真实碰到过的一次是 49 分钟没有响应。

所以正确用法是:分节写、逐节交付。

这不只是绕坑。它顺带符合写作的规律:每一节都过你一遍,全文才是你的。 如果你要的是“一次生成八千字”,那你要的其实不是写作辅助,是代写——那条线在本讲第五栏。

2.5 历史纵深:论文排版走过四代,每一代都在拆开“内容”和“格式”

排版这件事,人类折腾了五百多年,主线只有一个:把“写什么”和“长什么样”拆开。

第一代,铅活字。 十五世纪古腾堡的活字印刷,把整页文字拆成一个个可重排的铅字。它一次排好版就能印很多份,但改一个字,可能要把整版重排。这一代的痛点很清楚:格式与内容焊死在一起,动一处牵全身。

第二代,打字机与蜡纸油印。 上世纪,打字机进了办公室,改字容易多了;可一份稿子里的标题字号、缩进、行距,还是靠敲空格和回车一点点对付出来的。比如想把一个三级标题排得像样,得手动空几行、加粗、居中对齐——换个稿子,这套手感全归零。

第三代,Word 的样式与模板。 八十年代末到九十年代,字处理软件里出现了“样式”:段落不再靠手调,而是标成“一级标题”“正文”,长什么样由样式统一管。这一步的关键不是好看,是解耦——内容只说自己“是什么”,格式由样式说了算。 到九十年代末,这套思路被模板化:教务处发的那份《课程教学大纲(2026版)》,就是一个已经配好样式的模板。

第四代,模板引擎与本文这一讲的 docx_polish。 学术排版上,TeX(一九七八年)与后来的 LaTeX(一九八四年)把“内容与格式分离”做到了极致:作者只写“这里是一节”“这里是一张表”,长什么样交给模板类文件[1]。docx_polish 走的是同一条路——你只管内容,中文字体、标题层级、图题表题、表格边框、图片缩放、页码这六件事由它一次做完。

回头看这四代,规律一直没变:每一次进步,都是把一件人必须反复做的“手工活”变成一次配置。 铅活字把版拆成字,Word 把格式拆成样式,模板引擎把样式拆成模板——到今天,你只需要把内容定稿,格式交给工具跑一遍。

2.6 排版为什么必须放在最后

docx_polish 管六件事:中文字体、标题层级、图题表题、表格边框、图片缩放、页码。

它为什么放在最后:内容一改,段落增减,页码和图表位置全都变。先定内容,再排版;改完内容,重排一次。 不要一边排一边改文字。好比先定好菜的份量再摆盘——盘子摆好了才想起要加菜,就得重摆一遍。

2.7 设问自答之一:AI 参与写的稿子,能投吗

这个问题要拆成两半回答,两半的答案不一样。

能投的,是“你自己写的稿子,工具做了辅助”。 数据是你自己采集的,案例是你自己实施的,结论是你自己得出的;工具帮你把已知的东西组织成文字、把格式排整齐。这种情况可以投,但必须按学校与拟投刊物的规定如实声明 AI 的使用情况。不少刊物已经有 AI 使用声明的栏位,隐瞒使用,比使用本身严重得多。

不能投的,是“工具替你写出来的稿子”。 不给学生写论文、不替同事写、不生成不存在的实验与调查、不生成不存在的参考文献——这几条在任何时候都不放松。一篇你读都没读过、一个字没改过的稿子,署上你的名字投出去,那不是写作辅助,是代写。

一条判断标准很好用:“这篇稿子的每一节,我能不能讲清楚它的数据从哪来、结论怎么得到?” 讲得清,是辅助;讲不清,就是在用别人的话替自己署名。

2.8 设问自答之二:查重会不会出问题

会有人问:工具写的句子,查重系统一查,会不会判我重复?

把风险分三层看,就清楚了。第一层是文本重合。 查重比的是文字重合度;如果草稿里出现了你没给过、来源又不明的整句,那才是真正的风险点——这也是本讲校验点第一条要求“每个数字都能在素材里找到”的原因。第二层是“伪原创”。 用工具把别人的段落改写一遍来降重,这不是技巧,是学术不端;本书明确不做这件事,也不教这件事。第三层也是最要紧的一层:查重查不出“是谁写的”。 就算文字重合度为零,只要你的实质贡献是空的,署名就是虚的。

所以正确的态度是:把查重当成一道下限,不当成目标。 你要的不是“查得出查不出”,而是“这篇东西确实是我的研究”。好比体检报告正常,不代表你身体一定好,但它是一条底线;把底线当终点,就本末倒置了。

2.9 设问自答之三:为什么不能一次要整篇

因为会卡住——这不是态度问题,是实测过的能力边界。

假设你贪快,一次让它把引言、方法、讨论连着写下来。跑到第 3 节之后,它就不动了;真实碰到过的一次是 49 分钟没有响应。你损失的不只是那 49 分钟,还有“到底写到哪一节了、哪一段是好的”这份确定性。

分节跑反而更快:每一节几分钟出草稿,你当场读、当场改,下一节拿上一节的定稿去接。二十页的稿子,一节一节走,走得比“一次要八千字”稳当得多。

2.10 对照表:整篇跑与分节跑,差在哪里

对比维度一次要整篇分节写、逐节交付
实测结果第 3 节之后卡住(曾 49 分钟无响应)每节独立返回,一节一份草稿
你对稿子的掌控交上来才发现不对,全篇重来每节过你一遍,错了只重跑这一节
上下文衔接一次性铺开,写到后面容易跑偏把上一节定稿放进 materials,接得住
责任归属容易滑向“整篇都是它写的”每节都留你的改动痕迹
适合谁想省事的人想投出去的人

2.11 对照表:中文稿与投稿件,是两份东西

阶段你手上的东西形态判据
章节草稿一节一份中文草稿内容为主,格式不管数字可追、术语一致、引用可溯源
定稿内容全部定下来的完整 docx内容不再动每一节你都读过、改过
投稿件docx_polish 排过一遍的 docx字体/层级/图表/页码齐整合规投稿须知

顺序不能反:先草稿、再定稿、最后排版。 比如你排完版又改了一段文字——页码和图表位置就会跟着错,得重排一次。

三、动手三件套

一句话指令(分节版,一节一条)

跑一节(示例:方法一节):

用 paper_draft 写这篇论文的“方法”一节:topic 是“生成式人工智能赋能高校课堂教学的实践探索”,
venue 是《……》(中文教研刊物,读者是高校教师),section 用“方法”,words 写到 1200 字左右。
materials 我给的是:①我自己的课堂做法与完整实施过程(附文本);②两个班的练习数据、作品评分与
期末成绩(附表,含口径与时间);③三篇文献的要点(附三张精读卡)。
terms 用我给的术语表,约束译名与用词。写完这一节停下,我读完再跑下一节。

排版(内容全部定稿之后):

用 docx_polish 把这份定稿 docx 排一遍:中文字体统一、标题分成三级、图题表题按投稿要求、
表格加边框、图片等比缩放不放宽变形、页码加在中下。内容不要动。

翻译(需要时):

用 translate_pdf 把这份中文 PDF 保真直转成 Word,url 是……,mode 用 convert。

预期产物

校验点(照这六条量)

  1. 数字可追:草稿里每一个数字都要能在 materials 里找到。找不到的一律删掉——它不该有而有了,就是“编数据”的口子,必须立刻回查。
  2. 术语一致:拿术语表逐词对一遍,同一概念是否只有一个说法。
  3. 引用溯源:草稿里提到的文献要点,回到精读卡,再回到英文原文;没核过的不引。
  4. 合刊物的要求:结构顺序、字数区间、图表数量、参考文献格式,按投稿须知一条条对【需补:目标刊物的投稿须知条目清单】。
  5. 排版六件事齐:中文字体、标题层级、图题表题、表格边框、图片缩放、页码,六项逐项看。
  6. 逐节留痕:投稿件里应该找得到你的笔迹——每一节你都读过、改过、同意过。一篇“原样无改动”的稿子,不该以你的名字投出去。

四、常见错误与排错

症状查哪里
逐节连着跑,第 3 节之后不动了这是已知短板(曾 49 分钟无响应)。改成一次只要一节,逐节交付,别一次要整篇
草稿很“满”但没内容,全是套话materials 太空。补具体的做法、数据、案例;题目越空,草稿越像百科词条
出现了你没给过的数字立即回查素材来源;对不上的删掉。数据只能出自你自己
术语前后不一致没传 terms。把术语表补上,重跑该节
图片变形、表格没边框、页码从封面开始docx_polish 之前先在 Word 里把内容改定,再排;不要边排边改
排版后又改了文字改完内容要重排一次,否则页码与图表位置会错
外文摘要读着别扭机器对译只是辅助,外文终稿必须人核、人改
想“一次生成整篇八千字”这不是写作辅助,是代写。见下一栏

五、边界与红线(本讲是学术诚信最重的一讲)

六、拓展与学科迁移


带走一句话

机器能替你排好版,替你组织句子;但那句“这是我的研究”,只能你自己说。

背后的引擎(本讲速查)

你要干的活工具全名关键参数
基于素材写章节草稿mcp__research-assistant__paper_drafttopic、venue、materials(必填)、section(一次一节)、words、terms(术语表)
Word 排版mcp__research-assistant__docx_polishdocx_url(内容定稿后再排)
中英互译辅助(外文 PDF 译中文 / 中文 PDF 直转)mcp__research-assistant__translate_pdfurl、mode(auto/translate/convert)、filename
供文献要点与术语表(上游)mcp__research-assistant__lit_card/mcp__research-assistant__term_tablepdf_url + meta;texts_json

本讲要点(速记)

参考文献

[1] Lamport L. LaTeX: A Document Preparation System[M]. Reading, MA: Addison-Wesley, 1986.(LaTeX 的权威说明;TeX 由 D. E. Knuth 于 1978 年前后开发,LaTeX 于 1984 年前后出现,二者共同确立了“内容与格式分离”的排版范式)

[2] 中华人民共和国国家质量监督检验检疫总局, 中国国家标准化管理委员会. 信息与文献 参考文献著录规则: GB/T 7714—2015[S]. 北京: 中国标准出版社, 2015.

[3] 教育部. 高等学校预防与处理学术不端行为办法: 教育部令第 40 号[Z]. 2016-06-16.(抄袭、篡改、代写、伪造等行为的界定依据)

[4] 中共中央办公厅, 国务院办公厅. 关于进一步加强科研诚信建设的若干意见[Z]. 2018-05.(科研诚信与学术规范的总体要求)

数据与平台:本讲工具参数(paper_draft 的 topic/venue/materials/section/words/terms;docx_polish 的 docx_url;translate_pdf 的 mode 取值)来自 zhenyuonline.cn 的 research-assistant 引擎(2026-09-17 核对)。

文中“整篇逐节连着跑会在第 3 节之后卡住、曾 49 分钟无响应”为实测使用中确认的能力边界,如实写出,不作粉饰;

本讲不给出任何未经实测的字数产出率或排版耗时数字。文中刊物投稿要求处以【需补】标注,待按目标刊物补录。