计算机论文降AI后发现变量名、函数名或参数名变了,先恢复与真实代码一致的标识符,再润色解释文字。代码里的名称承担定位作用,正文可以换一种说法解释它,但不能随意把名称也换成近义词。
本文讨论论文表达的编辑方法,不涉及验证程序正确性。以下例子由编辑原创,仅用于说明文稿问题,不是PaperMomo或其他工具的运行结果。
名称只差一点,可能已经指向另一件事
设正文原来写:“函数load_batch读取输入,参数batch_size决定每次处理的数量。”如果改成“函数load_batches载入数据,并根据batchSize控制输入规模”,读者再去代码中查找,可能一个名称也找不到。
即便作者觉得下划线写法和驼峰写法“意思相同”,论文仍然需要使用项目中实际存在的名字。这里不必引入复杂的语言规则,只需打开自己的代码,确认到底采用哪一个名称。若源代码后来确实改名,则应同步更新正文,而不是长期保留两个互相竞争的版本。
还要留意范围词。“输入数据的数量”“每批数据的数量”“训练样本总量”读起来都像规模说明,却可能分别指不同对象。变量名没有改变,解释范围改变,同样会影响读者理解。
把程序片段与作者说明分开处理
可以把待修改内容分成三部分:需要原样对照的代码或伪代码;必须保持准确的标识符;可以改善表达的自然语言说明。前两部分作为参照,第三部分才是主要的措辞处理对象。
如果一段中代码和解释交替出现,可以先复制作者说明去处理,再带着源代码把结果放回原位置。这样不需要假定工具拥有某种代码保护开关,也容易看清它是否把“调用”“返回”“初始化”几个动作改了顺序。
对于整份Word稿,关键代码截图、公式与代码块也应在下载后单独查看。只看在线文字预览,不足以确认缩进、行号或符号仍可阅读。
伪代码重点看动作,正文重点看对应
伪代码未必采用某一种语言的可执行语法,但它仍应与论文解释一致。原来先筛选再计算,不能在改写后的说明中变成先计算再筛选;原来循环在条件满足时停止,不能为了简洁删掉停止条件。
可以从一个输入开始,用自己的话顺着正文讲一次过程,再看伪代码是否按相同顺序运行。如果讲到某一步需要临时补上正文没有的前提,就应补写说明。这里的目标是让读者能够理解方法,而不是增加术语数量。
一份很短的名称表就足够:正式名称、含义、出现位置。对重复出现的关键参数,检查摘要、方法、图注和实验设置是否同名;对路径、版本号等只出现一次的文本,则直接与实际材料核对。不要把所有普通英文单词都锁死,否则表达会被无必要地束缚。
PaperMomo的产品说明强调尽量保留专业术语、原意和逻辑。对计算机论文,可以先在文本模式改善一段算法解释,再以真实代码作为采用依据;产品定位并不等于自动替作者验证代码。
若论文同时有大量实验描述,可阅读工科实验论文的表达整理。最终留下的段落,应让读者既能读懂“为什么这样做”,也能准确找到“代码里在哪里做”。