三月的第一个周五凌晨两点,我把最后一遍pdfinfo的输出截图存进文件夹,然后点了投稿系统里那个按钮。那一刻其实没什么仪式感,只有一种"终于不用再改图三的字体了"的解脱。真正让我印象深刻的是后面这八个月:等审稿意见的两个多月、收到三份风格完全不同的评审报告、写答复信、等最终决定,以及录用之后 camera-ready 阶段的兵荒马乱。IROS24 对我来说,从头到尾都不只是"写一篇论文"那么简单。
这篇就是我把自己这次投稿 IROS24 的全过程拆开写下来的记录,从选会、投稿系统里那些明显坑、答复信的写法、常见审稿意见的潜台词,一直写到 camera-ready 和现场展示。适合两类人看:一是第一次往机器人领域顶会投会议论文的博士生和工程师,想知道"除了写论文之外还有哪些环节会翻车";二是投过几次、但总在审稿意见上吃亏的人,我把高频意见的潜台词和应对方式整理成了可以直接参照的模板。需要提前说明的是,这不是官方指南,所有规则永远以当年的 Call for Papers 和会议邮件为准,我写的都是自己踩过或者眼看着别人踩过的实战细节。
1. 选会这一步就决定了后面半年的节奏
1.1 我为什么在 ICRA 和 IROS 之间选了 IROS
机器人方向有两条主干道,ICRA 和 IROS 都是 IEEE 体系下的旗舰会议。最直观的区别是时间错位:ICRA 一般五月开,截稿在前一年九月前后;IROS 一般十月开,截稿在当年三月前后。这个错位对很多人来说是决定性的——如果你的实验结果是秋季才跑出来的,ICRA 那个窗口实际上等于没赶上,IROS 就是唯一现实的会议窗口。
流传比较广的一个说法是"IROS 偏系统与应用,ICRA 偏算法与理论"。我不完全同意这个二元划分,但有一点是确实的:IROS 有 interactive session 的传统,现场带实物演示、和同行站着聊一个下午的机会更多。如果你的工作里有真实机器人平台、有系统集成、有像样的 demo 视频,IROS 的审稿池通常对这种呈现形式接受度不错。
还有一个经常被忽略的成本项:会议论文录用之后必须到场展示,不去会被从 proceedings 里撤掉,这是硬规定。所以选会的时候得把"十月我能不能去"算进去。IROS24 在阿布扎比,十月中旬,从国内飞过去要转机,加上会期,整个行程基本要占掉一周半。这个时间成本在决定投稿之前就该想清楚。
1.2 RA-L 那条路:快,但节奏不由你控制
RA-L 是滚动投稿的期刊,录用之后可以选择在 ICRA 或者 IROS 上做 presentation。它的好处很明确:没有硬 deadline,随时可以投;它的代价也很明确:审稿周期不可控,两到三个月是常态,遇上拖延的审稿人拖到四个月以上也不罕见。而且 RA-L 对页数的限制更紧,超页费用更贵,它更偏好"一个完整闭环的小故事",对那种系统庞大、图特别多、需要八页才讲得完的工作其实不太友好。
我当时判断的标准很简单:这份工作如果压缩到六页,剩下的信息量还能不能把贡献撑住?能,就走 RA-L;不能,就走会议正稿。另外有个细节值得提一下:RA-L 的审稿人是按期刊审稿人的口径来的,对 baseline 完整度和实验严谨度的要求通常比会议稿更高,但相应的,返回来的意见也更详细、更有建设性,很少出现"写作需要改进"这种空话。
1.3 投稿前一个月我实际排的时间表
很多人问"提前多久开始准备",我把自己这次的时间线整理出来,供参考:
| 时间节点 | 主要任务 | 备注 |
|---|---|---|
| T-8 周 | 定 baseline 和数据集,跑通训练评估管线 | 这一步卡住是最致命的 |
| T-6 周 | 主实验:至少 3 个 baseline 乘 3 个场景 | 先跑最可能失败的配置 |
| T-4 周 | 消融实验 + 失败案例分析 | 消融是最容易被审稿人追着问的 |
| T-3 周 | 写正文初稿,先把图表位置占好 | 别等实验全跑完才动笔 |
| T-2 周 | 找两个不熟悉你方向的同门盲读 | 他们卡住的地方就是审稿人卡住的地方 |
| T-1 周 | 语言润色、画图、录视频、清元数据 | 录视频一定要留出重录的次数 |
| T-3 天 | 只做一件事:完整上传演练并跑格式检查 | 这个节点绝对不要拿去改内容 |
关于最后一条我要多说一句。投稿系统在 deadline 前几个小时会明显变慢,格式检查工具也可能出意外。我在 T-1 天就做过一次完整上传演练,确认了文件大小、字体嵌入、页数都没问题,真到提交那天只改了文件名。另外,有些会议会要求提前提交标题和摘要(abstract deadline 比 paper deadline 早几天),即便 IROS 这两者通常是同一天,也不要赌,提前两周把摘要写好放着,怎么都不亏。
2. 投稿系统里填错的每一个字段,都会变成审稿人给你的低分
2.1 领域选择为什么比摘要还关键
投稿的时候会选 primary topic 和 secondary topic。这两个下拉框决定了 AC 把你的稿子分给谁。填错的后果不是直接被拒,而是被不懂你的人审,具体表现就是那种意见:"这篇论文把 A 和 B 结合起来,但 A 和 B 本身都不是新方法,所以创新性有限。"因为审稿人只看见两个已知模块的拼接,看不见你在它们之间的接口层解决了什么问题。
我的做法是 primary 选最贴合的那个细分方向,secondary 填两到三个交叉方向,尽量覆盖"可能审我的人"的知识范围。摘要里坚决用领域标准术语,不自造词。我见过一个同门把一个已经有通用叫法的机制起了个新名字,审稿人直接回了一句"this is just X renamed",后面所有讨论都崩了。
2.2 双盲要真正做到位,包括 PDF 元数据
IROS 这几年采用的是双盲审稿,但每年 CFP 都会再确认一次,不要凭去年的经验办事。下面是我整理的自查清单,按容易漏的程度排序:
- 用官方模板(IEEE conference template),不要沿用实验室的旧模板,页边距和字号改了会过不了格式检查
- 作者块按当年要求处理,通常是留空或者只写 paper ID
- 致谢整段删掉,包括基金编号和项目名称
- 自引改成第三人称,"Prior work [12] proposed...",不要出现 "our previous work"
- 补充材料里不要留 GitHub 链接、个人主页、实验室 logo
- 视频里出现的人脸、工牌、实验室门口的铭牌,这个绝大多数人都会忘
- 最关键的一条:PDF 元数据里的作者名
最后这条每年都能筛掉一批人,因为你在本地看文件属性根本想不起来。两个命令就能查:
# 查看 PDF 基本信息,重点看 Author / Creator 字段 pdfinfo submission.pdf # 信息更全一些,可以过滤出作者相关字段 exiftool submission.pdf | grep -i author如果 LaTeX 编译出来的 PDF 里带着你的系统用户名,那也要处理掉,用\hypersetup{pdfauthor={},pdftitle={}}覆盖一下就能解决。
2.3 页数限制和超页费的省钱排版顺序
IROS 一般是正文六页(含图表),参考文献可以放到第七页,最多到八页但要交超页费。这个规则每年会微调,务必把去年和当年的 CFP 放在一起对比看。超页费按页计,两页的代价可能比你想的大,所以压页数是值得花时间的。
我压页的顺序是从性价比高到低:图表尺寸(用矢量图,别贴高清位图)→ 表格样式(去掉竖线和冗余横线,用 booktabs 风格)→ 公式(能行内就行内,多行公式合并)→ 段落(删掉"as we all know"式的铺垫)→ 参考文献条目压缩。如果你卡在六页半,前面四条基本都能压下去,实在不行再考虑付费。
2.4 点 Submit 之前的那张自检表
| 检查项 | 怎么查 | 常见翻车点 |
|---|---|---|
| 页数是否超限 | 阅读器直接看页数,注意参考文献算不算 | 图片浮动导致多出一页 |
| 字体是否嵌入 | pdffonts看 emb 那一列有没有 no | 用绘图软件导出的 Type 3 字体 |
| 文件大小 | 系统一般有上限,常见 20 到 60MB | 把视频直接塞进 PDF |
| 双盲残留 | 全文搜自己的姓、学校名、基金号 | 元数据、视频、附录 |
| 图的分辨率 | 放大到 200% 看一遍 | 截图当图用,糊得没法看 |
| 视频格式 | 一般要求 mp4/H.264 | 用 HEVC 编码,老播放器打不开 |
| 引用准确性 | 抽查十条,看作者名和年份 | BibTeX 里的会议名简写不统一 |
3. 等审稿意见的那两个多月,别干等
3.1 投稿当天就搭好答复信的素材库
IROS 的审稿周期大概两到三个月。这期间我做了一件回头看非常值的事:投稿当天就列了一份"预判质疑清单"。具体做法是把自己当成最挑剔的审稿人,写下五到八条最可能被问的问题,每条后面标上"我手上有什么证据"。比如:
- 为什么不用 X 作为 baseline?→ 有结果,在附录表 B,主实验为了篇幅没放
- 换个场景还能不能用?→ 跑了一半,泛化实验差两组
- 收敛性怎么保证?→ 有理论分析,在附录
- 计算量多大?→ 有实测数据,但表格还没做
然后在这两个多月里,优先把"证据不足"的那几条补掉。原因很现实:答复环节的窗口通常只有一到两周,甚至更短,那几天里你是绝对做不完新实验的,能用的只有之前攒下的东西。等到意见回来才开始跑对比实验,基本等于放弃这条意见。
3.2 意见回来之后先分类,再决定吵不吵
先说明一点,IROS 近几年的会议稿是有作者答复环节的,但窗口长度和具体形式每年会变,投稿前后一定要把 CFP 和后续邮件看清楚,不要按上一届的经验准备。
拿到三份意见之后,我的处理顺序是三个动作:
第一,看每份意见的 overall rating 和 confidence。AC 在做最终决定的时候,会更多参考 confidence 高、方向对口的审稿人。如果给低分的那位 confidence 是 low,而给高分的两位 confidence 都是 high,那你的处境其实比分数看起来好。
第二,找共识。两个以上审稿人提到同一个点,那就是必须正面回应的硬问题,不要试图绕过去。
第三,看分歧。一个人说这个模块设计得好,另一个人说它有问题,这种时候不要选边站,把事实和设计动机摆清楚,让 AC 判断。在答复信里跟着一方去反驳另一方,是最容易扣印象分的做法。
3.3 答复信的三段式和三个坑
我用的是很朴素的三段结构:开头三四行致谢,加一句"我们做了哪些主要改动";中间逐条回应,格式统一成 Reviewer 1 / Comment 1;结尾对确实指出的硬伤直接承认,说明下一步计划。
每条回应的内部也有固定套路:先用一句话复述对方的关注点,表示你理解了他真正在担心什么;然后给证据,优先给数字、表格编号、章节编号;最后说明这条意见在修订稿里怎么体现。如果因为篇幅原因没法加内容,就明确说"会在修订稿的观点补充中说明",而不是含糊过去。
三个坑我踩过其中一个,剩下两个是看别人踩的:
- 篇幅超限。不少会议要求答复信控制在一页以内,超了 AC 大概率不看。我的做法是先把所有想说的话写完,然后再压掉一半,压的过程其实就是筛出真正重要的论点。
- 语气。开头写"The reviewer misunderstood..."基本等于自杀。换成"We thank the reviewer for pointing this out. We realize the description in Section 3 may be unclear. In fact, ...",同样的意思,读起来完全不一样。
- 只承诺不给结果。写"we will add more experiments in the revision"但一个数字都没有,等于没说。哪怕只有一组初步数据,也比一句承诺强。
4. 高频审稿意见逐条拆解:它们到底在问什么
先把常见意见和它们的潜台词摆在一起,这张表我至今还在用:
| 意见表述 | 常见潜台词 | 应对优先级 |
|---|---|---|
| Novelty is limited | 可能是真重叠,也可能是没看懂差异化 | 最高 |
| Experiments are not sufficient | 缺近期 baseline、缺真实场景、缺消融 | 最高 |
| Comparison with X is missing | 审稿人自己做过 X | 高 |
| This is a combination of known techniques | 贡献层级没讲清楚 | 高 |
| Not clear how parameters are chosen | 复现性受质疑 | 中 |
| Writing needs improvement | 图表或动机部分有问题 | 中 |
4.1 "创新性不足"的三种真实含义
第一种是真的重叠,那你只能承认并明确差异;第二种是审稿人不在你这个子领域,视野里只有几篇老文章;第三种是你自己把新颖点写小了,明明解决的是接口层的问题,intro 里却只强调两个模块的拼接。
判断方法:看他引用的相关工作是什么。如果他提的三篇都是五年前的、而且针对的是完全不同的任务形态,那大概率是第二种。这种情况下不要在"新颖性"这个词上纠缠,补一个最接近的近期工作的对比实验,然后用一句话点明差异维度。差异要具体到"在动态障碍物场景下的任务成功率"这个颗粒度,写"我们的方法更好"是没有信息量的。
4.2 "实验不够"背后审稿人在找什么
说到底就三件事:跟谁比、在什么条件下比、别人能不能复现。所以补实验的优先级排序也是清楚的:和最近两年内的 SOTA 比 > 跨场景或跨形态的泛化实验 > 关键模块的消融 > 真实平台上的验证。
如果篇幅实在不够,第四条可以放进视频里。审稿人在看到真机视频之前,对"仿真里跑得好"是天然打折的。一个三十秒的真机成功片段,能抵一整段文字描述,这是我这次投稿里最直观的体会。
4.3 关于写作、图表和"读不懂"的意见
我帮导师审过几篇稿子,最深的感受是审稿人分配给你论文的时间可能只有三十分钟。他会按这个顺序读:标题、摘要、图一和图二、引言最后一段的贡献列表、主实验表、结论。如果图一没让他三秒内看懂你在解决什么问题,后面所有内容他都是带着怀疑在读。
所以我给自己定的自检标准是:图一单独拿出来,不给任何上下文,一个同方向的人能在三秒内说出"这是在解决什么问题"。做不到就重画,不要省这个时间。另外符号表值得用两行篇幅列出来,尤其是涉及多个坐标系和变换的工作,我见过太多因为符号没定义清楚被扣分的稿子。
4.4 遇到误读或者互相矛盾的意见
不要在答复信里指责审稿人,这一点没有例外。用"our description may have caused confusion"作为缓冲,然后给正确的说法,最后指出原稿里哪一句会导致误读、你打算怎么改。这个框架既保住了对方的体面,也把你的立场表达清楚了。
互相矛盾的意见处理起来更微妙。比如一个人要求加理论证明,另一个人说理论部分太长了。这种情况把取舍讲明白就行:"考虑到本文的主要贡献是系统实现与真实场景验证,我们将在修订稿中把定理的完整证明移入附录,正文只保留主要结论和适用条件。"把判断交给 AC,不要自己选边。
5. 录用之后才是真正的赶工
5.1 决定邮件里必须当周处理的事
六月中下旬决定邮件下来,通常包含三部分:决定结果、三份审稿意见,以及后续操作说明,比如 camera-ready 截止时间、版权表、注册开放时间。有四个东西我建议当周就确认完:
作者列表和顺序。camera-ready 之后再改作者基本要走申诉流程,非常麻烦。投稿时就要把这个定死,包括谁挂通讯、单位怎么写。
注册要求。一篇论文至少要有一位作者注册,通常按论文数量算,超过一定数量需要额外付费。早鸟价和正价差额不小,而且注册开放时间往往早于展示形式的通知,所以要主动盯。
展示形式。oral、spotlight 还是 interactive 海报,这个一般后面单独通知。但如果早鸟注册的截止时间早于通知,你就得自己先判断要不要先注册。
版权表。IEEE 的电子版权表一般和 camera-ready 同期提交,忘了会卡住出版流程,而且系统提示往往在截止前一天才发。
5.2 camera-ready 阶段能改什么、不能改什么
原则上是这样:可以改文字、改图表、补一个小规模实验、修正错误;不可以改结论、不可以加作者、不可以大幅调整方法叙述。很多第一次投稿的人以为录用了就随便改,实际上如果 Xplore 上线的版本和审稿版本差异过大,是有可能被 AC 找回来的。
我的习惯是做一次差异对比,用latexdiff生成一份带标记的版本自己过一遍,确保每一处改动都能对应到某条审稿意见,这样万一被问起来有据可查。视频如果要作为补充材料上传,注意平台对格式和大小的限制,别到最后一天才发现超了。
5.3 现场展示的准备方式,oral 和海报完全不是一回事
oral 一般是十二到十五分钟讲述,加三到五分钟提问。我的结构是固定的:三十秒讲问题,配一张图;两分钟讲现有方法为什么不行;六到八分钟讲方法,重点放在接口设计和关键决策的动机上;三分钟讲实验,主表加一个失败案例;最后三十秒结论。失败案例这一段非常重要,它会让提问环节的攻势软下来很多。
interactive 海报的准备逻辑完全不同。你要先准备一个六十到九十秒的口头 pitch,因为绝大多数人走到你海报前面只给你这么多时间。海报尺寸和展板规格会议会明确给出,一般是 A0 竖版;海报上小于 24pt 的正文基本没人会看,宁可少放内容也别缩小字号。
如果打算带实物演示,有两件事必须提前查:展馆的电源条件,以及大型平台的搬运和地面承重限制。千万别指望现场能临时调好机械臂标定,所有调试都要在酒店房间里完成,再整体搬过去。另外阿布扎比十月份白天依然很晒,展馆里的空调很足,带一件长袖外套——这条听起来像废话,但确实是我在会场里最庆幸的准备之一。
6. 万一没中:重投的决策流程
6.1 先分清是方法问题还是表达问题
把三份意见里的每一条问题抄到一张表上,然后打标签。S 类是结构性问题:方法的新颖性、实验设计是否成立、结论站不站得住。P 类是呈现问题:写作、图表、引用、符号定义。
如果 S 类占多数,重投之前必须先动手改工作本身,改文字没用;如果 P 类占多数,那其实是个好消息,两到三周就能改完重投。这个分类动作的意义在于防止一种很常见的错误:稿子被批得一无是处,你情绪上觉得要重做,实际上真正致命的只有一条。
6.2 三种去向和各自的时间成本
| 去向 | 适合什么情况 | 时间成本 |
|---|---|---|
| 下一个会议的常规截稿 | P 类问题为主,工作本身没问题 | 改两三周,等结果三个月 |
| RA-L | 工作完整、希望见刊更快、能接受期刊级严格度 | 两三个月,可能更久 |
| 领域期刊 | 工作体量大、需要更多篇幅、不着急 | 半年以上 |
我自己的原则是:如果被批"实验不充分",别急着改投,先把实验补完。同一份工作被同一位审稿人再审一次的概率不高,但你要面对的是全新的审稿人,同样的问题还会被问一遍,只是换了个说法。
6.3 把审稿意见变成能复用的资产
我从第一次投会议开始就维护一张表,每次的意见都按"原文 / 分类 / 我的回应 / 最终改了没有"记录。三四个会议下来,你会非常清楚地看到自己的固定弱点。我的固定弱点是 related work 写得太短,导致审稿人总觉得我没读过某几篇关键文章。后来我干脆把 related work 从半栏扩到一栏,之后这类意见就基本消失了。这个记录还有一个用处:写新论文的时候直接拿出来对照,把上次被问的问题在稿子里提前回答掉,比事后写答复信省力得多。
说到底,投稿这件事里能靠运气的部分比我想的要小。审稿人给低分的理由翻来覆去就那么几条:看不懂你在解决什么问题、不知道你比别人好在哪、不确定结果能不能复现。这三条本质上都是表达问题,而表达恰恰是你自己完全能控制的部分。我现在写论文的顺序已经完全反过来了——先把图一和贡献列表写出来,确认一个陌生人在三十秒内能看懂,再动手写方法部分。至于答复信,我把它当成一次强制性的写作训练:用一页纸说服三个可能并不友好的人,这个能力比多跑一组实验值钱得多。