The Fools' Journey

Coding, Physics and Curiosity - Notes from thefooliman

0%

写论文agent mvp上线了

起因是学校要求写一篇seminar arbeit, 老师明确告诉我们可以使用ai进行语言构建. 于是在陆陆续续完成数据模拟作为practical的部分, 然后着手开始准备理论部分.

总体框架不难, 把outline写出来, 然后每一个section逐步把骨架和内容逻辑搭建起来, 能用德语写就用德语写, 不行就中文, 英文, 甚至关键词. 然后把每个section交给ai进行润色, 变成完整的学术德语.

但是ai写的东西毕竟还是ai味太浓, 我也并不确定我们老师对于“ai润色”的尺度把控到底有多严重, 如果用专业aigc网站打分, 那一定是非常高的, 因为语言基本都是ai润色过或者改写过的. 这点我相信老师是完全可以理解的. 不过, 我还是把这篇论文初稿给别的ai进行“ai率点评”, 以尽量减少阅读体验上的ai感痕迹. 把别的ai总结的特征, 让帮我进行润色改写的ia进行修改.

这一步来回做了很多次, 但始终问题没有改善太多, 一是十几页的论文, ai最多也就改个几处. 不可能通篇修改. 二是, 再怎么让他不要这么写, 他也无法跳脱底层限制, 终究还是相似的写法. 所以唯一解就是通过固定的pattern.md, 把所有要求和禁忌写清楚, 写详细, 让他严格执行, 自我检查, 并且继续让外部ai进行检查.


好吧, 以上只是前情提要, 我干完这个累活, 就想着要把这件事给自动化了, 载体当然是老朋友claude code.

于是把我写论文时完整的工作流, 从接取用户输入, 到根据patterns写作/改写, 到全局guard检测合法性, 正确性, 到自检子agent自行检测patterns是否都被符合, 到外部子agent进行外部评估, 然后改写agent继续根据guard+自检+外部子agent的综合评估进行改写, 并将以上的逻辑迭代多次, 直到用户觉得满意.

还整了个普通模式和激进模式.

目前还是mvp, 还有很多可以优化的地方, 比如是否要引入外部aigc来专业对ai率进行评测, 直到某个数值下才停止迭代, 这一步实现较困难且容易陷入迭代死循环. 包括很多具体逻辑可能还存在漏洞, 我目前也只是跑了2篇小型论文进行了测试. 不过确实是完整可以跑了.

后续可以进一步支持中文, 做好主页包装, 发到marketplace, 引流, 支持codex, 支持德语等等, 有很多可以做, 不过目前还是首要确保整体功能的完整性.