
Jenni 会将引用文献直接插入文档中。而 Claude 则会在聊天窗口中指出论证中的问题并留下分析结果。您需要哪一个,取决于您的段落是否已经撰写完成。
揭示两者核心差异的正是 Claude 对论证的审查。它标出了六个学术主张,为其中五个提供了包含 DOI 的真实论文,而对第六个主张则表示:“我宁愿不为您提供参考文献,也不愿凭空捏造一个看似合理的文献。”
2026年9月16日,同一段 201 字的段落通过这两款工具进行了四项任务的测试:修改别扭的句子、引用可验证的主张、审查论证逻辑、导出文件。Jenni 运行在 Plus 版本上,Claude 运行在 Opus 5(高努力度设置)上。
<CTA title="让文献来源和句子保持在同一处" description="在光标处搜索文献,一键引用,在写作的同时让参考文献列表自动生成" buttonLabel="免费试用 Jenni" link="https://cn.app.jenni.ai/register" />
TLDR:选择 Jenni 还是 Claude?
如果是仍在撰写中的段落,选择 Jenni:在输入任何搜索词之前,该研究就已经出现在其引用列表中了,并且在评审卡片上点击“接受(Accept)”即可将文献自动归档到参考文献列表中。如果是已经写好的段落,选择 Claude:它权衡了六个学术主张,提供了六个可解析的 DOI,并且坚决不捏造那一个不存在的参考文献。
Jenni | Claude | |
结论 | 写作发生的地方。光标处即可检索论文,一键归档引用和参考文献,导出的文档支持 Word 动态引用字段 | 草稿审计的地方。它验证了临床试验,为六个被标出的主张中的五个提供了可解析的 DOI,并拒绝捏造第六个。所有这些内容都不会直接落入文档中 |
别扭的句子 | 提升流畅度,耗时 1 秒,提供版本差异对比(diff),点击“替换选区(Replace Selection)”即可将结果插入段落中 | 耗时 10 秒,提供“修改前”与“修改后”对比、五条条理清晰的修改理由,并主动对下一句提出了警示。需要手动复制回文档 |
转甲状腺素蛋白(TTR)主张 | 在搜索框留空时,该《新英格兰医学杂志》(NEJM)的临床试验就已经呈现在“发现(Discover)”列表中。一键即可写好文内引用以及带有 DOI 的 APA 第 7 版参考文献 | 进行了两次搜索,随后针对论文本身验证了细节,在句号前添加了文内引用,并补充了“第 28 天”以及“每公斤 0.3 毫克”的实验细节 |
论证审查 | 耗时 29 秒,提供三张卡片,每张均包含真实的文献记录、被引频次及影响因子。接受一个,拒绝两个,每次只需点击一下 | 权衡了六个学术主张,提供了六个均可解析的 DOI,但在聊天中写错了一个作者姓名,并故意保留了一个未提供文献来源的主张 |
文件导出 | 支持导出包含原生引用字段或超链接的 Word 文档,或 LaTeX 文档,提供四种排版预设。不支持 PDF | 在聊天窗口旁预览干净的 .docx 文件,包含七篇参考文献。段落有五处被修改,其中四处超出了被要求修改的句子范围 |
免费计划 | 无限次引用,每天 10 次自动补全,3 次 AI 编辑,5 条聊天消息,3 次审查,仅支持导出正文 | 在 Sonnet 和 Haiku 模型上提供聊天、网页搜索、记忆功能、Artifacts 以及文件创建。本次测试使用的是 Opus 5 |
付费(按年计费) | Plus 计划每年 144 美元,Pro 计划每年 348 美元 | Pro 计划预付 200 美元/年。Max 计划仅支持按月付费,每月 100 或 200 美元 |
最适合 | 将一个段落扩展为一篇附带文献来源的学术论文 | 在导师审阅之前,对已完成的段落进行深度剖析 |
谁应该选择哪一个?
在写作进行时选择 Jenni,在写作停止后选择 Claude。以下的任务测试为这一选择提供了依据。
面临章节交稿、文件夹里存有 40 篇论文的博士生
Jenni - 撰写论文期间有三项极为耗时的工作,而这三项工作在 Jenni 的文档编辑器内即可一站式解决:
在键入搜索词之前,光标处就会自动推荐相关论文。
参考文献列表随着每次点击“引用(Cite)”而自动增长。
每个章节都可以一键进行“学术主张可信度”审查,并在阅读过程中随时归档每个接受的文献来源。
如果您的文献文件夹是一个 Zotero 文献库,可以直接导入。完成之后,将章节中最薄弱的段落发送给 Claude,进行逐句的主张核对。
下周面临提交截止日期的博士后
撰写手稿用 Jenni,审计审查用 Claude - 导出带有原生引用字段的 Word 文档以及双倍行距预设是提交前的重要工作,而这些功能仅在 Jenni 这一侧提供。
请务必亲自打开预审提供的每一个 DOI,因为在本次测试中,Claude 给出的一篇文献虽然 DOI 正确,但却挂在了错误的第一作者名下。
这学期只需要写一篇期末论文的本科生
选择 Jenni 的免费计划 - 无限次引用、每天 10 次自动补全和 3 次审查完全可以应对一篇日常论文,而 3 次 AI 编辑机会最好留给决定成绩的关键句子。写完后,无论您的计划提供的是哪种模型,都可以让 Claude 重新通读一遍,以审查论文的逻辑结构。
测试是如何进行的
为本次测试专门撰写的一个段落,直接复制粘贴到两款工具中:
输入的内容 - 201 个字,六个句子,关于脂质纳米颗粒作为 CRISPR 递送载体的讨论。
特意植入的两处错误 - 一个以 "There is a lot of things that still needs"(主谓不一致)开头的句子,以及一个叠了三层的模糊词 "could perhaps maybe"(可能也许大概)。
可验证的学术主张 - 在较高剂量下,血清转甲状腺素蛋白的平均下降幅度为 87%,该数据出自 Gillmore 等人发表于 NEJM 2021 的研究。
给 Claude 的指令 - 包含四个输入的提示词,在下文的具体任务中均有引用,以便重现测试。
相同的测试条件 - 未上传任何文件,按相同顺序进行四项任务,Jenni 使用 Plus 计划,Claude 使用 Opus 5(高努力度设置),且均在同一天使用 Chrome 浏览器进行测试。
测试截止点 - 分别截止于 Jenni 的导出对话框和 Claude 的文件生成卡片处。测试过程中未实际下载任何文件。
逐项任务对比
需要修改的句子
Jenni - 选中该句子后,选区旁会弹出一个菜单,包含:寻找引用(Find citations)、AI 聊天(AI Chat)、AI 编辑(AI Edit)、批注(Comment)和审查(Review),选区字数为 43 个单词。点击 AI 编辑会在常用指令列表上方打开一个提示词框,“提升流畅度(Improve fluency)”位于“强化写作(Strengthen writing)”分组的首位。
点击后开始运行,卡片上显示“思考了 1 秒(Thought for 1 second)”:
"Many issues still need to be resolved, including how the particles behave outside the liver, whether repeat dosing triggers an immune response, and what the long-term editing outcomes are at off-target sites."
“查看修改(See edits)”开关以删除线和插入符的形式直观展示了重写内容,并在下方附有两行关于修改内容的说明。点击“替换选区(Replace Selection)”将其直接应用到段落中,段落总字数从 207 字降至 196 字。下一句中的三重模糊词未被触及,这符合单句修改任务的合理范围。
Claude - 给出的提示词是整个段落加上一条指令:“修改以 'There is a lot of things' 开头的那个别扭的句子,且仅修改该句子。向我准确展示你修改了什么。” 大约 10 秒后,它返回了一个“已修改句子”区块,新旧版本对照显示:
"Several questions remain unresolved, however: how the particles behave outside the liver, whether repeat dosing provokes an immune response, and what long term editing outcomes look like at off target sites."
下方附带了一个“修改内容说明”列表,列出了五条条理清晰的原因:主谓一致、冗余修饰、词序调整、列表引导、词汇选择。其中第二条是两款工具中给出的最棒的写作建议:以 “There is...” 开头的句子就像是在说话前清嗓子,往往显得多余。
接着,它还主动指出下一句堆叠了三个模糊词,并询问是否也需要进行精简。

Claude Opus 5:显示修改前后对比的“已修改句子”区块,以及列出修改原因的列表开头。
值得注意的一个细节:Claude 将 "long term" 和 "off target" 写成了无连字符的形式,而 Jenni 的版本对两者都加了连字符。
胜出者 - Jenni 险胜。Claude 的五条修改理由比任何差异对比都更具启发性,并且主动发现堆叠的模糊词也展现了极高的审校智慧。两款工具修改后的句子都无可挑剔,但最终只有 Jenni 成功将其直接应用到了文档中。
<ProTip title="💡 专家提示:" description="阅读 Claude 回复下方的说明,而不仅是看修改结果。它对下一句堆叠了三个模糊词的主动警示非常精准且实用" />
必须补充来源的学术主张
Jenni - 在 "infusion." 后面放置光标,点击“引用(Cite)”按钮会在文本内部打开一个搜索面板:包含一个空白搜索框,“全部(All)”、“发现(Discover)”和“文献库(Library)”选项卡,排序与筛选功能,以及底部的“添加自定义引用(Add custom citation)”链接。
此时,“发现(Discover)”选项卡并不是空的。它已经根据光标周围的句子自动提取并推荐了相关文献卡片,每张卡片都带有“引用(Cite)”、“查看(View)”和“保存(Save)”选项:
排在首位的是 Finn 等人发表于 Cell Reports 2018 的文献:被引 810 次,影响因子 6.44,开源获取。
排在第二位的是 Gillmore 等人发表于 New England Journal of Medicine 2021 的文献,正是该句子所描述的临床试验:被引 1.6K 次,影响因子 24.39,开源获取。
由于它排在第二位,所以在点击任何内容之前,仔细核对期刊信息是非常必要的。

光标处打开的引用面板,此时搜索框仍为空。红框标出的是排在“发现(Discover)”列表第二位的 NEJM 临床试验:被引 1.6K 次,影响因子 24.39,开源获取。
点击该卡片上的“引用(Cite)”同时完成了两项工作:文内引用插入到了光标处,且页面底部自动生成了“参考文献(References)”区域,并以 APA 第 7 版格式排版,包含 DOI、格式下拉菜单,且文献计数器显示为 1。
Claude - 提示词要求提供同样的内容,即“APA 第 7 版格式的文内引用以及带有 DOI 的完整参考文献。” 它表示相比于凭记忆撰写,它更倾向于验证文献细节,并为此进行了两次网页搜索。
大约 20 秒后,它报告称:“已对照论文原文进行验证。87% 的数据、期刊细节以及 DOI 均核对无误。” 随之返回的内容包括:
句号前的括号式引用,并主动提供了叙述式引用作为备选。
正确的 DOI,以及一条专业提示:由于该论文有 26 位作者,APA 第 7 版格式需要列出前 19 位作者、省略号以及最后一位作者。
极具价值的准确细节:87% 的下降幅度是在 0.3 mg/kg 剂量组、第 28 天时,对三名患者进行测量的结果,波动范围在 80% 至 96% 之间。
问题在于,所有这些都只是聊天对话框中的文本。底部变为了“请仔细核对引用的文献来源”,德语字符中的变音符号 “Taubel” 未能正确保留,且由于不存在实际的文档,因此无法在任何地方自动生成参考文献列表。
胜出者 - Jenni。虽然 Claude 对论文细节的研读比文献卡片更为深刻,且“第 28 天”的细节非常适合写入句子中,但 Jenni 能够通过一次点击同时生成文内引用和参考文献,这是聊天对话框无法做到的。
<ProTip title="📌 牢记:" description="索取括号式引用的同时,也可以要求提供叙述式引用。Claude 在未被要求的情况下主动提供了两者。当研究本身是句子的主语时,叙述式引用正是您所需要的" />
哪一个对学术论证的审查更为严苛?
Jenni - “学术主张可信度(Claim confidence)”与其他四种审查功能一起存放在“审查(Reviews)”面板中。点击“运行审查(Run review)”会实时列出正在进行的数据库查询,最终卡片上显示“思考了 29 秒(Thought for 29 seconds)”并给出了运行总结:
“已将转甲状腺素蛋白降低百分比的引用更新为更精确的文献来源。添加了支持脂质纳米颗粒临床状态和肝细胞摄取机制的支持性引用。”
其下方给出了具体分类:三个建议,其中两个为“无证据支持(Unsupported)”,一个是“弱证据支持(Weakly supported)”,而“过度解读(Misrepresented)”和“相互矛盾(Contradicted)”两项则显示绿色对勾(通过检测)。

完成后的学术主张可信度运行界面:思考了 29 秒、工作总结以及显示有三个修改建议的分类。推荐的引用文献以高亮形式显示在左侧的正文中。
随后,审查模式会引导用户逐一查看这些卡片。每张卡片都会指出被标记的句子,给出单句说明,并显示推荐文献的被引频次、影响因子、期刊、年份和摘要摘录,底部则设有“拒绝(Reject)”和“接受(Accept)”按钮。这三个建议的处理过程如下:
关于载脂蛋白 E(ApoE)的主张 - 推荐了 Yuan 等人 2023 年发表于 Biomaterials Research 的文献,被引 70 次,其摘录明确提及了肝细胞表面的 LDL 受体。点击“接受”,文献被成功归档。
关于“临床上最先进”的最高级修饰 - 推荐了一篇 2024 年发表于 Small 上关于桑叶脂质纳米颗粒治疗结肠疾病的论文。这显然与该主张对不上。点击“拒绝”。
关于 87% 的数据 - 建议将 NEJM 的引用替换为该研究在 2022 年的一篇重印本,被引 46 次,影响因子 0.00。由于是同一篇论文,但数据记录较差。点击“拒绝”。
“所有建议已处理完毕!”关闭了审查运行,此时文献计数器显示为 2,且被接受的论文已自动以正确格式排版在列表中。三个真实的文献记录在未离开编辑器页面的情况下完成了评审和归档。
Claude - 提示词为:“审查该段落中的论证。指出哪些主张是无证据支持、夸大或弱支持的,并针对每一个主张为我提供一篇能够支持它的真实论文,附带 DOI。”
它运行了多次搜索,并在约一分钟后给出了答复,开头同样是一段它自己的总结:“有六个主张需要注意。其中两个没有问题但缺少引用,三个是核心支柱但缺乏证据支持,还有一个是最高级修饰,以目前的写法可能很难辩护。” 这六个主张是:
针对最高级修饰,提供了 Paunovska, Loughrey 和 Dahlman 2022 年的研究作为可以参考的综述文献。
指出“主要是药理学而非遗传学作用”属于论述框架而非实际发现,因此无法提供能直接支持该说法的具体论文。
针对载脂蛋白 E 机制,推荐了 Akinc 等人 2010 年发表于 Molecular Therapy 的研究。
针对“表达持续数天”的主张,推荐了 Pardi 等人 2015 年的一项小鼠研究,指出这仅支持“瞬时表达”而非人类的数据。
针对重复给药,推荐了一篇 2024 年发表于 Molecular Pharmaceutics 上关于抗 PEG 抗体的论文。
针对可电离脂质的句子,推荐了 Cheng 等人 2020 年和 Dilliard 等人 2021 年的研究,并建议使用“脂质组成”作为更准确的表述。
接着,它给出了 Jenni 的审查卡片没有提供的两个段落。它明确拒绝为“长期脱靶效应”的主张寻找文献来源,说明了理由,并建议转而引用该临床试验自身的局限性章节。
第二个意见是关于结构性的:指出该段落的可信度表现为“本末倒置”,证据最充分的主张被埋没在了三个模糊词之中,而一些推论性的主张却被平铺直叙地断言出来。

论证审查的总结部分:Claude 拒绝寻找文献来源的主张、建议转而引用临床试验局限性的建议,以及指出该段落结构本末倒置的说明。
随后,我们通过 Crossref 和出版商页面核对了一边每一个 DOI。所有六个 DOI 都能准确解析到所指的论文,前文引用任务中的 Gillmore 论文也是如此,准确率达到了 7 分之 7。唯一的小失误是:关于抗 PEG 的论文实际上是 Omata 等人写的,而聊天中将其归功于了 Miyazaki。
胜出者 - 取决于具体任务。如果是为段落补充文献来源,选择 Jenni:29 秒内提供三个真实的文献记录,每次只需点击一下即可评判,并将合适的文献直接归档到列表中。如果是为了深度拷问段落逻辑,Claude 的表现超越了测试中的任何其他工具,但所有审查结果后续都需要您手动敲入编辑器中。
<ProTip title="⚠️ 注意:" description="聊天回复中的一个参考文献虽然 DOI 正确,但却挂在了错误的第一作者名下。请务必打开 DOI,并从论文的着陆页复制作者列表,切勿直接复制聊天内容" />
文件导出
Jenni - 导出功能位于右上角的三点菜单下,与批注、复制到剪贴板、版本历史和文档设置并列。它仅提供 Word (.docx) 和 LaTeX (.tex) 两种格式。
Word 选项卡会首先询问一个非常实用的问题:引用应当如何呈现。原生 Word 引用字段可以通过 Word 的“引用”选项卡保持文内引用和书目之间的动态链接;而超链接引用则是 Google 文档常用的选项,虽然可点击,但后台不含引用字段。

导出对话框:左侧为 Word 或 LaTeX 选项,红框标出的是在原生 Word 引用和超链接引用之间的选择。不提供 PDF 选项。
在其下方提供了四个布局预设、高级选项,以及一个大致的页面预览,预览下方设有“下载文件”按钮。缺少的格式是 PDF,且官方文档指出,免费计划在导出时不会包含文献列表。
Claude - 提示词为:“将修改后的段落连同文内引用和参考文献列表,整理成一个可供下载的 Word 文档发给我。” 它读取了文件,进行了搜索,运行了两个指令,并在约 75 秒后生成了一个文件卡片:Lnp paragraph revised(修改后的 LNP 段落),文档格式为 DOCX。
一个预览窗口在聊天旁打开:Times New Roman 字体、双倍行距、悬挂缩进,共三页。参考文献页面包含了七个条目,并且在聊天中弄错的第一作者名字,在文档的参考文献列表中被正确写为了 Omata。

聊天旁的文档预览,红框标出的是参考文献页。Omata 等人的条目在之前的聊天回答中被错误地归属到了另一个第一作者名下。
它自己列出的修改清单共有五项,而只有第一项是我们在初始任务中要求修改的那个句子:
修改了别扭的句子,并进行了扩展,以容纳关于重复给药的观点。
去掉了三层模糊词,并将肝外靶向重述为“已确立但在人类中尚未得到证实”。
使作用机制更加严密,因此关于载脂蛋白 E 的句子现在明确指出了可电离制剂和 LDL 受体。
为临床试验结果补充了“第 28 天”和“0.3 mg/kg”的实验细节。
将脱靶效应主张重新界定为了该临床试验设计之初并非为了评估的内容。
胜出者 - Jenni。其导出对话框输出的是您亲自撰写的文档,且引用字段在 Word 或 LaTeX 中依然保持动态。而 Claude 导出的文件虽然是一个精美的 .docx 文件,但由于包含了一些未经您亲自挑选的七个引用,并且在保留任何内容之前,您必须对照原始文档进行逐字核对。
<ProTip title="🔗 下一步:" description="Claude 会在聊天窗口旁预览 .docx 文件。在下载之前,请先在预览中阅读参考文献页,因为在本次测试中,该预览中的作者姓名才与聊天窗口中的名字更正并统一了" />
Jenni 领先的地方

本次测试展现了以下四个聊天窗口无法媲美的 Jenni 特性:
在提问前,文献列表就已准备就绪 - 在搜索框留空时,系统就已经根据光标处的句子推荐了卡片(包括 NEJM 临床试验)。而 Claude 则是在被要求后,经过两次搜索才找到了同一篇论文。
一键即可完成两项工作 - 在光标处插入文内引用的同时,在文档底部自动生成带有 DOI 的格式化 APA 条目。
接受即意味着归档 - 在审查中保留下来的文献来源会被直接归入参考文献列表中,文献计数器同时增至 2。
导出的文件完全由您掌控 - 无论是 Word(包含动态引用字段)还是 LaTeX,都完全保留了您选择的布局。而另一侧导出的 .docx 文件实际上是一篇带有未经您亲自挑选的引用的重写稿。
Claude 领先的地方
在测试当天,Claude 展现了以下四个 Jenni 无法做到的强项:
它研读的是论文,而非文献记录 - 能够准确提取“第 28 天”、“0.3 mg/kg 剂量组”、三位患者的数据在 80% 至 96% 之间,以及 APA 第 7 版关于 26 位作者的省略号规则。
在无法提供文献支持时会直言相告 - 刻意留空了一个无法提供文献支持的主张,并建议转而引用临床试验的局限性章节。相比之下,Jenni 的学术主张可信度虽然对三个被标记的句子都推荐了论文,但其中有两个被我们拒绝了。
六个 DOI,六篇真实的论文 - 每一个 DOI 都能准确解析到所指的论文。虽然在聊天中弄错了一个第一作者名字,但在随后构建的文档中予以了纠正。
它能够解释自己的逻辑 - 为一个句子给出了五条条理清晰的修改理由,对下一句主动给出了警示,并对段落的结构进行了诊断。而另一侧的说明只有两行字。
各工具的资费情况
两款工具的定价页面均截取自 2026 年 9 月 16 日。Claude 在免费计划中提供 Sonnet 和 Haiku 模型,而在 Pro 及以上计划中提供 Opus 模型,因此本次测试运行的是其付费版本。
计划 | Jenni | Claude |
免费版 | 0 美元。无限次引用,每天 10 次自动补全,3 次 AI 编辑,5 条 AI 聊天消息,3 次审查,10 个 PDF 上传,仅支持导出正文 | 0 美元。在 Sonnet 和 Haiku 模型上提供聊天、网页搜索、记忆、Artifacts、文件创建及深度思考(extended thinking)功能 |
第二档 | Plus 计划,每月 30 美元或按年计费时每月 12 美元(年付 144 美元):每月 5,000 次自动补全,无限次 PDF 上传,500 次 AI 编辑,500 条聊天消息,每月 10 次审查,支持完整导出 | Pro 计划,每月 20 美元或按年计费时每月 17 美元(需预付 200 美元):更高的使用额度,提供 Opus、Claude Code、Cowork 协作、项目管理、Research 研究及 Microsoft 365 集成 |
第三档 | Pro 计划,每月 73 美元或按年计费时每月 29 美元(年付 348 美元):无限次自动补全、上传、编辑、聊天及审查,享有优先支持 | Max 5x 计划,每月 100 美元(仅限按月计费):提供五倍于 Pro 计划的使用额度 |
第四档 | 无 | Max 20x 计划,每月 200 美元(仅限按月计费):提供二十倍于 Pro 计划的使用额度 |
年付账单 | Plus 144 美元,Pro 348 美元 | 仅 Pro 计划提供(预付 200 美元)。Max 计划仅支持按月付费 |
2026年9月的资费标准,于9月16日分别获取自 jenni.ai/pricing 和 claude.com/pricing。
关于 Max 计划的更多详情请参阅 Max 计划帮助页面,且所有计划的上下文窗口完全相同。每一侧付费所购买的生产力不尽相同:Jenni 侧重于提高写作产出,而 Claude 侧重于提升使用额度与应用范围。
<ProTip title="⏳ 顺序建议:" description="最后再要求 Claude 生成文档。它构建的 .docx 会整合论证审查中的参考文献,并更正在聊天窗口中写错的作者名字。因此,以不同的顺序运行这些任务会改变最终文件的内容" />
如何协同使用
这两款工具并不冲突,而是服务于不同的写作阶段。初稿撰写和文献引用推荐在 Jenni 中完成,因为这是聊天窗口完全无法实现的功能。
完成后的段落则可以发送给 Claude 进行逻辑通读,然后将反馈的修改意见手动录入编辑器中。在亲自打开并验证其 DOI 之前,切勿将聊天对话中的任何文献直接放入参考文献列表中。
<CTA title="直接将下一个参考文献放入论文中" description="在编辑器中进行引用,运行审查以自动归档您所接受的文献,然后导出为引用字段动态关联的 Word 文档" buttonLabel="开始免费写作" link="https://cn.app.jenni.ai/register" />
Claude 对段落进行了当天最严苛的审校,并对那个无法提供文献支持的主张表现得非常诚实。不过,这些宝贵的审校意见完全留在了聊天窗口这一侧,需要您自己动手搬运。
而 Jenni 的写作过程则更为流畅和专注。在您开始搜索之前,临床试验就已经在列表上等待了,文内引用和参考文献一同生成,接受的文献一键归档,导出面板也随时准备将带有动态引用的文档输出。
在文献触手可得的地方进行创作,写完后再交由聊天窗口进行逻辑挑剔,并亲自将修改意见带回。这才是最完美的学术写作流。
