前置条件与可接受边界
- 准备论文目录、原始数据、实验记录、参考文献库和学校AI使用规定。不要把未发表数据、受限数据、患者信息或企业机密直接上传到云端模型。
- 允许场景:语法纠错、段落重写、双语翻译、提纲整理、代码解释、格式检查。
- 高风险场景:生成不存在的文献、代写核心论证、修改实验结果、编造样本量、隐藏AI参与过程。研究者必须保留判断权和最终署名责任。
| 任务 | 建议做法 | 验收标准 |
|---|---|---|
| 语言润色 | 提供原文,限制“不得增加事实” | 逐句对照,事实数量不增加 |
| 文献总结 | 只允许基于提供的PDF或DOI | 结论能在原文页码定位 |
| 论文提纲 | 由作者先给研究问题和证据 | 每个论点绑定数据或文献 |
按审计流程使用AI
- 建立版本库。将论文、提示词和模型输出分开保存。
- 使用受限提示词。不要只说“帮我写论文”。使用可验证约束:
角色:学术编辑,不是作者。输入:以下原文。
任务:只修正语法、术语一致性和句子结构。
禁止:新增事实、数据、引用、结论或研究限制。
输出:修改后文本 + 修改清单 + 无法确认的内容。
- 记录模型信息。保存日期、模型版本、完整提示词、原始输出和人工修改。搜索“Gemini怎么注册”或“Google AI怎么用”时,优先看官方账户和地区政策;“Gemini国内使用”涉及可用性、数据跨境和机构规定,不能把访问成功等同于合规。
- 核验引用。对每个DOI检查标题、作者、期刊、年份,禁止仅凭模型给出的参考文献表入稿。
mkdir paper-audit && cd paper-audit
git init
mkdir manuscript prompts ai-output sources
git status
# 预期输出:
# Initialized empty Git repository
# On branch main
# Untracked directories: ai-output manuscript prompts sources
curl -s "https://api.crossref.org/works/10.1038/s41586-020-2649-2" | python -c "import sys,json; x=json.load(sys.stdin)['message']; print(x.get('title',[None])[0], x.get('published-print',x.get('published-online')))"
# 预期输出:
# 一行真实标题 + 发表日期;若为空或报错,DOI需要人工复核
提交前验证与证据留存
- 检查差异。每次人工修改后提交版本,并记录修改原因。
- 固定文件指纹。导出最终稿后保存哈希,防止提交文件与审计文件不一致。
- 最终人工验收。随机抽取10条引用逐条回到原文;随机抽取5个数字回到原始数据;通读摘要、结论和限制部分,确认没有模型新增的因果表述。
git add manuscript prompts ai-output sources
git commit -m "audit: record AI-assisted revision"
git log --oneline -1
# 预期输出:
# audit: record AI-assisted revision
sha256sum manuscript/final.pdf
# 预期输出:
# 64位十六进制哈希值 manuscript/final.pdf
如何验证已修复:满足以下四项才算闭环:引用10/10可定位;数字5/5与原始数据一致;提示词、输出和人工改动均有时间记录;导师或机构要求的AI披露已写入方法、致谢或附录。免费官方功能通常足够完成润色和核验;付费订阅主要增加配额与上下文长度,不会降低学术诚信责任。