复数实验室 五款模型 400 次提问与 3123 次引用核验案例
为了让"AI 引用是否可信"这一问题从个人经验变成可量化事实,复数实验室在复旦大学新闻学院《数据新闻与可视化》课程中设计了对照实验。目标是回答两个问题:
名称匹配
任务描述、口语长句、创作者、工具和仓库名称都可以直接搜索。
按名称、标签、主题和内容相关性排列
为了让"AI 引用是否可信"这一问题从个人经验变成可量化事实,复数实验室在复旦大学新闻学院《数据新闻与可视化》课程中设计了对照实验。目标是回答两个问题:
名称匹配
一份按事实陈述逐条标注的核验结果,标明每条结论是否被原始来源支持、属于哪类错误。
标签匹配
一份按相同指标跨年排列的趋势说明、对异常项的通俗解释,以及一份可在就诊时拿出来和医生核对的问题清单。它不会替你诊断,也不会替代体检报告原本的医学结论。
用途匹配
一份针对报告中具体数字(GPU 小时、性能提升、数据规模、计算成本等)的来源核对清单。
标签匹配
大学教师王树义(玉树芝兰)希望在"大语言模型研究中反向学习的应用"这一主题上快速建立调研初稿。他既想看到 AI 研究工具的吸引力,也想亲自核验生成产物的可靠性,因此把任务拆成"生成—审计—人工裁决"三段。
标签匹配
一份对报告中所有"来源对象"的分类清单:外部论文、预印本、会议页面、内部生成的图片、内部数据表、模型生成图、博客等。
用途匹配
把看不懂的医学术语、检查报告、化验单或病历交给多模态大模型,让它:
用途匹配
一份对作业规范的逐项核对结果,覆盖字数、格式、引用样式、AI 使用声明、课程禁止事项,确保内容正确的同时不因格式或学术诚信问题被扣分或被判无效。
用途匹配
DeepSeek 是支持中文与代码场景的大模型系列,在个体开发者与小团队中以"低单价、长上下文"著称。本页面按来源分场景整理它在三个案例中已观察到的用法与限制,保留各自边界,不做合并归纳。
用途匹配
作者:Efan404,少数派作者,香港高校 CS 硕士在读。
用途匹配
一份按论文维度整理的题录表(英文原题、年份或会议、研究领域、两三句摘要、创新点),以及结合学生技能与目标给出的 Top 3 阅读推荐和不合适候选的说明。
用途匹配
完整流程见 method-ai-search-summarize-then-verify-original。
用途匹配
對文獻綜述、課程論文、畢業論文、研究計畫、AI 草稿中每一條引用,確認該引用所指向的論文是否真的支持正文中的論斷、定義、數字與因果關係,最終得到一份「書目真實 + 內容支持」的核驗清單,並標記超出原文範圍、樣本條件不一致、結論...
用途匹配
一份针对报告初稿的问题清单:可能捏造的术语/数据/引用、可能断章取义的位置、最薄弱论点与反驳、预估评分、一句话主要问题、三条具体修改指令。
标签匹配
当 AI 回答中带有看似正式的链接与具体数字时,用户很容易把"出现链接"误读为"已经核实"。本方法把核验过程拆成可重复的步骤:先拆解事实陈述,再对每条引用执行"打开—定位—判断支持关系"的人工核对,把"链接存在 ≠ 已核实"转...
标签匹配
作者:李厂长来了 平台:哔哩哔哩 可核验页面:https://www.bilibili.com/video/BV1uxL6zQEV9/ 发布日期:2025-05-02 采集日期:2026-07-13 时长:约 15 分钟 候选...
用途匹配
哔哩哔哩创作者 Iris天冷要喝热拿铁 发布系列教程"从0-1驯服Zotero 7|Step by Step 我的科研日记"。第一集上线于 2024 年 2 月 12 日,目标是把 Zotero 当成一条从题录收集到写作引用的...
用途匹配
审计 AI 生成的研究报告 可以得到什么 - 一份针对生成报告的"具体异常点清单",每条异常绑定到具体句子、具体数字或具体引用。 - 一份把异常归类为"证据不足 / 格式问题 / 访问受限 / 来源类别错误 / 真实缺失"的初...
标签匹配
一份按章节组织的写作规划(章节目的、论点顺序、需要引用的证据、每部分篇幅),以及在此基础上逐章生成的初稿。不是一次性产出可提交全文,而是分段迭代。
用途匹配
對 AI(特別是 ChatGPT)給出的每一條參考文獻,輸出一份經過存在性、元數據一致性與內容支持性核驗的可信來源清單,並對每條書目標記核驗狀態:
用途匹配