PDF 元数据识别

当文献库中只有一个 PDF 文件、没有完整题录时,可使用“检索元数据”自动创建规范的上级文献条目,并保留原 PDF 作为附件。

使用方法

  1. 把 PDF 添加到文献库。
  2. 在文献列表中选中独立 PDF 附件。
  3. 右键选择“检索元数据”。
  4. 等待红豆分析文件并匹配数据源。
  5. 检查新建条目的题名、作者、年份、期刊、DOI 和文献类型。

识别依据

当前流程会综合使用:

  • 文件名和 PDF 内嵌标题;
  • PDF 前部页面文本与字号特征;
  • DOI、arXiv ID、ISBN 等标识符;
  • 文件 MD5 对应的服务端识别结果;
  • 中文题名的青提学术、万方和中国知网匹配。

中文文献会优先尝试中文数据源和中文识别策略;英文文献优先使用 DOI、arXiv 等标识符。系统会清理无效标题、比较题名相似度,并在 PDF 标题与文件名差异较大时回退匹配。

识别失败时

  • 把文件名改为完整论文题名后重试;
  • 检查 PDF 前几页是否包含可复制的题名和作者;
  • 复制 DOI,使用“通过标识符添加”;
  • 在“在线检索”中按题名或作者搜索;
  • 手动新建条目并把 PDF 拖为附件。

第三方数据源可能受登录权限、访问频率、网络和 IP 策略限制。识别成功后仍应人工核对,尤其是同名论文、预印本和正式发表版本。

文档更新时间: 2026-07-16 20:34   作者:管理员