论文 Fulltext Harv

数据 社区
解读按原文结构重写,命令、链接、术语均保留;右侧可核对作者原始 SKILL.md

方法与流程

  • §0. Quick start (orchestrated CLI):For a typical mixed list of DOIs from Web of Science / Scopus export: The CLI: Parses DOIs from WoS savedrecs (or pass multiple --savedrecs)

适用与边界

  • 当前原文没有单列适用场景。
  • Common pitfalls:Pitfall · Symptom · Fix Empty PDF/XML directories created on failure · "Downloaded N papers" but files are 0 bytes · Validate file size; remove empty dirs (this code does it via cleanuparticledir) Cloudflare blocks headless Playwright · 403 / "Just a…

原文中的明确线索

  • 要点:「Publisher TDM APIs」、「OA aggregators」、「Browser fallback」、「resume-safe Elsevier bulk」、「Quick reference」、「Elsevier」、「Wiley」、「Springer (OA)」
  • 文件与命令autopaperdownload/publishers.pyauto-paper-harvesterSUPPORTEDPUBLISHERS.md--savedrecsreferences/tdm-apis.mdapi.elsevier.com/content/article/doi/{DOI}?view=FULLELSEVIERAPIKEYELSEVIERINSTTOKEN

流狐整理:以上内容来自当前 SKILL.md 的章节与原词;未补写作者没有声明的工具、兼容性或能力。

流狐档案 作者与许可取自来源;运行、权限和网络为流狐检测或估算
流狐分类
数据
作者声明 Agent
未找到明确声明;不据此推断已兼容或已测试
静态检查
88 / 100 · 启发式扫描,不代表运行安全
作者 / 版本 / 许可
@jxtse · 未声明 license
流狐 Token 估算
低消耗
流狐接入估算
需手动接入
是否需要外部 API Key
需要 · GitHub
检测到的系统要求
未声明
底层运行要求
Python
检测到的文件与系统行为
  • 只读
  • 允许写入 / 修改
  • Shell 执行
  • 读取环境变量
检测到的网络行为
允许外网请求
安装命令数
无(仅作为资料)

档案由构建时根据 SKILL.md 与安装命令自动衍生,可能与作者实际意图存在差异。

需要注意: 未限定 allowed-tools,默认拥有全部工具权限。

输出预览 paper-fulltext-harvest.preview
# §0. Quick start (orchestrated CLI)

# Setup once
cp scripts/.env.example .env
# Edit .env to fill API keys (see §4 "Configuration")

# Run
python -m auto_paper_download \
    --savedrecs your_export.xls \
    --output-dir ./downloads/ \
    --delay 2.0

讨论

基于 GitHub Discussions。登录 GitHub 即可参与讨论、点赞、订阅更新。