返回Skills库

Hugging Face 论文页面

Apache-2.0
📊 数据知识
huggingfaceAPIMarkdown

查找和阅读 Hugging Face 论文页面的 markdown 内容,并使用论文 API 获取结构化元数据,如作者、链接的模型/数据集/空间、GitHub 仓库和项目页面。当用户分享 Hugging Face 论文页面 URL、arXiv URL 或 ID,或要求总结、解释或分析 AI 研究论文时使用。

Hugging Face 论文页面

Hugging Face 论文页面(hf.co/papers)是一个构建在 arXiv(arxiv.org)之上的平台,专门用于人工智能(AI)和计算机科学领域的研究论文。Hugging Face 用户可以在 hf.co/papers/submit 提交他们的论文,这会将其展示在每日论文 feed(hf.co/papers)上。每天,用户可以对论文进行投票和评论。每个论文页面允许作者:

  • 认领他们的论文(通过点击 authors 字段中的他们的名字)。这会使论文页面出现在他们的 Hugging Face 个人资料上。
  • 通过在模型卡片、数据集卡片或 Space 的 README 中包含 HF 论文或 arXiv URL 来链接相关的模型 checkpoint、数据集和 Spaces
  • 链接 GitHub 仓库和/或项目页面 URL
  • 链接 HF 组织。这也会使论文页面出现在 Hugging Face 组织页面上。

每当有人在模型卡片、数据集卡片或 Space 仓库的 README 中提及 HF 论文或 arXiv 摘要/PDF URL 时,该论文将被自动索引。请注意,并非所有在 Hugging Face 上索引的论文都被提交到每日论文。后者更多是一种推广研究论文的方式。论文只能在其在 arXiv 上发布日期后的 14 天内提交到每日论文。

Hugging Face 团队构建了一个易于使用的 API 来与论文页面交互。论文内容可以作为 markdown 获取,或者可以返回结构化元数据,如作者姓名、链接的模型/数据集/空间、链接的 GitHub 仓库和项目页面。

何时使用

  • 用户分享 Hugging Face 论文页面 URL(例如 https://huggingface.co/papers/2602.08025
  • 用户分享 Hugging Face markdown 论文页面 URL(例如 https://huggingface.co/papers/2602.08025.md
  • 用户分享 arXiv URL(例如 https://arxiv.org/abs/2602.08025https://arxiv.org/pdf/2602.08025
  • 用户提及 arXiv ID(例如 2602.08025
  • 用户要求您总结、解释或分析 AI 研究论文

解析论文 ID

建议从用户提供的任何内容中解析论文 ID(arXiv ID):

| 输入 | 论文 ID |

| --- | --- |

| https://huggingface.co/papers/2602.08025 | 2602.08025 |

| https://huggingface.co/papers/2602.08025.md | 2602.08025 |

| https://arxiv.org/abs/2602.08025 | 2602.08025 |

| https://arxiv.org/pdf/2602.08025 | 2602.08025 |

| 2602.08025v1 | 2602.08025v1 |

| 2602.08025 | 2602.08025 |

这允许您将论文 ID 提供给下面提到的任何 hub API 端点。

以 markdown 形式获取论文页面

论文内容可以通过以下方式作为 markdown 获取:

curl -s "https://huggingface.co/papers/{PAPER_ID}.md"

这应该返回 Hugging Face 论文页面的 markdown 版本。这依赖于论文在 https://arxiv.org/html/{PAPER_ID} 的 HTML 版本。

有 2 个例外情况:

  • 并非所有 arXiv 论文都有 HTML 版本。如果论文的 HTML 版本不存在,那么内容会回退到 Hugging Face 论文页面的 HTML。
  • 如果返回 404,则意味着该论文尚未在 hf.co/papers 上索引。有关信息,请参见 错误处理

或者,您可以从正常的论文页面 URL 请求 markdown,如下所示:

curl -s -H "Accept: text/markdown" "https://huggingface.co/papers/{PAPER_ID}"

论文页面 API 端点

所有端点都使用基本 URL https://huggingface.co

获取结构化元数据

使用 Hugging Face REST API 以 JSON 形式获取论文元数据:

curl -s "https://huggingface.co/api/papers/{PAPER_ID}"

这返回的结构化元数据可能包括:

  • 作者(姓名和 Hugging Face 用户名,如果他们已认领论文)
  • 媒体 URL(在将论文提交到每日论文时上传)
  • 摘要(摘要)和 AI 生成的摘要
  • 项目页面和 GitHub 仓库
  • 组织和参与元数据(投票数)

要查找与论文链接的模型,请使用:

curl https://huggingface.co/api/models?filter=arxiv:{PAPER_ID}

要查找与论文链接的数据集,请使用:

curl https://huggingface.co/api/datasets?filter=arxiv:{PAPER_ID}

要查找与论文链接的 spaces,请使用:

curl https://huggingface.co/api/spaces?filter=arxiv:{PAPER_ID}

认领论文作者身份

为 Hugging Face 用户认领论文的作者身份:

curl "https://huggingface.co/api/settings/papers/claim" \
  --request POST \
  --header "Content-Type: application/json" \
  --header "Authorization: Bearer $HF_TOKEN" \
  --data '{
    "paperId": "{PAPER_ID}",
    "claimAuthorId": "{AUTHOR_ENTRY_ID}",
    "targetUserId": "{USER_ID}"
  }'
  • 端点:POST /api/settings/papers/claim
  • 主体:
  • paperId(字符串,必需):正在认领的 arXiv 论文标识符
  • claimAuthorId(字符串):正在认领的论文上的作者条目,24 字符十六进制 ID
  • targetUserId(字符串):应该接收认领的 HF 用户,24 字符十六进制 ID
  • 响应:论文作者身份认领结果,包括已认领的论文 ID

获取每日论文

获取每日论文 feed:

curl -s -H "Authorization: Bearer $HF_TOKEN" \
  "https://huggingface.co/api/daily_papers?p=0&limit=20&date=2017-07-21&sort=publishedAt"
  • 端点:GET /api/daily_papers
  • 查询参数:
  • p(整数):页码
  • limit(整数):结果数量,在 1 到 100 之间
  • date(字符串):RFC 3339 完整日期,例如 2017-07-21
  • week(字符串):ISO 周,例如 2024-W03
  • month(字符串):月份值,例如 2024-01
  • submitter(字符串):按提交者过滤
  • sort(枚举):publishedAttrending
  • 响应:每日论文列表

列出论文

按发布日期排序列出 arXiv 论文:

curl -s -H "Authorization: Bearer $HF_TOKEN" \
  "https://huggingface.co/api/papers?cursor={CURSOR}&limit=20"
  • 端点:GET /api/papers
  • 查询参数:
  • cursor(字符串):分页游标
  • limit(整数):结果数量,在 1 到 100 之间
  • 响应:论文列表

搜索论文

对论文执行混合语义和全文搜索:

curl -s -H "Authorization: Bearer $HF_TOKEN" \
  "https://huggingface.co/api/papers/search?q=vision+language&limit=20"

这会搜索论文标题、作者和内容。

  • 端点:GET /api/papers/search
  • 查询参数:
  • q(字符串):搜索查询,最大长度 250
  • limit(整数):结果数量,在 1 到 120 之间
  • 响应:匹配的论文

索引论文

通过 ID 从 arXiv 插入论文。如果论文已经被索引,只有其作者可以重新索引它:

curl "https://huggingface.co/api/papers/index" \
  --request POST \
  --header "Content-Type: application/json" \
  --header "Authorization: Bearer $HF_TOKEN" \
  --data '{
    "arxivId": "{ARXIV_ID}"
  }'
  • 端点:POST /api/papers/index
  • 主体:
  • arxivId(字符串,必需):要索引的 arXiv ID,例如 2301.00001
  • 模式:^\d{4}\.\d{4,5}$
  • 响应:成功时返回空 JSON 对象

更新论文链接

更新论文的项目页面、GitHub 仓库或提交组织。请求者必须是论文作者、每日论文提交者或论文管理员:

curl "https://huggingface.co/api/papers/{PAPER_OBJECT_ID}/links" \
  --request POST \
  --header "Content-Type: application/json" \
  --header "Authorization: Bearer $HF_TOKEN" \
  --data '{
    "projectPage": "https://example.com",
    "githubRepo": "https://github.com/org/repo",
    "organizationId": "{ORGANIZATION_ID}"
  }'
  • 端点:POST /api/papers/{paperId}/links
  • 路径参数:
  • paperId(字符串,必需):Hugging Face 论文对象 ID
  • 主体:
  • githubRepo(字符串,可为空):GitHub 仓库 URL
  • organizationId(字符串,可为空):组织 ID,24 字符十六进制 ID
  • projectPage(字符串,可为空):项目页面 URL
  • 响应:成功时返回空 JSON 对象

错误处理

  • `https://huggingface.co/papers/{PAPER_ID}` 或 `md` 端点上的 404:该论文尚未在 Hugging Face 论文页面上索引。
  • `/api/papers/{PAPER_ID}` 上的 404:该论文可能尚未在 Hugging Face 论文页面上索引。
  • 论文 ID 未找到:验证提取的 arXiv ID,包括任何版本后缀

回退

如果 Hugging Face 论文页面没有足够的详细信息来回答用户的问题:

  • 检查常规论文页面 https://huggingface.co/papers/{PAPER_ID}
  • 回退到 arXiv 页面或 PDF 作为原始来源:
  • https://arxiv.org/abs/{PAPER_ID}
  • https://arxiv.org/pdf/{PAPER_ID}

注意事项

  • 公共论文页面不需要认证。
  • 写入端点(如认领作者身份、索引论文和更新论文链接)需要 Authorization: Bearer $HF_TOKEN
  • 首选 .md 端点以获得可靠的机器可读输出。
  • 当您需要结构化 JSON 字段而不是页面 markdown 时,首选 /api/papers/{PAPER_ID}

兼容工具

Claude CodeCodexHermes Agent

数据来源:huggingface-skillsApache-2.0 许可) | 查看上游来源

上游项目:huggingface/skills / huggingface-skills | 收录时间:2026-08-18 | 更新:2026-08-18

本页面内容基于上游开源许可项目整理,仅供学习参考。AI铺子不对第三方内容承担责任, 详情请参阅免责声明