查找和阅读 Hugging Face 论文页面的 markdown 内容,并使用论文 API 获取结构化元数据,如作者、链接的模型/数据集/空间、GitHub 仓库和项目页面。当用户分享 Hugging Face 论文页面 URL、arXiv URL 或 ID,或要求总结、解释或分析 AI 研究论文时使用。
Hugging Face 论文页面
Hugging Face 论文页面(hf.co/papers)是一个构建在 arXiv(arxiv.org)之上的平台,专门用于人工智能(AI)和计算机科学领域的研究论文。Hugging Face 用户可以在 hf.co/papers/submit 提交他们的论文,这会将其展示在每日论文 feed(hf.co/papers)上。每天,用户可以对论文进行投票和评论。每个论文页面允许作者:
- 认领他们的论文(通过点击
authors字段中的他们的名字)。这会使论文页面出现在他们的 Hugging Face 个人资料上。 - 通过在模型卡片、数据集卡片或 Space 的 README 中包含 HF 论文或 arXiv URL 来链接相关的模型 checkpoint、数据集和 Spaces
- 链接 GitHub 仓库和/或项目页面 URL
- 链接 HF 组织。这也会使论文页面出现在 Hugging Face 组织页面上。
每当有人在模型卡片、数据集卡片或 Space 仓库的 README 中提及 HF 论文或 arXiv 摘要/PDF URL 时,该论文将被自动索引。请注意,并非所有在 Hugging Face 上索引的论文都被提交到每日论文。后者更多是一种推广研究论文的方式。论文只能在其在 arXiv 上发布日期后的 14 天内提交到每日论文。
Hugging Face 团队构建了一个易于使用的 API 来与论文页面交互。论文内容可以作为 markdown 获取,或者可以返回结构化元数据,如作者姓名、链接的模型/数据集/空间、链接的 GitHub 仓库和项目页面。
何时使用
- 用户分享 Hugging Face 论文页面 URL(例如
https://huggingface.co/papers/2602.08025) - 用户分享 Hugging Face markdown 论文页面 URL(例如
https://huggingface.co/papers/2602.08025.md) - 用户分享 arXiv URL(例如
https://arxiv.org/abs/2602.08025或https://arxiv.org/pdf/2602.08025) - 用户提及 arXiv ID(例如
2602.08025) - 用户要求您总结、解释或分析 AI 研究论文
解析论文 ID
建议从用户提供的任何内容中解析论文 ID(arXiv ID):
| 输入 | 论文 ID |
| --- | --- |
| https://huggingface.co/papers/2602.08025 | 2602.08025 |
| https://huggingface.co/papers/2602.08025.md | 2602.08025 |
| https://arxiv.org/abs/2602.08025 | 2602.08025 |
| https://arxiv.org/pdf/2602.08025 | 2602.08025 |
| 2602.08025v1 | 2602.08025v1 |
| 2602.08025 | 2602.08025 |
这允许您将论文 ID 提供给下面提到的任何 hub API 端点。
以 markdown 形式获取论文页面
论文内容可以通过以下方式作为 markdown 获取:
curl -s "https://huggingface.co/papers/{PAPER_ID}.md"这应该返回 Hugging Face 论文页面的 markdown 版本。这依赖于论文在 https://arxiv.org/html/{PAPER_ID} 的 HTML 版本。
有 2 个例外情况:
- 并非所有 arXiv 论文都有 HTML 版本。如果论文的 HTML 版本不存在,那么内容会回退到 Hugging Face 论文页面的 HTML。
- 如果返回 404,则意味着该论文尚未在 hf.co/papers 上索引。有关信息,请参见 错误处理。
或者,您可以从正常的论文页面 URL 请求 markdown,如下所示:
curl -s -H "Accept: text/markdown" "https://huggingface.co/papers/{PAPER_ID}"论文页面 API 端点
所有端点都使用基本 URL https://huggingface.co。
获取结构化元数据
使用 Hugging Face REST API 以 JSON 形式获取论文元数据:
curl -s "https://huggingface.co/api/papers/{PAPER_ID}"这返回的结构化元数据可能包括:
- 作者(姓名和 Hugging Face 用户名,如果他们已认领论文)
- 媒体 URL(在将论文提交到每日论文时上传)
- 摘要(摘要)和 AI 生成的摘要
- 项目页面和 GitHub 仓库
- 组织和参与元数据(投票数)
要查找与论文链接的模型,请使用:
curl https://huggingface.co/api/models?filter=arxiv:{PAPER_ID}要查找与论文链接的数据集,请使用:
curl https://huggingface.co/api/datasets?filter=arxiv:{PAPER_ID}要查找与论文链接的 spaces,请使用:
curl https://huggingface.co/api/spaces?filter=arxiv:{PAPER_ID}认领论文作者身份
为 Hugging Face 用户认领论文的作者身份:
curl "https://huggingface.co/api/settings/papers/claim" \
--request POST \
--header "Content-Type: application/json" \
--header "Authorization: Bearer $HF_TOKEN" \
--data '{
"paperId": "{PAPER_ID}",
"claimAuthorId": "{AUTHOR_ENTRY_ID}",
"targetUserId": "{USER_ID}"
}'- 端点:
POST /api/settings/papers/claim - 主体:
paperId(字符串,必需):正在认领的 arXiv 论文标识符claimAuthorId(字符串):正在认领的论文上的作者条目,24 字符十六进制 IDtargetUserId(字符串):应该接收认领的 HF 用户,24 字符十六进制 ID- 响应:论文作者身份认领结果,包括已认领的论文 ID
获取每日论文
获取每日论文 feed:
curl -s -H "Authorization: Bearer $HF_TOKEN" \
"https://huggingface.co/api/daily_papers?p=0&limit=20&date=2017-07-21&sort=publishedAt"- 端点:
GET /api/daily_papers - 查询参数:
p(整数):页码limit(整数):结果数量,在 1 到 100 之间date(字符串):RFC 3339 完整日期,例如2017-07-21week(字符串):ISO 周,例如2024-W03month(字符串):月份值,例如2024-01submitter(字符串):按提交者过滤sort(枚举):publishedAt或trending- 响应:每日论文列表
列出论文
按发布日期排序列出 arXiv 论文:
curl -s -H "Authorization: Bearer $HF_TOKEN" \
"https://huggingface.co/api/papers?cursor={CURSOR}&limit=20"- 端点:
GET /api/papers - 查询参数:
cursor(字符串):分页游标limit(整数):结果数量,在 1 到 100 之间- 响应:论文列表
搜索论文
对论文执行混合语义和全文搜索:
curl -s -H "Authorization: Bearer $HF_TOKEN" \
"https://huggingface.co/api/papers/search?q=vision+language&limit=20"这会搜索论文标题、作者和内容。
- 端点:
GET /api/papers/search - 查询参数:
q(字符串):搜索查询,最大长度 250limit(整数):结果数量,在 1 到 120 之间- 响应:匹配的论文
索引论文
通过 ID 从 arXiv 插入论文。如果论文已经被索引,只有其作者可以重新索引它:
curl "https://huggingface.co/api/papers/index" \
--request POST \
--header "Content-Type: application/json" \
--header "Authorization: Bearer $HF_TOKEN" \
--data '{
"arxivId": "{ARXIV_ID}"
}'- 端点:
POST /api/papers/index - 主体:
arxivId(字符串,必需):要索引的 arXiv ID,例如2301.00001- 模式:
^\d{4}\.\d{4,5}$ - 响应:成功时返回空 JSON 对象
更新论文链接
更新论文的项目页面、GitHub 仓库或提交组织。请求者必须是论文作者、每日论文提交者或论文管理员:
curl "https://huggingface.co/api/papers/{PAPER_OBJECT_ID}/links" \
--request POST \
--header "Content-Type: application/json" \
--header "Authorization: Bearer $HF_TOKEN" \
--data '{
"projectPage": "https://example.com",
"githubRepo": "https://github.com/org/repo",
"organizationId": "{ORGANIZATION_ID}"
}'- 端点:
POST /api/papers/{paperId}/links - 路径参数:
paperId(字符串,必需):Hugging Face 论文对象 ID- 主体:
githubRepo(字符串,可为空):GitHub 仓库 URLorganizationId(字符串,可为空):组织 ID,24 字符十六进制 IDprojectPage(字符串,可为空):项目页面 URL- 响应:成功时返回空 JSON 对象
错误处理
- `https://huggingface.co/papers/{PAPER_ID}` 或 `md` 端点上的 404:该论文尚未在 Hugging Face 论文页面上索引。
- `/api/papers/{PAPER_ID}` 上的 404:该论文可能尚未在 Hugging Face 论文页面上索引。
- 论文 ID 未找到:验证提取的 arXiv ID,包括任何版本后缀
回退
如果 Hugging Face 论文页面没有足够的详细信息来回答用户的问题:
- 检查常规论文页面
https://huggingface.co/papers/{PAPER_ID} - 回退到 arXiv 页面或 PDF 作为原始来源:
https://arxiv.org/abs/{PAPER_ID}https://arxiv.org/pdf/{PAPER_ID}
注意事项
- 公共论文页面不需要认证。
- 写入端点(如认领作者身份、索引论文和更新论文链接)需要
Authorization: Bearer $HF_TOKEN。 - 首选
.md端点以获得可靠的机器可读输出。 - 当您需要结构化 JSON 字段而不是页面 markdown 时,首选
/api/papers/{PAPER_ID}。
兼容工具
站内相关工具
数据来源:huggingface-skills(Apache-2.0 许可) | 查看上游来源
上游项目:huggingface/skills / huggingface-skills | 收录时间:2026-08-18 | 更新:2026-08-18
本页面内容基于上游开源许可项目整理,仅供学习参考。AI铺子不对第三方内容承担责任, 详情请参阅免责声明。