> ## Documentation Index
> Fetch the complete documentation index at: https://firecrawl-docs-agent-spark-2.mintlify.site/llms.txt
> Use this file to discover all available pages before exploring further.

# 研究索引

> 搜索论文、阅读论文片段，并查找相关工作

Firecrawl Research 是一个专为科学与工程研究代理构建的专用索引。它提供一套面向研究的工具集，用于搜索论文、查看论文元数据、阅读相关的全文片段，以及通过结构化扩展发现相关论文。

该索引涵盖约 4300 万篇论文摘要。语料库大部分来自生物医学与生命科学领域——**PubMed**、**bioRxiv** 和 **medRxiv**——同时也包含物理学、数学和计算机科学领域的 **arXiv**。论文可通过其来源 ID 进行寻址，因此 `pmid:`、`pmcid:` 和 `doi:` 引用的使用方式与 `arxiv:` 相同。

* 按主题、方法、基准、作者或类别查找论文
* 查看规范论文元数据和来源 ID
* 阅读单篇论文中能够回答特定问题的片段
* 从高质量的种子论文扩展到相关论文、引用它们的论文或参考文献

<Note>
  为了让你的代理能够访问研究索引，我们强烈建议结合使用我们的 [CLI](/zh/sdks/cli) 或 [MCP](/zh/mcp-server) 与 [**专用研究技能**](https://github.com/firecrawl/skills/blob/main/skills/firecrawl-research-index/SKILL.md)，可通过以下命令安装：

  ```bash theme={null}
  npx skills add firecrawl/skills@firecrawl-research-index
  ```
</Note>

<div id="how-this-relates-to-search">
  ## 与 `/search` 的关系
</div>

Firecrawl 中有两个名为“research”的功能，它们并不是同一项功能：

|          | 研究索引 (本页)                                           | 使用 `categories: ["research"]` 的 `/search`                                |
| :------- | --------------------------------------------------- | ------------------------------------------------------------------------ |
| 搜索范围     | 包含约 4300 万篇摘要的论文索引——PubMed、bioRxiv、medRxiv、arXiv    | 开放网页，但仅限约 14 个学术**网站** (arxiv.org、nature.com、pubmed.ncbi.nlm.nih.gov、……) |
| 返回内容     | 排序后的论文记录：规范的 `paperId`、`primaryId`、来源 ID、标题、完整摘要、评分 | 普通网页结果：URL、标题、snippet                                                    |
| 能否阅读论文内容 | 可以——通过 `GET /search/research/papers/{id}` 按段落阅读     | 不可以                                                                      |
| 能否通过引用扩展 | 可以——`GET /search/research/papers/{id}/similar`      | 不可以                                                                      |
| 端点       | `GET /search/research/papers`                       | `POST /search`                                                           |

进行文献研究时——查找论文、阅读论文、追踪引用——请使用研究索引。如果您想获取位于学术域名上的普通网页，请使用 [`categories: ["research"]`](/zh/features/search#search-categories)。

<div id="endpoints">
  ## 端点
</div>

| 任务           | 端点                                                                                               |
| ------------ | ------------------------------------------------------------------------------------------------ |
| 搜索论文         | [`GET /search/research/papers`](/zh/api-reference/endpoint/research-search-papers)               |
| 查看元数据或阅读内容片段 | [`GET /search/research/papers/{id}`](/zh/api-reference/endpoint/research-paper)                  |
| 查找相关论文       | [`GET /search/research/papers/{id}/similar`](/zh/api-reference/endpoint/research-related-papers) |

<div id="search-papers">
  ## 搜索论文
</div>

使用自然语言查询来搜索论文摘要。响应会返回按相关性排序的论文，包含规范 `paperId`、首选 `primaryId`、来源 id、标题、摘要、评分，以及可选的排序信号。

<CodeGroup>
  ```bash cURL theme={null}
  # 无需 API 密钥即可开始；添加 -H "Authorization: Bearer $FIRECRAWL_API_KEY" 可获得更高的限流上限：
  curl -s "https://api.firecrawl.dev/v2/search/research/papers?query=diffusion%20image%20synthesis&k=20"
  ```

  ```bash CLI theme={null}
  firecrawl research search-papers "diffusion image synthesis" --limit 20
  ```

  ```python Python theme={null}
  from firecrawl import Firecrawl

  firecrawl = Firecrawl(
    # 无需 API 密钥即可开始；添加一个即可获得更高的限流上限：
    # api_key="fc-YOUR-API-KEY",
  )

  result = firecrawl.v2.search_papers("diffusion image synthesis", k=20)
  print(result)
  ```

  ```js Node theme={null}
  import { Firecrawl } from "firecrawl";

  const firecrawl = new Firecrawl({
    // 无需 API 密钥即可开始；添加一个即可获得更高的限流上限：
    // apiKey: "fc-YOUR-API-KEY",
  });

  const result = await firecrawl.research.searchPapers("diffusion image synthesis", {
    k: 20,
  });
  console.log(result);
  ```
</CodeGroup>

可选过滤条件：

* `authors`：按作者子字符串过滤；所有过滤条件都必须匹配
* `categories`：按论文类别过滤，例如 `cs.LG`
* `from`：created/updated 的包含下界，格式为 `YYYY-MM-DD`
* `to`：created/updated 的包含上界，格式为 `YYYY-MM-DD`

<div id="biomedical-example">
  ### 生物医学示例
</div>

索引中的大多数内容属于生命科学，因此临床和分子生物学查询的使用方式相同：

<CodeGroup>
  ```bash cURL theme={null}
  # 无需 API 密钥即可开始；添加 -H "Authorization: Bearer $FIRECRAWL_API_KEY" 可获得更高的限流：
  curl -s "https://api.firecrawl.dev/v2/search/research/papers?query=CRISPR%20base%20editing%20off-target%20effects%20in%20primary%20human%20T%20cells&k=20"
  ```

  ```bash CLI theme={null}
  firecrawl research search-papers "CRISPR base editing off-target effects in primary human T cells" --limit 20
  ```

  ```python Python theme={null}
  from firecrawl import Firecrawl

  firecrawl = Firecrawl(
    # 无需 API 密钥即可开始；添加 API 密钥可获得更高的限流：
    # api_key="fc-YOUR-API-KEY",
  )

  result = firecrawl.v2.search_papers(
    "CRISPR base editing off-target effects in primary human T cells",
    k=20,
  )
  print(result)
  ```

  ```js Node theme={null}
  import { Firecrawl } from "firecrawl";

  const firecrawl = new Firecrawl({
    // 无需 API 密钥即可开始；添加 API 密钥可获得更高的限流：
    // apiKey: "fc-YOUR-API-KEY",
  });

  const result = await firecrawl.research.searchPapers(
    "CRISPR base editing off-target effects in primary human T cells",
    { k: 20 },
  );
  console.log(result);
  ```
</CodeGroup>

结果会携带源所用命名空间中的 `primaryId`，因此生物医学搜索结果会以 `pmid:<id>`、`pmcid:<id>` 或 `doi:<doi>` 的形式返回。将该值直接传入下方的 inspect、read 和 related endpoint。

<div id="inspect-a-paper">
  ## 查看论文
</div>

使用规范 `paperId` 或来源特定的 `primaryId`。支持的 `primaryId` 格式包括 `arxiv:<id>`、`pmid:<id>`、`pmcid:<id>` 和 `doi:<doi>`；例如，要查询 PubMed 记录，可使用 `curl -s ".../v2/search/research/papers/pmid:<id>"`。

<CodeGroup>
  ```bash cURL theme={null}
  # 开始使用无需 API 密钥；添加 -H "Authorization: Bearer $FIRECRAWL_API_KEY" 可获得更高的限流：
  curl -s "https://api.firecrawl.dev/v2/search/research/papers/arxiv:1706.03762"
  ```

  ```bash CLI theme={null}
  firecrawl research inspect-paper arxiv:1706.03762
  ```

  ```python Python theme={null}
  from firecrawl import Firecrawl

  firecrawl = Firecrawl(
    # 开始使用无需 API 密钥；添加后可获得更高的限流：
    # api_key="fc-YOUR-API-KEY",
  )

  paper = firecrawl.v2.inspect_paper("arxiv:1706.03762")
  print(paper)
  ```

  ```js Node theme={null}
  import { Firecrawl } from "firecrawl";

  const firecrawl = new Firecrawl({
    // 开始使用无需 API 密钥；添加后可获得更高的限流：
    // apiKey: "fc-YOUR-API-KEY",
  });

  const paper = await firecrawl.research.getPaper("arxiv:1706.03762");
  console.log(paper);
  ```
</CodeGroup>

<div id="read-paper-passages">
  ## 读取论文片段
</div>

在同一个论文路径中添加 `query`，即可检索出与某个问题最相关的若干全文片段。这有助于你在纳入候选论文之前，先确认其中是否确实包含某种方法、数据集、约束条件或结果。

<CodeGroup>
  ```bash cURL theme={null}
  # 入门时无需 API 密钥；添加 -H "Authorization: Bearer $FIRECRAWL_API_KEY" 可提高限流上限：
  curl -s "https://api.firecrawl.dev/v2/search/research/papers/arxiv:1706.03762?query=what%20is%20the%20attention%20mechanism&k=4"
  ```

  ```bash CLI theme={null}
  firecrawl research read-paper arxiv:1706.03762 --question "What is the attention mechanism?" --limit 4
  ```

  ```python Python theme={null}
  from firecrawl import Firecrawl

  firecrawl = Firecrawl(
    # 入门时无需 API 密钥；添加后可提高限流上限：
    # api_key="fc-YOUR-API-KEY",
  )

  passages = firecrawl.v2.read_paper(
      "arxiv:1706.03762",
      "What is the attention mechanism?",
      k=4,
  )
  print(passages)
  ```

  ```js Node theme={null}
  import { Firecrawl } from "firecrawl";

  const firecrawl = new Firecrawl({
    // 入门时无需 API 密钥；添加后可提高限流上限：
    // apiKey: "fc-YOUR-API-KEY",
  });

  const passages = await firecrawl.research.getPaper("arxiv:1706.03762", {
    query: "What is the attention mechanism?",
    k: 4,
  });
  console.log(passages);
  ```
</CodeGroup>

<div id="find-related-papers">
  ## 查找相关论文
</div>

以一篇或多篇种子论文为起点，通过语义扩展发现更多论文，并根据自然语言 `intent` 对候选论文进行排序。

<CodeGroup>
  ```bash cURL theme={null}
  # 无需 API 密钥即可开始；如需更高限流，请添加 -H "Authorization: Bearer $FIRECRAWL_API_KEY"：
  curl -s "https://api.firecrawl.dev/v2/search/research/papers/arxiv:1706.03762/similar?intent=efficient%20transformers&mode=similar&k=20"
  ```

  ```bash CLI theme={null}
  firecrawl research related-papers arxiv:1706.03762 --intent "efficient transformers" --limit 20
  ```

  ```python Python theme={null}
  from firecrawl import Firecrawl

  firecrawl = Firecrawl(
    # 无需 API 密钥即可开始；如需更高限流，请添加一个：
    # api_key="fc-YOUR-API-KEY",
  )

  papers = firecrawl.v2.related_papers(
      "arxiv:1706.03762",
      "efficient transformers",
      mode="similar",
      k=20,
  )
  print(papers)
  ```

  ```js Node theme={null}
  import { Firecrawl } from "firecrawl";

  const firecrawl = new Firecrawl({
    // 无需 API 密钥即可开始；如需更高限流，请添加一个：
    // apiKey: "fc-YOUR-API-KEY",
  });

  const papers = await firecrawl.research.similarPapers("arxiv:1706.03762", {
    intent: "efficient transformers",
    mode: "similar",
    k: 20,
  });
  console.log(papers);
  ```
</CodeGroup>

模式：

* `similar`：共被引和书目耦合邻域中的论文
* `citers`：引用种子论文的论文
* `references`：种子论文引用的论文

<div id="search-github-history">
  ## 搜索 GitHub 历史记录
</div>

issue、已合并的拉取请求和仓库 README 现已收录于 [Developer Index](/zh/features/developer)。该索引会结合匹配段落对它们进行排序，并同时提供精选文档来源。可使用 [`GET` 或 `POST /search/developer`](/zh/api-reference/endpoint/developer-search)，也可使用设置了 `categories: ["developer"]` 的 `/search`。
