Skip to main content

Search(搜索)

1 min read

search 端点将网页搜索与 Firecrawl 的抓取能力相结合,为任意查询返回完整页面内容。

在请求中包含 scrapeOptions,并设置 formats: [{"type": "markdown"}],即可为每条搜索结果获取完整的 markdown 内容;否则默认只返回结果 (url、title、description) 。你也可以使用其他 formats,例如 {"type": "summary"} 来获取精简内容。

支持的查询运算符#

我们支持多种查询运算符,帮助你更高效地筛选搜索结果。

运算符功能示例
""精确 (非模糊) 匹配一段文本"Firecrawl"
-排除特定关键词或对其他运算符取反-bad, -site:firecrawl.dev
site:仅返回来自指定网站的结果site:firecrawl.dev
filetype:仅返回具有特定文件扩展名的结果filetype:pdf, -filetype:pdf
inurl:仅返回在 URL 中包含某个词的结果inurl:firecrawl
allinurl:仅返回在 URL 中包含多个词的结果allinurl:git firecrawl
intitle:仅返回在页面标题中包含某个词的结果intitle:Firecrawl
allintitle:仅返回在页面标题中包含多个词的结果allintitle:firecrawl playground
related:仅返回与特定域相关的结果related:firecrawl.dev
imagesize:仅返回尺寸完全匹配的图片imagesize:1920x1080
larger:仅返回大于指定尺寸的图片larger:1920x1080

location 参数#

使用 location 参数获取按地理位置定向的搜索结果。格式:"string"。示例:"Germany"、"San Francisco,California,United States"。

查看支持的位置完整列表,了解所有可用的国家和语言。

country 参数#

使用 country 参数以 ISO 国家/地区代码指定搜索结果所属国家/地区。默认值:"US"。

示例:"US"、"DE"、"FR"、"JP"、"UK"、"CA"。

Categories 参数#

使用 categories 参数按特定类别筛选搜索结果:

  • research:将网页搜索限定为学术和研究网站 (arxiv.org、nature.com、ieee.org、pubmed.ncbi.nlm.nih.gov、biorxiv.org、medrxiv.org 等) 。返回带 snippet 的常规网页结果,而非论文记录
  • pdf:搜索 PDF
  • developer:搜索 Developer Index——包括公开代码仓库中的 issue、已合并的 pull request 和 README,以及精选文档网站
Note

**research 是网站筛选条件,不是论文索引。**它会将此端点的网页结果限定在固定的学术域名列表中。

如需直接搜索科学文献——包括 PubMed、bioRxiv、medRxiv 和 arXiv 中的论文摘要,以及读取论文内段落和扩展引用图谱——请使用 研究索引GET /search/research/papers

使用示例#

域名过滤#

使用 includeDomains 可将结果限制在特定域名内,或使用 excludeDomains 将特定域名从搜索结果中排除。域名只能填写主机名,不包含协议或路径。

includeDomainsexcludeDomains 不能同时使用。

包含域名示例#

域名排除示例#

分类响应#

每个结果都包含一个 category 字段,用于表示其来源:

使用 tbs 参数按时间范围过滤搜索结果,包括自定义日期区间。详细示例及支持的 formats 请参见 Search Feature 文档

你是需要 Firecrawl API 密钥的 AI 代理吗?如需自动化入门说明,请参见 firecrawl.dev/agent-onboarding/SKILL.md