# Masquage des données personnelles identifiables (PII)

> Masquer les données personnelles identifiables dans les sorties de scrape et de parse

import PIIPython from "/snippets/fr/v2/scrape/pii/python.mdx";
import PIINode from "/snippets/fr/v2/scrape/pii/js.mdx";
import PIICURL from "/snippets/fr/v2/scrape/pii/curl.mdx";
import PIICLI from "/snippets/fr/v2/scrape/pii/cli.mdx";

Le masquage des PII remplace les informations permettant d’identifier une personne dans le markdown renvoyé avant que vous ne l’envoyiez à des agents, à des journaux, à des bases vectorielles ou à des pipelines d’analyse.

<div id="how-it-works">
  ## Comment ça marche
</div>

Définissez `redactPII: true` dans une requête de scraping. Firecrawl masque les informations personnelles identifiables du markdown généré et renvoie la version masquée dans `markdown`. Vous n’avez pas besoin de transmettre `formats` ; markdown est le format de sortie par défaut.

<CodeGroup>
  <PIIPython />

  <PIINode />

  <PIICURL />

  <PIICLI />
</CodeGroup>

<div id="redaction-options">
  ## Options de masquage
</div>

Pour la plupart des requêtes, utilisez `redactPII: true`. Pour ajuster le masquage, passez un objet d’options :

```json
{
  "redactPII": {
    "mode": "accurate",
    "entities": ["EMAIL", "PHONE", "SECRET"],
    "replaceStyle": "tag"
  }
}
```

| Option         | Valeurs                                                       | Par défaut         | Description                                                                                                                                                                      |
| -------------- | ------------------------------------------------------------- | ------------------ | -------------------------------------------------------------------------------------------------------------------------------------------------------------------------------- |
| `mode`         | `accurate`, `aggressive`, `fast`                              | `accurate`         | Stratégie de masquage. `accurate` utilise uniquement le modèle, `aggressive` améliore le rappel grâce à des heuristiques supplémentaires, et `fast` évite l&#39;appel au modèle. |
| `entities`     | `PERSON`, `EMAIL`, `PHONE`, `LOCATION`, `FINANCIAL`, `SECRET` | Toutes les entités | Limite le masquage à certaines catégories d&#39;entités.                                                                                                                         |
| `replaceStyle` | `tag`, `mask`, `remove`                                       | `tag`              | Remplace les segments par des balises comme `<EMAIL>`, les masque avec `*` ou supprime complètement les caractères.                                                              |

<Note>
  Le CLI Firecrawl et le serveur MCP proposent un masquage booléen simple. Des options avancées sont disponibles via l&#39;API et les SDKs, qui exposent l&#39;objet d&#39;options `redactPII` complet.
</Note>

<div id="response">
  ## Réponse
</div>

Lorsque le masquage réussit, `markdown` contient le contenu masqué :

```json
{
  "success": true,
  "data": {
    "markdown": "Contact us at <EMAIL> or <PHONE>.",
    "metadata": {
      "sourceURL": "https://example.com/contact"
    }
  }
}
```

Pour un affichage en ligne de commande, redirigez le markdown vers le moteur de rendu de votre choix :

```bash cURL
curl -X POST https://api.firecrawl.dev/v2/scrape \
  -H "Authorization: Bearer $FIRECRAWL_API_KEY" \
  -H "Content-Type: application/json" \
  --data '{
    "url": "https://dlptest.com/sample-data.pdf",
    "redactPII": true
  }' | jq -r ".data.markdown" | glow
```

<div id="billing">
  ## Facturation
</div>

Le masquage des PII coûte 5 crédits par page : 1 crédit de scrape de base, plus 4 crédits supplémentaires pour le masquage.

Pour les PDF analysés, chaque page PDF supplémentaire consomme toujours le crédit normal d’analyse PDF et entraîne également le supplément de masquage.

<div id="availability">
  ## Disponibilité
</div>

Le masquage des PII est pris en charge partout où Firecrawl accepte des options de scrape :

* **Scrape** - définissez `redactPII` dans `/v2/scrape`.
* **Crawl, extraction par lot et recherche** - passez `redactPII` dans `scrapeOptions`.
* **Parse** - passez `redactPII` dans le JSON `options` du multipart.
* **SDKs** - Python utilise `redact_pii` ; JavaScript et les autres SDKs utilisent `redactPII` ou la casse native de leurs options.
* **CLI** - passez `--redact-pii` à `firecrawl scrape`.
* **serveur MCP** - incluez `"redactPII": true` dans les arguments de l’outil `firecrawl_scrape` pour un masquage booléen simple.

> Êtes-vous un agent IA qui a besoin d’une clé API Firecrawl ? Consultez [firecrawl.dev/agent-onboarding/SKILL.md](https://www.firecrawl.dev/agent-onboarding/SKILL.md) pour obtenir les instructions d’intégration automatisée.
