> ## Documentation Index
> Fetch the complete documentation index at: https://firecrawl-docs-prompt-injection-screening.mintlify.site/llms.txt
> Use this file to discover all available pages before exploring further.

# Analyse de documents

> Découvrez les capacités d'analyse de documents.

Firecrawl offre de puissantes fonctionnalités d’analyse de documents, vous permettant d’extraire du contenu structuré à partir de divers formats. Cette fonctionnalité est particulièrement utile pour traiter des fichiers comme des feuilles de calcul, des documents Word, et plus encore.

<div id="supported-document-formats">
  ## Formats de documents pris en charge
</div>

Firecrawl prend actuellement en charge les formats de documents suivants :

* **Feuilles de calcul Excel** (`.xlsx`, `.xls`, `.xlsm`, `.xlsb`, `.ods`)
  * Chaque feuille est convertie en tableau
  * Les feuilles sont séparées par des titres H2 portant le nom de la feuille
  * Préserve le formatage des cellules et les types de données

* **Documents Word** (`.docx`, `.doc`, `.docm`, `.odt`, `.rtf`)
  * Extrait le contenu textuel tout en préservant la structure du document
  * Conserve les titres, paragraphes, listes et tableaux
  * Préserve le formatage et le style de base

* **Présentations PowerPoint** (`.pptx`, `.ppt`, `.pptm`, `.odp`)
  * Extrait le contenu des diapositives dans l’ordre de lecture
  * Inclut les notes du présentateur

* **Livres numériques EPUB** (`.epub`)
  * Extrait le contenu des chapitres tout en préservant la structure du document

* **Fichiers CSV** (`.csv`)
  * Converti en tableau

* **Documents PDF** (`.pdf`)
  * Extrait le contenu textuel avec les informations de mise en page
  * Préserve la structure du document, y compris les sections et les paragraphes
  * Prend en charge les PDF textuels et les PDF scannés (avec OCR)
  * Markdown optionnel par page et blocs de mise en page typés avec cadres de délimitation
  * Facturé 1 crédit par page. Voir la [tarification](https://firecrawl.dev/pricing) pour plus de détails.
  * Voir les [options PDF](/fr/features/parse#pdf-options) pour la référence complète : modes d’analyse, limites de pages, Markdown par page et blocs de mise en page.

<div id="how-to-use-document-parsing">
  ## Comment utiliser l’analyse de documents
</div>

L’analyse de documents dans Firecrawl fonctionne de deux façons :

1. **Analyse à partir d’une URL (`/v2/scrape`)** : fournissez une URL pointant vers un type de document pris en charge.
2. **Analyse par téléversement de fichier (`/v2/parse`)** : téléversez directement le contenu binaire du fichier avec `multipart/form-data`.

Pour l’analyse à partir d’une URL, Firecrawl détecte automatiquement le type de fichier à partir de l’extension ou du type de contenu.

<div id="upload-documents-with-v2parse">
  ### Importer des documents avec `/v2/parse`
</div>

Utilisez `/v2/parse` lorsque le document source est local ou n’est pas accessible publiquement via une URL.

<CodeGroup>
  ```bash cURL theme={null}
  curl -X POST "https://api.firecrawl.dev/v2/parse" \
    -H "Authorization: Bearer fc-YOUR-API-KEY" \
    -F 'options={"formats":["markdown"]}' \
    -F "file=@./document.docx;type=application/vnd.openxmlformats-officedocument.wordprocessingml.document"
  ```

  ```js Node theme={null}
  import { Firecrawl } from "firecrawl";

  const app = new Firecrawl({ apiKey: "fc-YOUR-API-KEY" });

  const doc = await app.parse(
    {
      data: "<html><body><h1>Upload Parse</h1></body></html>",
      filename: "upload.html",
      contentType: "text/html",
    },
    { formats: ["markdown"] },
  );

  console.log(doc.markdown);
  ```

  ```python Python theme={null}
  from firecrawl import Firecrawl
  from firecrawl.v2.types import ScrapeOptions

  app = Firecrawl(api_key="fc-YOUR-API-KEY")
  doc = app.parse(
      b"<!DOCTYPE html><html><body><h1>Upload Parse</h1></body></html>",
      filename="upload.html",
      content_type="text/html",
      options=ScrapeOptions(formats=["markdown"]),
  )
  print(doc.markdown)
  ```
</CodeGroup>

<div id="example-scraping-an-excel-file">
  ### Exemple : extraction d’un fichier Excel
</div>

```js Node theme={null}
import { Firecrawl } from 'firecrawl';

const firecrawl = new Firecrawl({
  // Aucune clé API requise pour démarrer — ajoutez-en une pour des limites de débit plus élevées :
  // apiKey: "fc-YOUR-API-KEY",
});

const doc = await firecrawl.scrape('https://example.com/data.xlsx');

console.log(doc.markdown);
```

<div id="example-scraping-a-word-document">
  ### Exemple : Scraper un document Word
</div>

```js Node theme={null}
import { Firecrawl } from 'firecrawl';

const firecrawl = new Firecrawl({
  // Aucune clé API requise pour démarrer — ajoutez-en une pour des limites de débit plus élevées :
  // apiKey: "fc-YOUR-API-KEY",
});

const doc = await firecrawl.scrape('https://example.com/data.docx');

console.log(doc.markdown);
```

<div id="output-format">
  ## Format de sortie
</div>

Tous les types de documents pris en charge sont convertis en Markdown propre et structuré. Par exemple, un fichier Excel comportant plusieurs feuilles peut être converti en :

```markdown theme={null}
## Feuille1

| Nom   | Valeur |
|-------|--------|
| Élément 1 | 100   |
| Élément 2 | 200   |

## Feuille2

| Date       | Description  |
|------------|--------------|
| 2023-01-01 | Premier trimestre|
```

> Êtes-vous un agent IA ayant besoin d’une clé API Firecrawl ? Consultez [firecrawl.dev/agent-onboarding/SKILL.md](https://www.firecrawl.dev/agent-onboarding/SKILL.md) pour obtenir des instructions d’intégration automatisée.
