Envoyer des données d'e-mails et PDF parsées vers n8n
N8n est une plateforme d’automatisation puissante pour les développeurs et les équipes techniques, mais souffre véritablement de lacunes côté parsing documentaire. Son node Read PDF intégré extrait du texte brut de PDF propres. Il n’offre ni OCR, ni extraction de tableaux, ni prise en charge des documents scannés. Pour tout ce qui est plus complexe, les utilisateurs n8n finissent par écrire du JavaScript personnalisé, utiliser pdftotext via un node d'exécution de commandes, ou appeler des APIs externes simplement pour extraire des données structurées d’un PDF.
Parseur supprime toutes ces étapes superflues. Son parseur d'e-mails IA extrait les champs structurés des e-mails, PDF et documents scannés, puis envoie du JSON propre directement dans votre workflow n8n. Vous configurez ce qu'il faut extraire dans Parseur, et n8n s’occupe du reste.
Points clés à retenir
Le node PDF natif de n8n ne gère que du texte, sans OCR. Parseur ajoute l’extraction par IA, le support des documents scannés et le parsing structuré de tableaux, que n8n ne peut pas faire seul.
Parseur envoie du JSON structuré à n8n lors d'événements liés aux documents : Document traité, Tableaux aplatis, Ligne de tableau traitée, et Export échoué.
Le connecteur Parseur est disponible pour n8n Cloud. Les utilisateurs de n8n auto-hébergé peuvent se connecter via un webhook générique, prêt pour la production dès aujourd'hui.
Aucune compétence en code n’est requise pour configurer l’extraction dans Parseur. n8n gère le routage et toute logique complémentaire dont vous avez besoin.
Parseur et n8n proposent tous deux des plans gratuits pour tester le workflow complet.
Ce que n8n ne gère pas nativement avec les documents
Parseur and n8n integration
L'approche de n8n pour le traitement PDF nécessite des contournements qui ajoutent une charge de maintenance :
Le node Read PDF extrait du texte brut mais perd toute la structure des tableaux
Les PDF scannés et documents basés sur des images nécessitent un service OCR externe
L'extraction de champs spécifiques comme les numéros de facture ou les totaux nécessite du JavaScript ou des regex personnalisés
Les lignes d’un tableau ressortent en bloc de texte, nécessitant un parsing supplémentaire avant d'être utilisables
Parseur se charge de tout cela en amont, avant que les données n’atteignent n8n. Des champs comme la date de la facture, le nom du fournisseur, les lignes d'articles et les totaux arrivent dans votre workflow n8n sous forme de propriétés JSON nommées et propres. Aucun outil en ligne de commande, aucune fonction personnalisée, aucune maintenance de regex.
Ce que vous pouvez bâtir avec Parseur et n8n
Une fois Parseur et n8n connectés, la couche d'extraction est gérée automatiquement. Vos workflows n8n reçoivent des données propres et structurées, et peuvent se concentrer sur le routage et la logique :
Facture vers ERP ou Google Sheets : extrayez automatiquement le nom du fournisseur, la date de facturation, le sous-total, les taxes, le total et les lignes d’articles des factures fournisseurs. Poussez chaque facture comme nouvel enregistrement dans votre ERP ou ajoutez des lignes dans Google Sheets pour vos reportings. Consultez le guide de traitement des factures.
E-mails de commande vers base de données : capturez les IDs de commande, les coordonnées clients et les informations sur les produits à partir des e-mails de commande entrants, puis insérez les données dans Postgres ou MySQL. Vos fiches restent à jour sans saisie manuelle. Voir le guide de parsing e-commerce.
Avis d’expédition vers Slack : obtenez des alertes Slack instantanées lorsqu'une notification d’expédition arrive, ou si une exportation de document échoue. Tenez l’équipe informée en temps réel.
Pièces jointes vers Drive et métadonnées vers CRM : stockez les PDF dans Google Drive tout en envoyant les détails extraits comme le numéro de facture, le nom du client et le montant payé directement dans votre CRM. Voir le guide des e-mails prospects.
Annonces immobilières vers base de données : les e-mails d’annonces immobilières parsés peuvent être routés directement vers un tableur de suivi ou un CRM. Voir le cas d’usage immobilier.
Comment fonctionne l’intégration
La configuration s’effectue en trois étapes :
Un nouvel e-mail ou document arrive dans votre boîte de réception Parseur
Parseur extrait les champs structurés que vous avez définis et envoie le JSON propre à n8n via le connecteur ou un webhook
n8n exécute votre workflow, en routant les données vers les applications ou bases de données que vous avez connectées
Vous configurez l’extraction dans Parseur une seule fois. n8n gère le routage à partir de là.
Parseur sends structured JSON to n8n, which routes it to your apps
Pas à pas : Connecter Parseur à n8n
Étape 1 : Transférez vos documents à Parseur
Chaque boîte Parseur dispose d’une adresse e-mail dédiée. Transférez-y un échantillon d’e-mail ou de PDF. Le document apparaît dans votre boîte en quelques secondes, pièces jointes comprises.
Mettez en place une règle de transfert automatique dans Gmail ou Outlook pour traiter automatiquement tous les nouveaux documents entrants.
Étape 2 : Définissez les champs à extraire
Pour les formats pris en charge, Parseur extrait les données automatiquement via ses modèles préconçus.
Pour vos documents personnalisés, créez un modèle en surlignant les champs à capturer et en nommant chacun d'eux. Parseur appliquera cette logique à tous les futurs documents du même type. Les lignes de tableau comme les lignes d'articles sont extraites en tant qu'objets structurés distincts, sans configuration supplémentaire.
Étape 3 : Ajoutez le node Parseur dans n8n
Connectez-vous à n8n, démarrez un nouveau workflow puis cherchez le node Parseur. Connectez-le à votre compte Parseur à l’aide de votre clé API, puis choisissez votre événement déclencheur :
Document traité : événement standard avec le payload JSON complet
Tableaux aplatis : utile si vos documents comprennent des tableaux multi-lignes
Ligne de tableau traitée : s’active séparément pour chaque ligne dans un champ de tableau
Export échoué : idéal pour les notifications d’échec et les alertes Slack
Étape 4 : Traitez un document et mappez vos champs
Rendez-vous dans votre boîte Parseur et re-traitez un document. Les résultats parsés s’affichent dans le journal d’exécution de n8n. Ajoutez ensuite les nodes d’action dont vous avez besoin (Google Sheets, Slack, Postgres, CRM) et mappez les champs Parseur en utilisant {{ $json.field_name }}.
Pour toute la procédure illustrée étape par étape, suivez le guide officiel : Connecter Parseur à n8n.
Connecteur Parseur vs Webhook générique
Deux options sont disponibles pour relier Parseur à n8n, et la bonne dépend de votre configuration :
Option
Idéal pour
Avantages
À noter
Connecteur Parseur (Recommandé)
Utilisateurs n8n Cloud
Configuration rapide, gestion native des événements, conçu pour Parseur
Toujours en cours de déploiement en version bêta. Peut ne pas être encore disponible sur toutes les instances
Webhook générique
Utilisateurs n8n auto-hébergés ou ceux qui souhaitent de la flexibilité
Fonctionne partout, configuration simple, contrôle total sur les headers et le routage
Nécessite une configuration manuelle du webhook dans n8n
Les trois fonctionnent avec Parseur. n8n est idéal pour les équipes techniques et les développeurs qui souhaitent auto-héberger la plateforme, ont besoin d'une logique JavaScript personnalisée dans leurs workflows, ou se connectent à des bases de données et des APIs nécessitant plus de flexibilité. Make est mieux adapté aux workflows visuels complexes à plusieurs étapes sans auto-hébergement. Zapier est la solution la plus rapide pour de simples connexions entre deux applications, sans contrainte technique. Pour un comparatif détaillé, consultez le comparatif Zapier vs Make vs n8n.
Outils gratuits pour les documents similaires
Si vous avez besoin de convertir des documents indépendants sans configurer un workflow complet, ces outils gratuits fonctionnent dans le navigateur sans création de compte requise :
Si le même type de document arrive régulièrement par e-mail, l'intégration complète entre Parseur et n8n traitera automatiquement chaque document dès son arrivée.
Qu'est-ce que Parseur ?
Parseur est un logiciel de data extraction puissant pour extraire automatiquement des données d'emails, de PDFs et de documents et automatiser vos workflows.
Toutes les fonctionnalités de Parseur.
Qu’est-ce que n8n ?
N8N est une plateforme d'automatisation de flux de travail qui connecte différentes applications et services sans besoin de coder lourdement. Elle offre aux utilisateurs un éditeur visuel pour concevoir des workflows, facilitant ainsi le transfert des données, le déclenchement d’actions et l’optimisation des processus entre outils.
Questions courantes sur la connexion de Parseur à n8n pour automatiser le parsing d’e-mails et de documents.
N8n dispose d’un node Read PDF basique qui extrait du texte brut des PDF natifs (non scannés). Il n’intègre ni OCR, ni extraction de tableaux, ni gestion des fichiers scannés. Pour tout besoin allant au-delà d’une simple extraction de texte, il vous faudra un outil externe. Parseur répond parfaitement à ce manque : il gère les PDF natifs, les documents scannés, les images et les tableaux structurés, puis envoie automatiquement le JSON propre à n8n.
Oui. Les utilisateurs de n8n auto-hébergé peuvent connecter Parseur en utilisant un node webhook générique. Veillez à ce que votre instance n8n soit accessible publiquement afin que Parseur puisse joindre l’endpoint webhook. Le connecteur Parseur fonctionne avec n8n Cloud.
Configurez Parseur comme déclencheur dans n8n avec le connecteur Parseur ou un webhook. Ajoutez ensuite un node Google Sheets comme prochaine étape de votre workflow. Mappez les champs JSON Parseur sur les colonnes du tableur grâce à l’interface de mapping de champs de n8n. Chaque nouveau document traité par Parseur ajoutera automatiquement une nouvelle ligne à votre feuille.
Non. Parseur est un outil d’extraction no-code où vous pointez les données à extraire et nommez chaque champ. Le connecteur Parseur dans n8n se connecte avec votre clé API et ne requiert aucun code. Si vous souhaitez ajouter de la logique ou des transformations dans votre workflow n8n, le JavaScript est disponible, mais n’est pas nécessaire pour la configuration de base.
Oui. Parseur envoie les données à votre endpoint n8n via HTTPS. Avec la méthode webhook, vous pouvez ajouter des headers ou des secrets partagés pour une validation supplémentaire. Les utilisateurs auto-hébergés peuvent ainsi garder leurs process sensibles entièrement en interne.
Oui, un connecteur officiel Parseur est disponible sur n8n. Un node communautaire existe également. Si vous ne voyez pas le connecteur dans votre instance, vous pouvez utiliser la méthode webhook à la place, qui fonctionne aussi bien sur n8n Cloud qu’en auto-hébergement et est prête pour la production dès maintenant.
Parseur gère quatre événements déclencheurs pour n8n. « Document traité » s’exécute avec une charge utile JSON standard dès qu’un document est extrait. « Tableaux aplatis » est utile si vos documents contiennent des données sous forme de tableau. « Ligne de tableau traitée » déclenche l’action séparément pour chaque ligne d’un champ tableau. « Export échoué » permet le monitoring d’erreur et les alertes Slack.
Oui. Parseur extrait les lignes d’articles sous forme de données de tableau structurées et envoie chaque ligne comme un objet JSON distinct à n8n. Vous pouvez ensuite utiliser les nodes Postgres, MySQL ou autre base de données de n8n pour insérer chaque ligne comme un enregistrement individuel. Cela fonctionne avec les factures, bons de commande et tout document comportant des tableaux répétés.
Le connecteur Parseur est conçu spécifiquement pour Parseur et gère nativement les événements. Il expose directement les différents événements déclencheurs dans l’interface n8n, accélérant la configuration. La méthode webhook générique fonctionne partout, y compris en auto-hébergement lorsque le connecteur n’est pas disponible, et donne un contrôle complet sur les headers et le routage.
n8n est idéal si votre équipe souhaite auto-héberger la plateforme d’automatisation, a besoin de logique JavaScript personnalisée dans le workflow ou travaille avec des bases de données et APIs nécessitant plus de flexibilité que Zapier ou Make. Zapier est plus rapide à mettre en place pour des flux simples entre deux applications. Make est plus adapté pour concevoir des workflows visuels complexes sans auto-hébergement.