Trier les documents entrants
Factures, devis, courriers : le pipeline Sort files lit chaque document, le labellise et le range dans le bon dossier
Tri automatique, dossier par dossier
Des pipelines d'OCR, de classification et de résumés, dans votre périmètre
Assemblez un pipeline dans la console : un déclencheur, une source, des étapes, une destination. Six modèles pré-câblés lisent vos PDF et vos pièces jointes, les classent, les résument et les rangent dans des tables Iceberg ou des dossiers. L'OCR et la classification tournent sur un modèle servi dans votre cluster, ou sur une API tierce si vous le préférez.
Factures, devis, courriers : le pipeline Sort files lit chaque document, le labellise et le range dans le bon dossier
Tri automatique, dossier par dossier
Extract documents passe un bucket de PDF à l'OCR et pose le résultat dans une table Iceberg, interrogeable comme n'importe quelle table
Du PDF à la table Iceberg
Memory distillation résume une table en niveaux L0 et L1 (Hippocampe) : vos agents IA cherchent dans la synthèse avant de plonger dans le détail
Recherche progressive
Une équipe de gestion immobilière reçoit chaque jour factures, devis et courriers par email
Plus de tri manuel : chaque document arrive classé au bon endroit
Une équipe data doit rendre exploitable un stock d'archives PDF accumulées depuis des années
Des années d'archives deviennent une base documentaire interrogeable
Découvrez comment les pipelines de documents construisent votre base documentaire.