Du document à la donnée vérifiée, avec la preuve jointe.
Intake reçoit PDF, images, e-mails et fichiers d'entreprise ; il en extrait l'information pertinente, relie chaque valeur à sa source et n'envoie que les exceptions en revue humaine.
Chaque donnée arrive avec sa provenance, son niveau de confiance et un parcours de revue.
Preuve et provenance, aussi dans l'API
Le différentiel n'est pas de lire le document : c'est que chaque valeur extraite renvoie à la page et à la région exactes où elle a été lue.
{
"supplier": {
"value": "ACME, S.L.",
"confidence": 0.99,
"evidence": { "page": 1, "bbox": [120, 80, 310, 112] }
},
"total": {
"value": "12450.00",
"currency": "EUR",
"confidence": 0.98,
"evidence": { "page": 1, "bbox": [412, 640, 528, 668] }
},
"due_date": {
"value": "2026-09-30",
"confidence": 0.71,
"status": "human_review_pending"
}
}Exemple illustratif avec des données fictives — il ne provient d'aucun client.
Ce que fait Intake
Une couche d'entrée pour tout ce qui arrive non structuré.
Formats d'entreprise
PDF, images numérisées, e-mails avec pièces jointes et fichiers bureautiques entrent par la même porte.
Classification documentaire
Chaque document est identifié par type avant toute extraction : facture, contrat, acte, dossier.
OCR et extraction
Les champs pertinents sont extraits avec un niveau de confiance champ par champ, pas comme un bloc de texte.
Validations déterministes
Formats, sommes, dates et identifiants sont vérifiés par des règles, pas par un nouvel appel à un modèle.
Revue humaine
Seules les exceptions arrivent à une personne : ce qui est validé poursuit son chemin sans attendre.
Preuve par champ
Chaque valeur conserve sa page et sa région d’origine, si bien que toute donnée peut être auditée ensuite.
Pour les développeurs
Conçu pour s'intégrer, pas pour remplacer vos systèmes.
API asynchrone et webhooks
Envoyez le document, recevez le résultat quand il est prêt et abonnez-vous aux événements du pipeline.
Isolation multi-tenant
Les données de chaque organisation vivent et sont traitées isolément des autres.
Privacy et Savings intégrés
L'information sensible est protégée et chaque appel à un modèle est optimisé avant de s'exécuter.
Limites connues et benchmarks
Nous ne publions aucun chiffre de vitesse, de précision ou de capacité tant qu'il n'existe pas de benchmark reproductible décrivant matériel, dataset, type de document, résolution, taille de lot, percentiles de latence et taux d'erreur.
D'ici là, la meilleure preuve est votre propre cas : demandez une exécution sur un document réel et vérifiez le résultat champ par champ.
Commencez par un document, pas par une transformation complète.
Traitez un document d'exemple avec notre équipe et décidez avec le résultat sous les yeux.