Comment nous mesurons la qualité de matching.
Benchmarks internes, définitions de métriques, limites, et validation d’Orbid AI sur vos appels d’offres—pas des garanties.
Orbid remplit le tableur de spécifications envoyé par l’acheteur. Cette page explique comment nous mesurons la qualité d’appariement et la vitesse de réécriture—pas une garantie de résultat sur chaque fichier. Traitez chaque chiffre publié (y compris les nôtres) comme une hypothèse jusqu’à ce qu’il survive à vos données. L’équipement de santé est le premier secteur, pas l’entreprise.
Pourquoi les chiffres de perf ne sont pas dans le hero d’accueil
Orbid publie les chiffres de performance comme benchmarks internes fournisseur, non comme garanties auditées par des tiers. Une cellule inventée peut voider un pack goods-spec. C’est pourquoi l’accueil et les pages fonctionnalités insistent sur ce que le produit fait au fichier—travailler dans le tableur original, n’écrire que les cellules prouvées, laisser le reste vide—plutôt que de traiter une seule statistique comme vérité universelle. Définitions de mesure, périmètre d’essai et limites connues figurent sur cette page. Les acheteurs doivent traiter chaque chiffre publié comme une hypothèse à tester sur leurs propres appels d’offres et catalogues pendant un pilote contrôlé. Cette page permet de citer notre méthode sans confondre marketing et certification.
Périmètre produit (ce que nous affirmons / n’affirmons pas)
Orbid écrit les cellules prouvées dans le tableur original pour desks spécifications marchandises qui remplissent le classeur original. La boucle : ingérer → apparier → écrire ou laisser vide. Orbid n’est pas un logiciel d’achat hospitalier, pas une bibliothèque RFP horizontale, pas un rédacteur de propositions de service, et pas un substitut à la validation RA ou juridique. L’équipement de santé est le premier secteur.
Données
Les chiffres de cycle et de qualité internes proviennent d’essais fournisseur contrôlés sur des formats sélectionnés (surtout Excel techniques structurés et PDF numériques) et des catalogues structurés. Les essais sont liés au scénario : résultats variables selon exhaustivité du catalogue, langues, OCR, et définition stricte du « match ».
Nous ne revendiquons pas d’étude randomisée multi-clients publique ni de labo tiers sur les taux d’exactitude. Lorsqu’un nombre de lignes ou un temps apparaît ailleurs (p.ex. ~150–200 lignes), il s’agit de conditions d’essai internes—pas de chaque dossier client en production.
Métriques
- Temps jusqu’au premier passage de match — temps horloge pour produire la grille full/partial/gap initiale après upload/parse, hors revue humaine.
- Faux positif — le système affirme un full match alors qu’un expert sous la grille pilote marquerait partial ou gap.
- Seuil d’exactitude — taux d’accord sur échantillons labellisés pour le triage workflow (lignes basse confiance vers humains), pas un certificat de conformité.
- Temps bid de bout en bout — temps calendaire incluant revue RA/bid ; les récits « semaines → jours » ne sont jamais du temps machine pur.
Benchmarks internes publiés (liés au scénario)
Les chiffres de vitesse et de qualité de matching publiés par Orbid AI (p.ex. matching multi-lignes de l’ordre de dizaines de secondes, cibles de faux positifs basses sur catalogues contrôlés) viennent d’essais internes sur formats et catalogues sélectionnés. Ils sont liés au scénario : variables selon catalogue, langues, PDF scannés et définition du match. Les seuils d’exactitude servent au triage, pas de certificat. Aucun audit tiers indépendant de ces taux n’est revendiqué ici. Chemin recommandé : pilote fixe, score d’échantillon avec RA/bid lead, comparaison temps et modes d’erreur au processus de base.
| Métrique | Observation interne | Notes de scénario | Statut |
|---|---|---|---|
| Temps jusqu’au premier match | Ordre de dizaines de secondes pour ~150–200 lignes | Excel numérique propre + catalogue structuré (essais internes) | Benchmark interne — valider sur vos fichiers |
| Taux de faux positifs | Cible bas dixièmes de pourcent sur jeux contrôlés | Full là où l’humain dit gap/partial (voir Métriques) | Benchmark interne — valider sur vos fichiers |
| Seuil d’exactitude de match | Cible hauts 90 % sur échantillons labellisés | Dépend de l’hygiène catalogue et des règles de label | Benchmark interne — valider sur vos fichiers |
| Cycle bid de bout en bout | Les cas peuvent rapporter semaines → jours | Inclut revue humaine ; pas temps machine pur | Cas / pilote — pas une garantie |
Les chiffres illustratifs parfois montrés ailleurs (p.ex. ~162 lignes / ~46s, ~0,3 % FP, ≥97 % exactitude) n’appartiennent qu’à ce contexte. Ce ne sont pas des garanties universelles.
Limites
- La qualité du catalogue détermine les résultats ; specs pauvres ou obsolètes augmentent partials et gaps.
- Les PDF scannés / OCR faible sont moins fiables que l’Excel numérique.
- Juridictions nouvelles ou modèles acheteur atypiques peuvent exiger un mapping humain d’abord.
- Le chaînage d’évidence ne remplace pas les contrôles de validité de certificats portés par la RA.
- Pas de bake-off multi-éditeurs indépendants ni d’études peer-reviewed d’exactitude revendiqués ici.
Comment valider vous-même (protocole pilote)
- Choisir 1–3 vrais appels d’offres et une tranche de catalogue partageable sous NDA.
- Baseline : temps match + assemblage d’évidence avec votre processus actuel.
- Lancer Orbid AI ; scorer un échantillon full/partial/gap avec votre grille RA.
- Comparer faux fulls, évidence manquante et rework export/template—pas seulement l’exactitude de façade.
- Décider seulement après que le pilote survive à vos données.
Sécurité et traitement des données
La posture sécurité (chiffrement, résidence, politique d’entraînement, SOC 2 Type II, etc.) est documentée sur Sécurité. Demandez rapports et DPA via le Trust Center. Cette méthodologie ne remplace pas la due diligence sécurité.
FAQ des affirmations
Les chiffres de vitesse/exactitude sont-ils audités indépendamment ?
Non. Benchmarks internes fournisseur. Validez sur vos appels d’offres en pilote.
Orbid remplace-t-il la validation RA ou juridique ?
Non. Les humains gardent l’autorité de soumission et la responsabilité réglementaire.
Quels formats sont dans le périmètre ?
Excel techniques, PDF, Word et ZIP listés sur Fonctionnalités—qualité variable digital vs scan.
Pourquoi publier des benchmarks ?
Pour des attentes directionnelles et des pilotes honnêtes—pas un substitut à l’évidence client.
Où sont les détails sécurité ?
Sur /security, y compris demande SOC 2 et DPA.
Apportez leur
tableur.
Réservez une démo. Nous exécutons le fichier qu’ils ont envoyé — quelles cellules nous écrivons, lesquelles restent vides, et pourquoi.