Aucun modèle ne s'exécute lorsqu'un corpus est généré. Chaque réclamation est assemblée à partir d'un gabarit cohérent par construction, et chaque ligne remonte à l'événement clinique qui l'a produite.
Healthcare Corpus génère des membres, des périodes d'admissibilité, des réclamations médicales professionnelles et institutionnelles et des réclamations pharmaceutiques synthétiques — tarifés selon les fichiers de tarification publics des CMS, adjugés selon la conception des garanties de chaque régime, et reproductibles à l'octet près à partir d'une graine.
Les systèmes qui ont le plus besoin d'être testés sont conçus pour repérer précisément ce que les données synthétiques ordinaires ont de faux — ou ne contiennent jamais.
Ils sont petits, et ils passent les contrôles d'un pipeline parce qu'ils ne contiennent rien de ce que ces contrôles existent pour attraper.
Valides code par code, faux dans l'ensemble : un diagnostic qui ne justifie pas l'acte, un acte facturé là où il ne peut pas avoir lieu, un médicament pour une affection que le membre n'a pas.
Le développement, le travail en sous-traitance ou à l'étranger, l'évaluation de fournisseurs et les démonstrations de vente exigent tous des réclamations réalistes — sans accès aux données de production.
Évaluer une règle de fraude ou un modèle de risque exige de savoir quels membres devraient être signalés. Un corpus dont les comportements ont été rédigés le sait ; les données réelles le disent rarement.
Un persona décrit un patient type sous forme de taux et de proportions. Une cohorte tirée d'un mélange de personas est inscrite à des régimes, puis déroulée dans le temps.
L'assistance de l'IA se limite à la rédaction des fichiers de spécification, qu'une personne révise avant qu'ils soient validés. La génération est du Python déterministe appliqué aux spécifications, aux tables de référence et à une graine.
Des réclamations réalistes et cohérentes, sans renseignements personnels sur la santé — pour le travail où savoir exactement ce que contiennent les données est tout l'enjeu.
Éprouvez l'ingestion, le mappage vers le modèle canonique et le chargement de l'entrepôt avec les trois familles de réclamations, au niveau de l'en-tête et de la ligne, et des périodes d'admissibilité avec interruptions et changements de régime — à n'importe quel volume, de façon reproductible.
Les signatures comportementales sont rédigées plutôt qu'espérées, et chaque ligne porte le persona qui l'a produite — une règle peut donc être évaluée pour sa sensibilité et pour ses faux positifs, avec persona_id comme étiquette.
Un profil clinique ne contient ni montants ni mécanique de régime : la même population peut donc être inscrite à deux régimes, cliniquement identique et différente seulement par la conception des garanties.
Comme le corpus ne contient aucun renseignement personnel sur la santé, il peut aller là où les données de production ne vont pas : chez un client potentiel, un fournisseur concurrent, une nouvelle recrue ou un sous-traitant.
Un corpus dit ce qu'il est : quel persona et quel événement ont produit chaque ligne, quels montants sont réels, quels codes sont réels, et quelle version de chaque table a répondu.
Il reproduit les taux que ses auteurs ont rédigés, pas la prévalence réelle, les distributions de coûts ni les courbes d'utilisation. La calibration sur des références publiées est un travail à venir.
Tout ce qu'il contient a été rédigé, et la longue traîne n'est longue que dans la mesure où elle est écrite. Il sert aux tests, aux démos et à la formation — pas à apprendre ce qui se passe dans une population réelle.
La coordination des prestations est hors du champ, et les codes de motif de refus ne sont pas écrits : un refus tiré selon un taux n'a aucun motif que le corpus puisse honnêtement nommer.
Autorisations préalables, résultats de laboratoire, données d'évaluation des risques pour la santé et de déterminants sociaux, sérialisation X12 ou FHIR, réseaux d'orientation, capitation et paiement fondé sur la valeur.
Dans un mandat de déploiement, vos populations, vos régimes et vos profils d'utilisation sont rédigés sous forme de spécifications, révisés, puis générés dans votre propre environnement, sous vos propres licences de jeux de codes.
Écrivez-nous pour en savoir plus sur Healthcare Corpus et les mandats de déploiement, ou pour amorcer la conversation avec notre équipe.
info@artisoft.io