·

Documentazione clinica

Documentazione clinica

Medicina veterinaria

Medicina veterinaria

Clinico

Clinico

Perché le note veterinarie in testo libero compromettono la codifica automatizzata

Le cartelle cliniche veterinarie in testo libero mancano della struttura necessaria per una codifica clinica automatizzata affidabile. Scopri perché il linguaggio incerto, le abbreviazioni e le procedure narrative causano errori di codifica

Le note di consulto in testo libero costituiscono la spina dorsale della documentazione clinica veterinaria, ma sono progettate per il ragionamento clinico, non per l'estrazione di dati. Quando un veterinario scrive "Sospetto che potremmo trovarci di fronte a un'otite in fase iniziale", sta comunicando un'incertezza diagnostica a un collega. Quando un sistema di codifica automatizzato legge la stessa frase, potrebbe non rilevare affatto la diagnosi, classificarla erroneamente o assegnare un codice con un livello di confidenza che il clinico non ha mai inteso. Questo divario tra il modo in cui i veterinari scrivono e il modo in cui i sistemi di codifica leggono è una delle ragioni principali per cui la codifica clinica nella pratica veterinaria rimane inaffidabile, e perché i dati che ne dipendono sono così spesso incompleti.

Cosa richiede la codifica clinica nella pratica veterinaria

La codifica clinica converte le informazioni chiave contenute in una narrazione clinica in dati strutturati e standardizzati utilizzando un vocabolario controllato. In medicina veterinaria, i framework più utilizzati includono VeNom (Veterinary Nomenclature) e SNOMED CT (Systematized Nomenclature of Medicine Clinical Terms). Lo scopo è trasformare una nota di consulto, scritta in linguaggio naturale, in concetti discreti e non ambigui: una diagnosi, una specie, un sistema corporeo, una procedura.

I sistemi di codifica, siano essi gestiti manualmente o guidati dall'elaborazione del linguaggio naturale (NLP, una branca dell'intelligenza artificiale che interpreta il linguaggio umano), analizzano le cartelle cliniche alla ricerca di segnali specifici. Devono identificare un endpoint codificabile, una condizione confermata o sospetta, e mapparla a un termine all'interno del vocabolario controllato. Ciò che non possono fare in modo affidabile è dedurre il significato clinico dal contesto narrativo, risolvere terminologie ambigue o distinguere tra un problema attivo attuale e uno storico menzionato di sfuggita.

Come osservato da una ricerca pubblicata su npj Digital Medicine, le note veterinarie differiscono sostanzialmente nello stile di scrittura e nel vocabolario tra le cliniche, e i loro codici diagnostici utilizzano un framework terminologico diverso dalla medicina umana. A differenza dell'assistenza sanitaria umana, dove un'infrastruttura di codifica robusta è integrata nei sistemi clinici, la maggior parte delle cartelle cliniche veterinarie sono in testo libero senza codifica diagnostica standard. L'assenza di tale infrastruttura significa che l'intero peso della codificabilità ricade sulla nota stessa. Per saperne di più su come la codifica clinica nella pratica veterinaria differisce dalla medicina umana, consulta la nostra panoramica dedicata.

Gli schemi narrativi specifici che compromettono la codifica automatizzata

Diverse abitudini specifiche del testo libero causano costantemente errori o omissioni nella codifica. Non si tratta di errori casuali, ma di conseguenze prevedibili della scrittura di note per la comunicazione clinica piuttosto che per l'estrazione di dati strutturati.

Diagnosi incorporate in un linguaggio evasivo. Quando un veterinario scrive "Sospetto che potremmo trovarci di fronte a un'otite in fase iniziale", la diagnosi è presente ma sepolta in un linguaggio epistemico evasivo. Gli strumenti automatizzati spesso non rilevano o classificano erroneamente le diagnosi espresse in questo modo. Il sistema di codifica non può determinare in modo affidabile se questo rappresenti una condizione sospetta che giustifica un codice o un'osservazione speculativa che non lo giustifica.

Abbreviazioni e sigle specifiche della pratica. Termini come "orecchio bilat.", "PU/PD query Cushing", o "?IBD" sono immediatamente comprensibili a un collega nella stessa pratica ma vengono interpretati in modo incoerente dai sistemi di codifica. La ricerca sull'NLP per le cartelle cliniche veterinarie ha rilevato che la terminologia non standardizzata è una delle barriere più persistenti all'estrazione automatizzata affidabile, in particolare quando si mappano i dati di prescrizione e le descrizioni cliniche a condizioni specifiche su larga scala.

Diagnosi differenziali registrate come conclusioni. Quando un veterinario elenca le esclusioni, "DDx: ipotiroidismo, Cushing, diabete", senza dichiarare una diagnosi di lavoro confermata, gli strumenti di codifica rimangono senza un endpoint codificabile. Le diagnosi differenziali possono essere clinicamente appropriate, ma non forniscono al sistema nulla a cui ancorare un codice.

Procedure descritte in modo narrativo. "Ho dato un'occhiata veloce alla pelle e ho rasato l'area" non emerge come un codice di procedura discreto. Le azioni procedurali incorporate in una prosa descrittiva vengono regolarmente perse dai sistemi automatizzati che cercano segnali di procedura riconoscibili piuttosto che resoconti narrativi di ciò che è accaduto durante il consulto.

Presupposti su specie e razza. Quando il segnalamento del paziente (specie, razza, età, sesso) non viene ripetuto o referenziato nel corpo della nota, gli strumenti automatizzati possono applicare codici progettati per un contesto di specie diverso. Se il sistema di codifica legge una nota isolatamente dalla cartella del paziente, l'assenza di contesto sulla specie può comportare codici applicati erroneamente o ambigui.

Negazione e contesto storico mescolati con reperti attivi. "Nessun vomito, anche se il proprietario riferisce che è stato un problema l'anno scorso" è una costruzione comune e clinicamente sensata, ma può causare una codifica falsa positiva del vomito come condizione attuale. I primi lavori sulle prestazioni di ricerca in testo libero nelle cartelle cliniche veterinarie hanno stabilito che la sensibilità di ricerca per le diagnosi nelle note non strutturate variava dal 33% al 98%, e il valore predittivo positivo dal 2% al 74%, a seconda della condizione e della strategia di ricerca utilizzata. Un intervallo così ampio rende i dati aggregati inaffidabili senza una revisione manuale significativa. La gestione della negazione rimane uno dei problemi tecnicamente più difficili nell'NLP clinico.

Perché il linguaggio evasivo è particolarmente problematico per l'accuratezza della codifica

L'incertezza clinica non è un fallimento della documentazione, ma una parte legittima e importante del ragionamento veterinario. Il problema è che il linguaggio utilizzato per esprimere l'incertezza nelle note in testo libero fa collassare una distinzione che i sistemi di codifica devono preservare.

C'è una differenza significativa tra:

  • Una condizione sospetta che dovrebbe generare un codice "sospetto" o "query"

  • Una condizione che viene attivamente esclusa e non dovrebbe essere codificata affatto

  • Una condizione menzionata solo come contesto storico

Nella prosa in testo libero, tutte e tre possono apparire in costruzioni quasi identiche. "Query Cushing", "escludendo Cushing" e "il proprietario ha menzionato che il Cushing era stato sollevato da un veterinario precedente" possono sembrare superficialmente simili a un modello NLP, ma hanno implicazioni di codifica completamente diverse. La ricerca sull'accuratezza della codifica automatizzata ha rilevato che i tassi di accuratezza possono scendere fino al 60% in compiti di codifica in testo libero complessi, in parte perché l'evasività, la negazione e l'ambiguità contestuale rimangono computazionalmente difficili da risolvere.

Il problema di fondo è che i veterinari sono formati per documentare il loro processo di ragionamento, inclusa l'incertezza, in forma narrativa. I sistemi di codifica sono progettati per estrarre conclusioni. Quando la nota contiene ragionamento piuttosto che conclusioni, il sistema ha materiale limitato con cui lavorare.

Come le omissioni sono spesso più dannose degli errori

Una cartella clinica codificata erroneamente è un problema, ma una cartella omessa è invisibile. Quando una condizione o una procedura non viene catturata affatto, non c'è alcun segnale, nessuna anomalia e nessun prompt per la revisione. L'assenza diventa semplicemente parte dei dati.

Questa invisibilità ha conseguenze reali:

  • Lacune nei dati sulla salute della popolazione. Gli studi di text-mining sulla sorveglianza della sindrome enterica degli animali da compagnia hanno dimostrato che le cartelle cliniche non strutturate richiedono uno sforzo computazionale significativo per estrarre anche i conteggi di casi di base. Senza una codifica sistematica, l'accertamento dei casi per gli studi di prevalenza e incidenza è fondamentalmente inaffidabile.

  • Trigger di richiamo mancati. Nei sistemi di gestione della pratica, gli avvisi automatizzati per il follow-up, la vaccinazione o la dispensazione ripetuta dipendono spesso da cartelle cliniche codificate. Le cartelle cliniche codificate supportano avvisi automatizzati che le cartelle in testo libero non possono attivare in modo affidabile.

  • Reporting di pratica impreciso. L'audit clinico nella pratica veterinaria si è dimostrato difficile retrospettivamente a causa delle barriere nello stabilire la diagnosi dalle cartelle cliniche, con l'assenza di codifica coerente identificata come ostacolo principale.

  • Sorveglianza delle malattie distorta. I programmi di sorveglianza nazionali come SAVSNET (Small Animal Veterinary Surveillance Network) e VetCompass dipendono dalla qualità dei dati provenienti dalle singole pratiche. Quando le condizioni non vengono codificate, i modelli di malattia appaiono meno prevalenti di quanto siano, una distorsione con implicazioni per il reporting sulla gestione antimicrobica e il monitoraggio delle malattie emergenti.

Uno studio che utilizza modelli gradient boosted per l'accertamento dei casi da cartelle cliniche veterinarie in testo libero ha rilevato che gli strumenti NLP potrebbero raggiungere un'elevata accuratezza per condizioni specifiche e ben definite, ma solo dopo un'ampia pulizia dei dati, un controllo ortografico veterinario personalizzato e un addestramento su cartelle cliniche annotate manualmente. Il sovraccarico computazionale necessario per compensare le note non strutturate è sostanziale.

Le modifiche strutturali delle note che rendono le cartelle cliniche più affidabilmente codificabili

Gli aggiustamenti che migliorano la codificabilità non richiedono un cambiamento fondamentale nel modo in cui i veterinari pensano o ragionano. Richiedono piccoli cambiamenti coerenti nel modo in cui le conclusioni cliniche vengono presentate nella cartella scritta. La maggior parte può essere implementata senza aggiungere tempo significativo a un consulto.

Dichiarare esplicitamente una diagnosi di lavoro. Anche in condizioni di incertezza, una frase coerente come "Diagnosi di lavoro: otite esterna" fornisce al sistema di codifica un segnale inequivocabile. L'incertezza può ancora essere documentata nel corpo narrativo, ma l'endpoint codificabile deve essere visibile.

Separare i reperti attivi dal contesto storico e dalle diagnosi differenziali escluse. Una semplice distinzione strutturale, ad esempio raggruppare i problemi attivi separatamente da "storia" o "background", riduce il rischio che le condizioni storiche vengano codificate come attuali. Le diagnosi differenziali escluse dovrebbero essere etichettate come tali piuttosto che elencate insieme alla diagnosi di lavoro.

Utilizzare una terminologia coerente per le condizioni comuni. Alternare tra "infezione dell'orecchio", "otite", "orecchio bilaterale" e "infiammazione auricolare" in diversi consulti crea incoerenza che si accumula nel tempo nei dati a livello di pratica. Stabilire un termine preferito per le condizioni frequentemente incontrate, anche informalmente, migliora l'affidabilità della codifica sia manuale che automatizzata.

Registrare le procedure come azioni discrete. "Citologia eseguita (tampone auricolare, orecchio destro)" è codificabile. "Ho dato un'occhiata e ho preso un tampone mentre il proprietario lo teneva" non lo è. La distinzione non riguarda la formalità, ma il fornire alla cartella un segnale procedurale riconoscibile.

Includere il contesto specifico della specie quando la nota può essere letta indipendentemente. Questo è particolarmente rilevante per le pratiche che utilizzano sistemi in cui le note possono essere estratte, condivise o elaborate al di fuori della cartella del paziente, ad esempio nei riepiloghi di invio o nei set di dati di sorveglianza.

Dove i modelli strutturati e gli assistenti IA possono aiutare, e dove non possono

Per una panoramica più ampia degli strumenti di documentazione IA per veterinari e cosa valutare prima di adottarli, consulta la nostra guida dedicata. I modelli strutturati affrontano direttamente il problema della codificabilità sostituendo i campi narrativi aperti con campi discreti e obbligatori: specie, motivo della presentazione, diagnosi di lavoro, procedure eseguite. La ricerca ha dimostrato che i modelli linguistici di grandi dimensioni addestrati su grandi volumi di dati curati e codificati manualmente possono ottenere miglioramenti significativi nella codifica diagnostica automatizzata, ma la qualità dei dati di addestramento sottostanti e la qualità delle note in arrivo rimangono il limite massimo per le prestazioni.

Gli assistenti medici IA che generano note strutturate dall'audio del consulto possono ridurre l'onere della scrittura manuale delle note e migliorare la coerenza, ma affrontano le stesse ambiguità che colpiscono i codificatori manuali. Se un veterinario esprime verbalmente una diagnosi con un linguaggio evasivo, l'assistente trascriverà quell'evasività. Se una procedura viene descritta in modo narrativo piuttosto che nominata, l'assistente potrebbe non presentarla come un'azione codificabile discreta.

I modelli, nel frattempo, riducono la libertà narrativa e possono sembrare gravosi in ambienti clinici frenetici. La ricerca sull'NLP veterinario identifica costantemente la variazione dello stile di scrittura tra le cliniche come una sfida importante per la generalizzazione del modello, il che significa che anche i sistemi automatizzati ben addestrati possono funzionare in modo diverso tra le pratiche a seconda di quanto coerentemente vengono utilizzati i modelli. Nessuno dei due strumenti elimina il problema. Entrambi sono vincolati dalla qualità della nota da cui stanno lavorando.

Come appare in pratica una codifica affidabile

L'esempio seguente illustra lo stesso incontro clinico scritto in due modi. Il contenuto clinico è identico, la codificabilità no.

Versione tipica in testo libero:

"Bella è venuta con il suo proprietario che era preoccupato per le sue orecchie. Si è grattata molto e ha scosso la testa. All'esame l'orecchio destro sembrava piuttosto infiammato e c'era una secrezione scura (potrebbe essere lievito, potrebbe essere batterica, difficile da dire in questa fase). L'orecchio sinistro sembrava a posto. Ho pulito l'orecchio destro e ho preso un tampone. L'ho iniziata con Surolan per ora e vedremo come va. Il proprietario deve tornare tra due settimane se non migliora."

Da questa nota, un sistema di codifica automatizzato affronta diverse sfide: la diagnosi è implicita ma non dichiarata, la procedura ("ho pulito l'orecchio destro e ho preso un tampone") è incorporata nella narrazione, la lateralità è presente ma non strutturata, e la logica del trattamento è espressa come incertezza piuttosto che come decisione clinica.

Versione strutturalmente adattata:

"Motivo della presentazione: scuotimento della testa e prurito, orecchio destro.
Reperti attivi: otite esterna destra (eritema, secrezione ceruminosa scura). Orecchio sinistro NAD.
Diagnosi di lavoro: otite esterna destra, probabilmente lievito (Malassezia) (componente batterica non esclusa).
Procedure: citologia orecchio destro (tampone prelevato), lavaggio orecchio destro eseguito.
Trattamento: Surolan otico (5 gocce orecchio destro BID x 14 giorni).
Follow-up: controllo tra 2 settimane se non c'è miglioramento."

Nella seconda versione, la diagnosi di lavoro è esplicita e codificabile. La procedura è nominata e lateralizzata. La diagnosi differenziale è riconosciuta senza essere registrata come diagnosi confermata. Il trattamento è collegato a un prodotto nominato e a un'azione discreta. Ogni elemento di cui il sistema di codifica ha bisogno è presente e inequivocabile, senza alcuna perdita di informazioni cliniche.

Perché questo è importante oltre il singolo consulto

La qualità di una singola nota di consulto ha conseguenze che si estendono ben oltre l'incontro stesso. A livello di pratica, una codifica inaffidabile significa che il reporting sul carico di casi, la prevalenza delle malattie e gli esiti del trattamento si basa su dati incompleti. A livello nazionale, i programmi di sorveglianza delle malattie che attingono alle cartelle cliniche veterinarie, incluso il monitoraggio della gestione antimicrobica e il tracciamento delle malattie zoonotiche, sono accurati solo quanto le cartelle che li alimentano.

La ricerca epidemiologica che utilizza cartelle equine in testo libero ha dimostrato sia il potenziale che i limiti di questa fonte di dati: il text mining può far emergere associazioni significative di fattori di rischio, ma gli autori notano che l'approccio "richiede un cambiamento concettuale nella diagnosi della malattia che dovrebbe essere considerato attentamente". Quel cambiamento concettuale inizia con il modo in cui i singoli veterinari scrivono le loro note.

La fattibilità a lungo termine del supporto decisionale clinico assistito da IA in medicina veterinaria dipende anche da questa base. I modelli addestrati su dati veterinari codificati e strutturati possono supportare la diagnosi, segnalare interazioni farmacologiche e identificare popolazioni a rischio. I modelli addestrati su cartelle in testo libero scritte in modo incoerente, senza codifica affidabile, affrontano sfide di generalizzazione significative che limitano la loro utilità clinica. Una codifica affidabile dipende da cartelle affidabili. E le cartelle affidabili, nella pratica veterinaria, iniziano con le scelte che i veterinari fanno su come scrivono.

Domande frequenti

Perché le note veterinarie in testo libero causano errori di codifica clinica

Le note di consulto in testo libero sono scritte per la comunicazione clinica, non per l'estrazione di dati. I sistemi di codifica automatizzati necessitano di endpoint codificabili inequivocabili, ma le note veterinarie spesso contengono linguaggio evasivo, abbreviazioni specifiche della pratica e descrizioni narrative delle procedure. Queste abitudini rendono difficile per i sistemi di codifica identificare una diagnosi confermata, distinguere i reperti attivi da quelli storici o far emergere codici procedurali discreti.

Quali framework di codifica utilizzano le pratiche veterinarie

I framework più utilizzati in medicina veterinaria sono VeNom (Veterinary Nomenclature) e SNOMED CT (Systematized Nomenclature of Medicine Clinical Terms). Entrambi convertono le narrazioni cliniche in concetti standardizzati e strutturati che coprono diagnosi, specie, sistemi corporei e procedure. A differenza dell'assistenza sanitaria umana, la maggior parte delle cartelle cliniche veterinarie sono in testo libero senza codifica diagnostica standard, il che pone l'intero peso della codificabilità sulla nota stessa.

Quali abitudini di scrittura specifiche compromettono più comunemente la codifica automatizzata

Diversi schemi causano costantemente errori di codifica. Le diagnosi sepolte in un linguaggio evasivo, come "Sospetto che potremmo trovarci di fronte a un'otite in fase iniziale", vengono spesso perse o classificate erroneamente. Le abbreviazioni e le sigle specifiche della pratica vengono interpretate in modo incoerente tra i sistemi. Le diagnosi differenziali elencate senza una diagnosi di lavoro confermata lasciano gli strumenti di codifica senza un ancoraggio. Le procedure descritte in modo narrativo piuttosto che nominate come azioni discrete vengono regolarmente omesse. La negazione e il contesto storico mescolati con i reperti attivi possono anche generare codici falsi positivi per condizioni che non sono attuali.

Come influisce il linguaggio evasivo sull'accuratezza della codifica

Il linguaggio evasivo fa collassare distinzioni che i sistemi di codifica devono preservare. Una condizione sospetta, una condizione che viene attivamente esclusa e una condizione menzionata solo come contesto storico possono tutte apparire in costruzioni quasi identiche nella prosa in testo libero. La ricerca sull'accuratezza della codifica automatizzata ha rilevato che i tassi di accuratezza possono scendere fino al 60% in compiti di codifica in testo libero complessi, in parte perché l'evasività, la negazione e l'ambiguità contestuale rimangono computazionalmente difficili da risolvere.

Perché le omissioni dalla codifica clinica sono più dannose degli errori

Una cartella clinica codificata erroneamente esiste almeno nei dati e può essere segnalata per la revisione. Una cartella omessa è invisibile. Quando una condizione o una procedura non viene catturata affatto, non c'è anomalia e nessun prompt per la correzione. Questa invisibilità influisce sui dati sulla salute della popolazione, sui trigger di richiamo automatizzati, sul reporting a livello di pratica e sui programmi di sorveglianza delle malattie nazionali come SAVSNET e VetCompass, tutti dipendenti dalle cartelle codificate provenienti dalle singole pratiche.

Quali cambiamenti pratici rendono le note veterinarie più affidabilmente codificabili

Piccoli cambiamenti coerenti nel modo in cui le conclusioni cliniche vengono presentate possono migliorare significativamente la codificabilità. Dichiarare esplicitamente una diagnosi di lavoro, anche in condizioni di incertezza, fornisce ai sistemi di codifica un segnale inequivocabile. Separare i reperti attivi dal contesto storico e dalle diagnosi differenziali escluse riduce la codifica falsa positiva. Utilizzare una terminologia coerente per le condizioni comuni, registrare le procedure come azioni discrete nominate e includere il contesto specifico della specie quando le note possono essere lette indipendentemente aiutano tutti senza aggiungere tempo significativo a un consulto.

Gli assistenti medici IA o i modelli strutturati possono risolvere il problema della codifica

Entrambi gli strumenti possono aiutare, ma nessuno dei due elimina il problema. I modelli strutturati sostituiscono i campi narrativi aperti con campi obbligatori discreti, il che migliora direttamente la codificabilità. Gli assistenti medici IA che generano note strutturate dall'audio del consulto possono migliorare la coerenza, ma affrontano le stesse ambiguità dei codificatori manuali. Se un veterinario esprime verbalmente una diagnosi con un linguaggio evasivo, l'assistente trascriverà quell'evasività. La qualità della nota rimane il limite massimo per le prestazioni di codifica, indipendentemente dallo strumento.

Come influisce la codifica veterinaria inaffidabile sulla sorveglianza delle malattie

I programmi di sorveglianza nazionali che attingono alle cartelle cliniche veterinarie, incluso il monitoraggio della gestione antimicrobica e il tracciamento delle malattie zoonotiche, sono accurati solo quanto le cartelle che li alimentano. Quando le condizioni non vengono codificate, i modelli di malattia appaiono meno prevalenti di quanto siano. Gli studi di text-mining sulla sorveglianza della sindrome enterica degli animali da compagnia hanno dimostrato che senza una codifica sistematica, l'accertamento dei casi per gli studi di prevalenza e incidenza è fondamentalmente inaffidabile.

Come appare una nota veterinaria affidabilmente codificabile rispetto a una nota tipica in testo libero

Il contenuto clinico può essere identico, ma la struttura fa la differenza. Una nota tipica in testo libero può implicare una diagnosi, incorporare procedure nella narrazione ed esprimere la logica del trattamento come incertezza. Una nota strutturalmente adattata dichiara esplicitamente la diagnosi di lavoro, nomina e lateralizza le procedure come azioni discrete, etichetta le diagnosi differenziali separatamente dai reperti confermati e collega il trattamento a un prodotto e un'azione nominati. Ogni elemento di cui il sistema di codifica ha bisogno è presente e inequivocabile, senza alcuna perdita di informazioni cliniche.

Inizia a usare Tandem oggi stesso

Unisciti a migliaia di operatori sanitari che scelgono referti senza stress.

Inizia a usare Tandem oggi stesso

Unisciti a migliaia di operatori sanitari che scelgono referti senza stress.

Inizia a usare Tandem oggi stesso

Unisciti a migliaia di operatori sanitari che scelgono referti senza stress.