← Torna al blog
Scheda editoriale su Claude for Legal e Astra for Law, con due poltrone davanti a un tavolo da riunione in marmo sotto un pannello di testo avorio
Scelta tecnica Controllo incrociato

L'attualità in pratica

Claude for Legal e Astra for Law: che cosa dicono queste due offerte della propria architettura

Due produttori di modelli entrano nel diritto a quattro mesi di distanza. Ciò che hanno in comune sta in una sola frase, ed è quella che conta davvero.

Per studi legali e direzioni legali che valutano le proprie opzioni in materia di intelligenza artificiale.


Il 12 maggio 2026, Anthropic ha pubblicato Claude for Legal. Il 17 settembre, OpenAI ha annunciato Astra for Law. Entrambi gli annunci sono stati ampiamente commentati, e la domanda che pongono non è quella che ha occupato la stampa specializzata.

Che cosa è stato annunciato, esattamente

Claude for Legal è una suite open source pubblicata con licenza Apache 2.0. Riunisce dodici estensioni per area di pratica e più di venti connettori verso i software su cui il mercato funziona: gestione documentale, data room, piattaforme di revisione, ricerca. Ogni estensione inizia con un colloquio che apprende la pratica del team prima di produrre alcunché. La suite è gratuita; ciò che si paga è l'abbonamento al modello che la fa funzionare.

Astra for Law è una configurazione di GPT-6 Astra per il lavoro giuridico, accompagnata da un indice di ricerca che copre la giurisprudenza, le leggi, i regolamenti, le regole di procedura e le decisioni amministrative degli Stati Uniti, su più di 230 milioni di indirizzi. L'accesso passa dapprima per un programma riservato a studi selezionati, con l'interfaccia di programmazione a seguire. Ventisei estensioni partner accompagnano il lancio.

Entrambe le offerte sono serie, e le cifre pubblicate da OpenAI lo mostrano: sul Legal Research Bench di Vals AI, una serie di 200 domande di ricerca giuridica in diritto americano, Astra for Law ottiene il 54% di risposte corrette contro il 38,7% dello stesso modello con la sola ricerca web. Non è un effetto annuncio.

Che cosa portano realmente queste offerte

Queste due offerte risolvono un problema reale. Un modello generalista interrogato su una questione di diritto produce risposte plausibili e riferimenti che non sempre lo sono. Ancorare il modello a un corpus verificato cambia la natura dell'esercizio: il riferimento citato esiste, dice ciò che gli si fa dire, e il professionista può verificarlo.

Il secondo apporto è l'integrazione. Le estensioni di Claude for Legal si innestano sui sistemi di gestione documentale, sugli strumenti di firma e sulle piattaforme di revisione. I partner di Astra for Law coprono lo stesso terreno. In entrambi i casi l'idea è la stessa: lavorare dove i fascicoli già si trovano, anziché esigere che vengano spostati.

La questione del diritto applicabile

Le due offerte non si collocano nello stesso punto su questa questione, e la distinzione merita di essere fatta.

L'indice di Astra for Law copre il diritto degli Stati Uniti. L'offerta è destinata in via prioritaria al mercato americano, e lo dichiara. Fuori da quella giurisdizione, il suo apporto principale, che è l'ancoraggio su fonti verificate, non si applica al diritto che il professionista esercita.

Claude for Legal procede diversamente. Le estensioni sono file di testo adattabili, senza giurisdizione iscritta nella loro concezione, e l'accesso alle fonti passa per connettori aperti. Diversi coprono ordinamenti diversi da quello americano: uno di essi dà accesso a più di 31 milioni di documenti provenienti da più di 160 giurisdizioni, tra cui il diritto consolidato dell'Unione europea e la giurisprudenza delle corti supreme e costituzionali.

L'ancoraggio sulle fonti di un dato diritto non è dunque, di per sé, ciò che distingue queste offerte da uno strato di orchestrazione. Ciò che le distingue è altrove.

Ciò che un produttore di modelli non può fare

Claude for Legal funziona con i modelli di Anthropic. Astra for Law funziona con quelli di OpenAI. È un'evidenza, ma ha una conseguenza che si misura raramente: il controllo della produzione è affidato al modello che l'ha prodotta.

Quando una di queste offerte verifica un'analisi, propone una rilettura o segnala una debolezza in un ragionamento, è la stessa famiglia di modelli che redige e che controlla. Il controllo condivide i pregiudizi della redazione, i suoi punti ciechi e i suoi errori caratteristici.

Nessun produttore ha ragione di fare altrimenti: costruirebbe contro il proprio prodotto.

Questo vincolo ha un secondo effetto, più lento. Chi costruisce i propri processi su una di queste offerte lega la qualità del proprio lavoro alla traiettoria di un fornitore. Se un altro modello diventa migliore tra sei mesi, bisognerà attendere oppure ricostruire tutto.

Creazione, challenge, controllo

MAX non è un modello. È uno strato che ne governa diversi, e che fa passare ogni produzione attraverso tre operazioni distinte, affidate a sistemi differenti.
La creazione. Un modello redige, a partire dal fascicolo, dalle posizioni già assunte e dalla terminologia in uso. È l'operazione che tutti conoscono, ed è la sola che la maggior parte degli strumenti realizza.

Il challenge. Un secondo modello, che non ha redatto, riprende la produzione e la contesta. Cerca ciò che il primo non ha visto: l'ipotesi posta senza essere verificata, la qualificazione adottata senza essere discussa, la clausola la cui redazione apre una lettura che nessuno ha voluto. Questo modello non condivide né i dati di addestramento del primo, né i suoi pregiudizi, né i suoi punti ciechi. È precisamente per questo che vede altro.

Il controllo. La produzione è confrontata con le fonti di diritto ufficiali del diritto che si applica alla richiesta. I riferimenti citati esistono, dicono ciò che si fa loro dire, lo stato del testo invocato è quello che vale alla data in questione. Questa operazione non rileva del giudizio di un modello ma di una verifica contro una fonte.

Il diritto applicabile è quello della richiesta, non quello del fornitore. Una questione di diritto francese si verifica contro le fonti francesi, una questione di diritto italiano contro le fonti italiane, una questione di diritto inglese contro le proprie.

Le tre operazioni sono separate perché non hanno la stessa natura. Creare richiede di produrre. Challengiare richiede di contraddire. Controllare richiede di verificare. Un sistema che confonde le tre fa compiere a uno stesso modello un lavoro e la sua critica.

Il principio dei quattro occhi applicato ai modelli

Questo principio è noto a tutti coloro che esercitano in un settore regolamentato. In banca, un impegno oltre una certa soglia richiede due firme. In revisione, il fascicolo di un socio è riesaminato da un altro socio. In compliance, chi rileva un'allerta non è chi la chiude.

La ragione non è la diffidenza. È che un controllore che condivide la prospettiva del controllato non vede ciò che questi non ha visto.

Questo principio è stato solo raramente trasposto ai sistemi di intelligenza artificiale, e mai come principio di architettura, per una ragione strutturale: presuppone due modelli indipendenti l'uno dall'altro, dunque un'architettura che non appartiene ad alcun produttore.

È ciò che separa uno strato di orchestrazione da un'offerta costruita su un modello unico. Il primo può affidare la creazione e il challenge a sistemi che non si somigliano. La seconda, quale che sia la qualità del suo modello, fa rileggere una produzione da chi l'ha scritta.

Le tre domande da porre prima di scegliere

Tre domande si pongono prima di scegliere, e nessuna riguarda le prestazioni annunciate.
La prima: su quali fonti è verificata la produzione? Un indice di 230 milioni di indirizzi non vale nulla se non contiene il diritto che praticate.
La seconda: chi controlla ciò che è stato prodotto? Se è il modello che l'ha redatto, il controllo condivide i suoi punti ciechi. È la domanda che pone il principio dei quattro occhi, e si pone qui come altrove.
La terza: che cosa accade quando arriva un modello migliore? La risposta determina se il vostro equipaggiamento invecchia o migliora.
Queste tre domande si rivolgono a ogni fornitore, noi compresi. Chi le pone ottiene da ciascuno una risposta verificabile, oppure constata di non ottenerne alcuna.
← Torna al blog