Una memoria per agenti AI che non serve mai come vero un ricordo che la sua fonte non sostiene.
Ogni ricordo è legato alla sua fonte. Un giudice locale decide se la fonte lo sostiene davvero. Un fatto non sostenuto va in quarantena. Con una ricevuta: chi ha scritto la fonte, quando, l'impronta del contenuto, chi ha deciso.
Non è in vendita. Il codice è pubblico. Questa pagina dice cosa funziona, cosa no e con quali numeri, e cambia quando cambiano i numeri.
La versione 0.7, 4.705 commit da luglio a settembre 2026, è pubblica su github.com/aureliocpr-ctrl/verimem. Misurata da noi, sulla nostra macchina.
| La promessa | Cosa abbiamo misurato | Dove |
|---|---|---|
| Un fatto che la fonte non dice va in quarantena | Un dettaglio inventato senza numeri veniva ammesso 8 volte su 10 in italiano e 9 su 10 in inglese; con un numero dentro veniva quasi sempre fermato | README della 0.7, riga 37 |
| Nessun ricordo si perde | Il 21,1% dei ricordi non era mai stato servito: 3.828 su 18.147, al 13 settembre 2026 | registro del 13 settembre |
| Ogni ricordo porta la sua fonte | Lo store conservava un'impronta, non la fonte: la fonte intera si ritrova per 628 ricordi su 9.245, il 6,8% | registro del 3 ottobre |
Per questo la 0.7 è ferma dal 30 settembre 2026. Non la vendiamo e non la consigliamo. github.com/aureliocpr-ctrl/verimem ↗
Il 2 ottobre 2026 un'istanza senza il contesto della vecchia versione ha riscritto il nucleo da zero: github.com/aureliocpr-ctrl/verimem-next, licenza Apache-2.0, 47 commit, 190 test, 3.165 righe. Un solo percorso di scrittura. Nessun addestramento: il giudice è un modello pronto all'uso.
- Sulle memorie vere del pilota, il giudice di base senza riaddestramento fa 0,962 di AUROC contro 0,789 del giudice che avevamo riaddestrato: il riaddestramento su etichette date da un modello lo aveva peggiorato.
- Su un banco italiano con etichette umane (EVALITA 2009, 800 coppie), i migliori giudici pronti fanno 0,880, 0,870 e 0,841: nessuno è perfetto, e lo scriviamo.
La macchina parla con la tua voce.
Nelle trascrizioni degli agenti, l'85,6% dei blocchi marcati «utente» è testo iniettato dalla macchina. Chi legge senza filtro ricorda la macchina come se fossi tu. Nessuno degli strumenti che abbiamo smontato filtra.
Coerenza non è verità.
Se è l'agente a scegliere la fonte, il giudice controlla che il ricordo torni con quel testo, non che il testo sia vero. Per questo la ricevuta dirà sempre se la fonte è stata letta dal sistema, indicata, dichiarata o assente.
Chi parla, di chi è il fatto, che tipo di riga è.
«Il mio cane si chiama Aron» detto da te è un fatto su di te; detto dall'assistente, citato, chiesto o sperato, no. Scrivendo la voce dentro il testo prima del giudizio, gli errori su cinque giudici e quattro lingue passano da due terzi a quasi zero. Il tipo di riga, domanda, piano, sfogo, citazione, è il prossimo esperimento.
Ripetere non rende vero.
Un fatto detto tre volte in tre giorni è «detto tre volte», con le date e le righe accanto, mai «vero». Conta solo la voce della persona, un voto per giorno, e l'eco della macchina non conta mai.
Sei domande con i criteri scritti prima e le date.
- Il giudice regge sulle memorie vere? Se su 523 casi etichettati da un umano non tiene nove ricordi veri su dieci lasciando passare al massimo uno falso su dieci, e le cure fuori dal modello non lo salvano, il giudice esce dal prodotto. entro il 23 ottobre 2026
- Le cure fuori dal modello reggono su dati veri? Una cura che costa più del 5% dei ricordi veri o regge solo sul sintetico esce. entro il 23 ottobre 2026
- Il legame fonte-ricordo esiste nei negozi di memoria degli altri? Sì in tre su cinque: dove la fonte resta, il rapporto all'indietro è possibile. deciso
- Il costo è sostenibile? Giudice leggero sotto un gigabyte e sotto due decimi di secondo a fatto, oppure un servizio residente. entro il 23 ottobre 2026
- Qualcuno lo vuole? Quaranta conversazioni. Con meno di tre risposte, resta uno strumento nostro. entro il 1° dicembre 2026
- Il nucleo nuovo è una base? Sì: diciannove difetti trovati, nessuno strutturale. deciso
Il primo prodotto che può chiudersi è un rapporto sulle memorie che un agente ha già: per ogni ricordo, chi ha scritto la fonte, da quale fonte, quanto è vecchio, se la fonte è cambiata dopo, se numeri e date tornano, se la fonte lo dice davvero, e chi l'ha deciso. Il primo strato non ha bisogno di nessun modello.
Se hai un agente con una memoria e vuoi sapere quanto ti puoi fidare di quello che ricorda, scrivimi.
aureliocpr@gmail.com github.com/aureliocpr-ctrl/verimem-next ↗ Chi sono e come lavoro: capriello.com ↗