Linguistica computazionale · Made in Italy

IA e NLP
per la lingua italiana.

Sviluppiamo tecnologie di elaborazione del linguaggio naturale per l'italiano, basate su un lessico e su algoritmi proprietari. Analizziamo ogni parola, individuiamo le entità, riconosciamo polarità e registro e anonimizziamo i documenti prima che vengano condivisi o pubblicati.

NomiVerbiAggettiviArticoli e preposizioniAvverbi
italica-X · analisi di esempio

Velocità · dati misurati

Una frase analizzata in 2 millisecondi.

italica-X è stato progettato per l'italiano e per elaborare grandi volumi di testo in tempi brevi. Questi sono i tempi registrati dal motore nel 2026, su 1,5 milioni di richieste reali.

Una frase
2ms

tempo medio di analisi completa: parole, lemmi, parti del discorso

Un documento di alcune pagine
0,6s

tempo medio per un testo da 1.000 a 5.000 parole

Un documento anonimizzato con ADA
0,46s

~50.000 documenti analizzati in 6,2 ore

Il lessico
4,5milioni

forme flesse, generate da 115.924 lemmi

Medie calcolate partendo dai dati di log delle richieste di italica-X, gennaio–settembre 2026. Il tempo misura l'elaborazione nel motore, esclusa la rete. Il dato di ADA viene dal benchmark del 26 agosto 2026 su un corpus di dominio, un documento alla volta.

Un motore, due prodotti

italica-X costituisce il nucleo tecnologico delle nostre applicazioni. italica porta l'analisi linguistica nelle mani di chi studia l'italiano, ADA la mette al lavoro nei sistemi documentali della Pubblica Amministrazione.

Per chi studia e chi insegna

italica

L'analisi grammaticale dell'italiano in un'interfaccia simile a una chat. Scrivi una frase e ogni parola viene taggata con la sua parte del discorso, il lemma e le caratteristiche grammaticali. Il motore impiega circa 2 millisecondi per frase, quindi la risposta è immediata. L'interfaccia è disponibile in sette lingue. Puoi usarla sul web, su iOS e su Android.

Apri italica.app →
Per PA, sanità e giustizia

ADA

Anonimizza in locale i tuoi documenti in italiano: 21 classi di entità rilevate, codici validati in tempo reale con risultati deterministici.

Guarda ADA su un documento →
basati su
Il motore

italica-X

Un vocabolario proprietario e un insieme di algoritmi costruiti sulla grammatica italiana. Riconosce dal contesto il ruolo grammaticale di ogni parola: in la porta è chiusa e in porta la borsa la stessa parola ha due analisi diverse. italica-X può essere ovviamente utilizzato per analizzare e classificare email e PEC.

Accesso API per integratori →
Tokenizzazione e POStoken → lemma → parte del discorso
Estrazione di entitàpersone, enti, luoghi, date
Polaritàpositiva · neutra · negativa
Registroformale, burocratico, colloquiale

ADA · Anonimizzazione on-premises

Ogni documento viene processato ed anonimizzato on premises.

Caricate un PDF o un testo. ADA lo analizza con italica-X, riconosce i dati personali e produce una versione in cui sono sostituiti da -OMISSIS-. Ogni fase resta in un livello separato del documento (caricato, tokenizzato, annotato, anonimizzato), quindi il lavoro si può controllare e ripetere.

Perché scegliere ADA?

  • VelocitàMeno di mezzo secondo per documento: 48.464 documenti anonimizzati in 6,2 ore, uno alla volta.
  • Il dato non esceViene installato presso il vostro data center su macchine Linux: solo CPU, nessuna GPU, nessuna connessione in uscita. È un assetto adatto anche a dati sanitari (art. 9 GDPR) e giudiziari (art. 10 GDPR).
  • VerificabileL'elaborazione di uno stesso documento restituisce sempre lo stesso risultato. Ogni riconoscimento è riconducibile a regole esplicite, consultabili e verificabili.
  • Revisione umanaSostituire i dati con -OMISSIS- non basta sempre a rendere anonimo un documento: anche il contesto può far riconoscere una persona. Per questo ogni annotazione si può controllare e correggere a mano nell'editor prima di usare il documento: nei casi delicati l'ultima parola spetta a un operatore.
  • Codici validatiCodice fiscale (anche omocodici), IBAN, targa, CAP, carta d'identità, indirizzi IP e MAC vengono riconosciuti e poi verificati con i controlli formali di ciascun formato.
  • GestioneMulti-tenant, ruoli utente, fascicoli, log, sharing, export e tanto altro.
Documento di esempioUfficio anagrafe

Richiesta di certificato di residenza

Il sottoscritto Mario Rossi, nato a Roma il 12/04/1978, codice fiscale RSSMRA78D12H501M, residente in via Roma 14, chiede il rilascio del certificato di residenza per uso amministrativo.

PersonaLuogoDataCodice personale · validatoIndirizzo
Dati personali evidenziati

ADA per l'editoria

Editori giuridici, banche dati e redazioni pubblicano ogni giorno sentenze, atti e documenti che contengono dati personali. ADA li anonimizza prima della pubblicazione: nomi, codici fiscali, indirizzi e gli altri dati diventano -OMISSIS-, il resto del testo resta intatto, leggibile e citabile.

  • Archivi interi48.464 documenti anonimizzati in 6,2 ore: un archivio di queste dimensioni si elabora in una notte, non in mesi di lavoro manuale.
  • Stesse regoleLo stesso dato viene oscurato allo stesso modo in tutto l'archivio, documento dopo documento.
  • RevisioneIl redattore controlla le annotazioni nell'editor e le corregge prima di pubblicare.
  • Testi riservatiManoscritti e documenti non pubblicati restano nella vostra rete.

21 classi di entità

Identità
persona, minore, indirizzo, documento d'identità, codice personale
Contatto e digitale
contatto, dato digitale, entità internet
Sensibili (art. 9)
dato sanitario, dato giudiziario, dato familiare
Economico e lavorativo
dato economico, dato lavorativo, partita IVA
Procedimentali
protocollo, procedimento, fascicolo, riferimento normativo
Contestuali
organizzazione, luogo, data

In sviluppo: pseudonimizzazione reversibile, con segnaposto tipizzati (PERSONA_001) e una tabella di corrispondenza cifrata conservata a parte.

Appliance · italica-X e ADA

Tutto su una macchina, dentro la vostra rete.

italica-X e ADA arrivano preinstallati e pronti all'uso. Potete riceverli su un server fisico oppure come macchina virtuale da importare nella vostra infrastruttura. Il software è lo stesso in entrambi i casi.

Server fisico

Consegnato configurato

Arriva con il software installato: va solo inserito nella rete dell'ente. Adatto a chi non ha un'infrastruttura di virtualizzazione.

Macchina virtuale

Immagine pronta

Un'immagine da importare nel vostro hypervisor, per chi ha già un data center o un cloud privato.

Cosa contiene, cosa richiede

  • Softwareitalica-X, il motore linguistico con un lessico di 4,5 milioni di forme flesse, e ADA, l'applicazione web di anonimizzazione.
  • HardwareLinux, solo CPU. Nessuna GPU e nessun acceleratore.
  • ReteNessuna connessione in uscita. Nessun servizio esterno nella catena del trattamento.
  • AccessoADA dal browser, nella rete interna. italica-X tramite API HTTP, per integrare l'analisi nei vostri sistemi.
  • Velocità0,46 secondi per documento anonimizzato, misurati su un corpus di dominio.

Dimensionamento e configurazione: scriveteci →

LLM on-premises · Progettazione

Modelli linguistici installati nella vostra infrastruttura.

Progettiamo soluzioni basate su Large Language Model installate sull'infrastruttura del cliente. Documenti, domande e risposte non escono mai dalla vostra rete. Per Pubbliche Amministrazioni, sanità e aziende che trattano dati riservati è una base solida per la protezione dei dati, insieme alle misure organizzative e alle basi giuridiche del trattamento.

  1. AnalisiCasi d'uso, volumi, vincoli di sicurezza e hardware disponibile.
  2. Scelta del modelloModelli open-weight valutati sull'italiano e sui vostri documenti, non su benchmark generici.
  3. ArchitetturaRicerca sui documenti interni (RAG), controllo degli accessi, log e audit, nel vostro data center o cloud privato.
  4. Messa in produzioneInstallazione, verifica della qualità in italiano, formazione del personale e manutenzione.
La vostra infrastruttura
Documenti e richiesteprotocollo, archivi, sportelli
italica-Xentità estratte, dati personali oscurati
LLM open-weightsu GPU dedicate, con RAG sui documenti interni
Risposte e bozzecon fonti citate e log di audit

Nessuna chiamata verso API esterne

Ricerca e sviluppo

Una lingua sola, studiata a fondo.

La nostra ricerca parte dalla grammatica italiana, non da un modello generico. Costruiamo il lessico, scriviamo le regole e misuriamo i risultati su testi reali: così nasce ogni funzione di italica-X e di ADA.

  • Prima il lessico115.924 lemmi generano 4.545.631 forme flesse, in media 39 per lemma. È la base su cui lavora ogni analisi.
  • Regole con un nomeOgni riconoscimento risale a una regola che si può leggere e verificare. Lo stesso testo dà sempre lo stesso risultato.
  • Misure, non promessePubblichiamo solo tempi misurati: 2 ms per frase su 1,5 milioni di richieste reali, 0,46 s per documento anonimizzato.
Esempio · dal lemma alle forme

anonimizzare

anonimizzoanonimizzianonimizzaanonimizziamoanonimizzateanonimizzanoanonimizzavoanonimizzaianonimizzòanonimizzeròanonimizzereianonimizzassianonimizzandoanonimizzatoanonimizzataanonimizzati…

115.924 lemmi → 4.545.631 forme

Sul banco di lavoro

  • In produzioneAnalisi grammaticale, entità, polarità e registro con italica-X.
  • In produzioneAnalisi e classificazione di email e PEC.
  • In produzioneAnonimizzazione con ADA su 21 classi di entità.
  • In sviluppoPseudonimizzazione reversibile: segnaposto tipizzati (PERSONA_001) e tabella di corrispondenza cifrata.
  • Su progettoLLM open-weight on-premises, con italica-X a monte per oscurare i dati personali.

SAC3 · Accordo Quadro per la PA locale

intelligo nell'Accordo Quadro SAC3 per la Pubblica Amministrazione.

intelligo è mandante del Raggruppamento Temporaneo d'Impresa guidato da IBM Italia, aggiudicatario del Lotto 1 dell'Accordo Quadro Servizi Applicativi Cloud, edizione 3, destinato alle Pubbliche Amministrazioni Locali.

Nel raggruppamento, intelligo contribuisce con le proprie competenze NLP per l'italiano: l'analisi dei testi con italica-X, l'anonimizzazione dei documenti con ADA e le soluzioni basate su Large Language Model installate sull'infrastruttura dell'ente, da cui i dati non escono. Un ente attiva i servizi con un Contratto Esecutivo, secondo il proprio Piano dei Fabbisogni.

SAC3 con IBM

  • IBM Italia S.p.A.Mandataria
  • intelligo S.r.l.Mandante

I 13 servizi del catalogo SAC3

Principali

  • SVISviluppo e manutenzione evolutiva
  • MIMigrazione applicativa al cloud
  • CFConfigurazione di soluzioni di terze parti
  • CWSviluppo in co-working con l'ente
  • MADManutenzione adeguativa
  • MACManutenzione correttiva
  • SSSupporto tecnico-specialistico ICT
  • GAGestione del portafoglio applicativo

Accessori

  • GOGestione operativa
  • IAMGestione dell'identità e dell'accesso
  • ACDAcquisizione e classificazione dati
  • ELEE-learning e assistenza virtuale
  • HDContact center e help desk

L'acquisizione e classificazione dati comprende anche i dati non strutturati: è l'ambito in cui lavorano italica-X e ADA.

L'azienda

Competenze scientifiche, tecnologie proprietarie.

Fondata nel 2023, intelligo è un team di ingegneri con esperienza nell'NLP maturata in ambito accademico e industriale. Ci concentriamo su una sola lingua, l'italiano.

  • FORUM PA 2025

    A Roma, con N&C, come partner ospitati allo stand della Regione Puglia, abbiamo presentato italica-X e ADA. Il tema dell'edizione: «Verso una PA aumentata. Persone, tecnologie, relazioni».

  • Distretto Biomedico Salentino

    Presentazione di italica e ADA a investitori HealthTech, a Lecce.

  • Puglia Women AI

    Gold Partner del primo bootcamp sull'intelligenza artificiale dedicato alle donne, alla Fiera del Levante di Bari.

Fondata
2023
Sede
Veglie, Lecce
Qualità
ISO 9001
Parità di genere
UNI/PdR 125
Lingua
Prima l'italiano
Forma
Startup innovativa

Contatti

Portateci un documento: vi mostriamo cosa può fare italica-X.