Linguistica computazionale · Made in Italy

IA e NLP
per la lingua italiana.

intelligo sviluppa soluzioni di elaborazione del linguaggio naturale per l'italiano, basate su un vocabolario e su algoritmi proprietari. Analizza ogni parola, individua le entità, coglie il tono e anonimizza il documento prima che lo legga qualcun altro.

NomiVerbiAggettiviArticoli e preposizioniAvverbi
italica-X · analisi di esempio

Velocità · dati misurati

Una frase analizzata in 2 millisecondi.

italica-X è stato scritto per l'italiano e per lavorare in fretta. Questi sono i tempi registrati dal motore nel 2026, su 1,5 milioni di richieste reali.

Una frase
2ms

tempo medio di analisi completa: parole, lemmi, parti del discorso

Un documento di alcune pagine
0,6s

tempo medio per un testo da 1.000 a 5.000 parole

Un documento anonimizzato con ADA
0,46s

~50.000 documenti analizzati in 6,2 ore

Il lessico
4,5milioni

forme flesse, generate da 115.924 lemmi

Medie calcolate sul registro delle richieste di italica-X, gennaio–settembre 2026. Il tempo misura l'elaborazione nel motore, esclusa la rete. Il dato di ADA viene dal benchmark del 26 agosto 2026 su un corpus di dominio, un documento alla volta.

Un motore, due prodotti

Il motore si occupa della linguistica. italica la mette nelle mani di chi studia l'italiano, ADA la mette al lavoro nei sistemi documentali della Pubblica Amministrazione.

Per chi studia e chi insegna

italica

L'analisi grammaticale dell'italiano in un'interfaccia simile a una chat. Scrivi una frase e ogni parola torna con la sua parte del discorso, il lemma e le caratteristiche grammaticali. Il motore impiega circa 2 millisecondi per frase, quindi la risposta è immediata. L'interfaccia è disponibile in sette lingue. Puoi usarla sul web, su iOS e su Android.

Apri italica.app →
Per PA, sanità e giustizia

ADA

Anonimizza documenti italiani senza farli uscire dalla vostra rete: 19 classi di entità, codici validati, sempre lo stesso risultato sullo stesso documento.

Guarda ADA su un documento →
basati su
Il motore

italica-X

Un vocabolario proprietario e un insieme di algoritmi costruiti sulla grammatica italiana. Riconosce il significato di una parola dal contesto: in la porta e in porta la la stessa parola ha due analisi diverse. italica-X analizza e classifica, per esempio, email e PEC.

Accesso API per integratori →
Tokenizzazione e POStoken → lemma → parte del discorso
Estrazione di entitàpersone, enti, luoghi, date
Polaritàpositiva · neutra · negativa
Registroformale, burocratico, colloquiale

ADA · Anonimizzazione on-premise

Ogni documento anonimizzato dentro la vostra rete.

Caricate un PDF o un testo. ADA lo analizza con italica-X, riconosce i dati personali e produce una versione in cui sono sostituiti da -OMISSIS-. Ogni fase resta un livello separato del documento (caricato, tokenizzato, annotato, anonimizzato), quindi il lavoro si può ispezionare e ripetere.

  • VelocitàMeno di mezzo secondo per documento: 48.464 documenti anonimizzati in 6,2 ore, uno alla volta.
  • Il dato non esceInstallato presso di voi su una macchina Linux: solo CPU, nessuna GPU, nessuna connessione in uscita. È l'assetto che serve per i dati sanitari e giudiziari (art. 9 GDPR).
  • VerificabileLo stesso documento dà sempre lo stesso risultato, e ogni riconoscimento risale a una regola con un nome. In sede di audit si mostra la regola, non una probabilità.
  • Codici validatiCodice fiscale (anche omocodici), IBAN, targa, CAP, carta d'identità, indirizzi IP e MAC vengono verificati, non indovinati.
  • GestionePiù aziende, ruoli, cartelle, registro delle operazioni e condivisione con scadenza. Le annotazioni si correggono a mano nell'editor.
Documento di esempioUfficio anagrafe

Richiesta di certificato di residenza

Il sottoscritto Mario Rossi, nato a Roma il 12/04/1978, codice fiscale RSSMRA78D12H501M, residente in via Roma 14, chiede il rilascio del certificato di residenza per uso amministrativo.

PersonaLuogoDataCodice personale · validatoIndirizzo
Dati personali evidenziati

ADA per l'editoria

Editori giuridici, banche dati e redazioni pubblicano ogni giorno sentenze, atti e documenti pieni di dati personali. ADA li anonimizza prima della pubblicazione: nomi, codici fiscali, indirizzi e gli altri dati diventano -OMISSIS-, il resto del testo resta intatto, leggibile e citabile.

  • Archivi interi48.464 documenti anonimizzati in 6,2 ore: un archivio di queste dimensioni si elabora in una notte, non in mesi di lavoro manuale.
  • Stesse regoleLo stesso dato viene oscurato allo stesso modo in tutto l'archivio, documento dopo documento.
  • RevisioneIl redattore controlla le annotazioni nell'editor e le corregge prima di pubblicare.
  • Testi riservatiManoscritti e documenti non pubblicati restano nella vostra rete.

19 classi di entità

Identità
persona, minore, indirizzo, documento d'identità, codice personale
Contatto e digitale
contatto, dato digitale, entità internet
Sensibili (art. 9)
dato sanitario, dato giudiziario, dato familiare
Economico e lavorativo
dato economico, dato lavorativo
Procedimentali
protocollo, procedimento, fascicolo, riferimento normativo
Contestuali
organizzazione, luogo, data

In sviluppo: pseudonimizzazione reversibile, con segnaposto tipizzati (PERSONA_001) e una tabella di corrispondenza cifrata conservata a parte.

Appliance · italica-X e ADA

Tutto su una macchina, dentro la vostra rete.

italica-X e ADA arrivano preinstallati e pronti all'uso. Potete riceverli su un server fisico oppure come macchina virtuale da importare nella vostra infrastruttura. Il software è lo stesso in entrambi i casi.

Server fisico

Consegnato configurato

Arriva con il software installato: va solo inserito nella rete dell'ente. Adatto a chi non ha un'infrastruttura di virtualizzazione.

Macchina virtuale

Immagine pronta

Un'immagine da importare nel vostro hypervisor, per chi ha già un data center o un cloud privato.

Cosa contiene, cosa richiede

  • Softwareitalica-X, il motore linguistico con un lessico di 4,5 milioni di forme flesse, e ADA, l'applicazione web di anonimizzazione.
  • HardwareLinux, solo CPU. Nessuna GPU e nessun acceleratore.
  • ReteNessuna connessione in uscita. Nessun servizio esterno nella catena del trattamento.
  • AccessoADA dal browser, nella rete interna. italica-X tramite API HTTP, per integrare l'analisi nei vostri sistemi.
  • Velocità0,46 secondi per documento anonimizzato, misurati su un corpus di dominio.

Dimensionamento e configurazione: scriveteci →

LLM on-premise · Progettazione

Modelli linguistici che restano nei vostri server.

Progettiamo soluzioni basate su Large Language Model installate sull'infrastruttura del cliente. Documenti, domande e risposte non escono mai dalla vostra rete. È la condizione che serve a Pubbliche Amministrazioni, sanità e aziende che trattano dati riservati.

  1. AnalisiCasi d'uso, volumi, vincoli di sicurezza e hardware disponibile.
  2. Scelta del modelloModelli open-weight valutati sull'italiano e sui vostri documenti, non su benchmark generici.
  3. ArchitetturaRicerca sui documenti interni (RAG), controllo degli accessi, log e audit, nel vostro data center o cloud privato.
  4. Messa in produzioneInstallazione, verifica della qualità in italiano, formazione del personale e manutenzione.
La vostra infrastruttura
Documenti e richiesteprotocollo, archivi, sportelli
italica-Xentità estratte, dati personali oscurati
LLM open-weightsu GPU dedicate, con RAG sui documenti interni
Risposte e bozzecon fonti citate e log di audit

Nessuna chiamata verso API esterne

Ricerca e sviluppo

Una lingua sola, studiata a fondo.

La nostra ricerca parte dalla grammatica italiana, non da un modello generico. Costruiamo il lessico, scriviamo le regole e misuriamo i risultati su testi reali: così nasce ogni funzione di italica-X e di ADA.

  • Prima il lessico115.924 lemmi generano 4.545.631 forme flesse, in media 39 per lemma. È la base su cui lavora ogni analisi.
  • Regole con un nomeOgni riconoscimento risale a una regola che si può leggere e verificare. Lo stesso testo dà sempre lo stesso risultato.
  • Misure, non promessePubblichiamo solo tempi misurati: 2 ms per frase su 1,5 milioni di richieste reali, 0,46 s per documento anonimizzato.
Esempio · dal lemma alle forme

anonimizzare

anonimizzoanonimizzianonimizzaanonimizziamoanonimizzateanonimizzanoanonimizzavoanonimizzaianonimizzòanonimizzeròanonimizzereianonimizzassianonimizzandoanonimizzatoanonimizzataanonimizzati…

115.924 lemmi → 4.545.631 forme

Sul banco di lavoro

  • In produzioneAnalisi grammaticale, entità, polarità e registro con italica-X.
  • In produzioneAnalisi e classificazione di email e PEC.
  • In produzioneAnonimizzazione con ADA su 19 classi di entità.
  • In sviluppoPseudonimizzazione reversibile: segnaposto tipizzati (PERSONA_001) e tabella di corrispondenza cifrata.
  • Su progettoLLM open-weight on-premise, con italica-X a monte per oscurare i dati personali.

SAC3 · Accordo Quadro per la PA locale

Nel raggruppamento che porta i servizi cloud agli enti locali.

intelligo è mandante del Raggruppamento Temporaneo d'Impresa guidato da IBM Italia, aggiudicatario del Lotto 1 dell'Accordo Quadro Servizi Applicativi Cloud, edizione 3, destinato alle Pubbliche Amministrazioni Locali.

Dodici aziende con competenze di system integration, sviluppo applicativo, migrazione al cloud, gestione operativa e consulenza direzionale, su tutto il territorio nazionale. Un ente attiva i servizi con un Contratto Esecutivo, secondo il proprio Piano dei Fabbisogni.

Aziende
12
Servizi a catalogo
13
Lotto
1

Le aziende del raggruppamento

  • IBM Italia S.p.A.Mandataria
  • N&C S.p.A.Mandante
  • intelligo S.r.l.Mandante
  • Leonardo S.p.A.Mandante
  • Net Service S.p.A.Mandante
  • Webgenesys S.p.A.Mandante
  • Deloitte Consulting S.r.l.Mandante
  • Telecom Italia S.p.A.Mandante
  • Engage S.p.A.Mandante
  • Jakala Civitas S.p.A.Mandante
  • Sistemi Informativi S.r.l.Mandante
  • We-Com S.r.l.Mandante

I 13 servizi del catalogo

Principali

  • SVISviluppo e manutenzione evolutiva
  • MIMigrazione applicativa al cloud
  • CFConfigurazione di soluzioni di terze parti
  • CWSviluppo in co-working con l'ente
  • MADManutenzione adeguativa
  • MACManutenzione correttiva
  • SSSupporto tecnico-specialistico ICT
  • GAGestione del portafoglio applicativo

Accessori

  • GOGestione operativa
  • IAMGestione dell'identità e dell'accesso
  • ACDAcquisizione e classificazione dati
  • ELEE-learning e assistenza virtuale
  • HDContact center e help desk

L'acquisizione e classificazione dati comprende anche i dati non strutturati: è l'ambito in cui lavorano italica-X e ADA.

L'azienda

Una startup innovativa del Salento.

Fondata nel 2023, intelligo è un team di ingegneri con esperienza nell'NLP maturata in ambito accademico e industriale. Ci concentriamo su una sola lingua, per trattarla meglio degli strumenti generalisti.

  • FORUM PA 2025

    A Roma, con N&C, come partner ospitati allo stand della Regione Puglia, abbiamo presentato italica-X e ADA. Il tema dell'edizione: «Verso una PA aumentata. Persone, tecnologie, relazioni».

  • Distretto Biomedico Salentino

    Presentazione di italica e ADA a investitori HealthTech, a Lecce.

  • Puglia Women AI

    Gold Partner del primo bootcamp sull'intelligenza artificiale dedicato alle donne, alla Fiera del Levante di Bari.

Fondata
2023
Sede
Veglie, Lecce
Qualità
ISO 9001
Parità di genere
UNI/PdR 125
Lingua
Prima l'italiano
Forma
Startup innovativa

Contatti

Portaci un documento. Ti mostriamo cosa può fare italica-X.