L'AI della tua azienda. Nella tua infrastruttura.

Chat AI, knowledge intelligence, RAG, agenti, generazione multimodale e automazione su un'infrastruttura AI locale controllata dalla tua organizzazione.

I3K Local AI non è una workstation con un LLM sopra. È una piattaforma AI privata installata in azienda: EuLLM come runtime di inferenza, RAG Enterprise come piattaforma di knowledge e document intelligence, e un'architettura estendibile a moduli su cui consolidare progressivamente i carichi di lavoro AI che oggi sono sparsi su più servizi SaaS esterni. Dati, prompt, documenti e contenuti generati restano sotto il controllo dell'organizzazione, e l'inferenza locale non ha costo per token.

L'appliance vive dentro il perimetro aziendale: i workload AI le girano intorno, i dati non la lasciano.

Una sola piattaforma AI locale

La stessa appliance non serve una sola funzione. È l'infrastruttura AI comune dell'organizzazione: si parte da chat privata e RAG, e nel tempo si aggiungono agenti, voice, document intelligence, generazione e automazione senza cambiare architettura.

Come è fatto lo stack

Applicazioni aziendali

Chat · RAG · Agenti · Voice · Documenti · Coding · Vision · Generative AI · Automazione

I3K AI Services

Orchestrazione, moduli, API interne, controllo accessi

RAG Enterprise

Knowledge e document intelligence

EuLLM

Runtime di inferenza, model management, API OpenAI-compatible

Hardware locale

AMD · NVIDIA · acceleratori validati I3K

Dallo hardware locale fino alle applicazioni aziendali: EuLLM è un livello dello stack, non l'intero prodotto.

Come leggere i badge

Mostriamo l'intera direzione della piattaforma, non solo ciò che è pronto oggi. Ogni capacità porta il suo stato reale: Disponibile fa parte della piattaforma core, Modulo opzionale si licenzia a parte, Pianificato è in sviluppo, Roadmap è direzione confermata ma non ancora in lavorazione, Dipende dall'hardware significa che serve la configurazione adatta.

DisponibileModulo opzionalePianificatoRoadmapDipende dall'hardware

Piattaforma core

Quello che l'appliance fa dal primo giorno.

4 capability

Private AI Chat

Disponibile

Chat aziendale privata su modelli LLM locali, con possibilità di usare modelli diversi a seconda del task e API OpenAI-compatible per collegare le applicazioni già in uso.

  • Chat multi-modello
  • Selezione modello per task
  • API OpenAI-compatible
  • Nessun prompt inviato a terzi

Enterprise Knowledge & RAG

Disponibile

Powered by RAG Enterprise. Interrogazione in linguaggio naturale su repository documentali aziendali, con risposte ancorate alle fonti.

  • Hybrid retrieval e ricerca semantica
  • Citazioni e fonti verificabili
  • Embeddings e reranking locali
  • PDF, DOCX, TXT e altre sorgenti
  • Analisi di repository estesi

Document Intelligence

Disponibile

Estrazione e comprensione strutturata dei documenti, oltre la semplice ricerca: è qui che RAG Enterprise si estende verso i processi aziendali concreti.

  • OCR e layout understanding
  • Classificazione documenti
  • Estrazione strutturata e table extraction
  • Fatture, moduli, contratti
  • Confronto e sintesi documenti

Model Management

Disponibile

Capacità centrale di EuLLM: gestire quali modelli girano, come sono quantizzati e su quale hardware, senza reinstallare la piattaforma.

  • Catalogo modelli e installazione
  • Model profile e quantizzazione
  • Deployment hardware-aware
  • Versioning e switch a caldo
  • Compatibilità API

Moduli che si aggiungono

Licenziabili separatamente sulla stessa appliance.

3 capability

AI Agents

Modulo opzionale

Gli LLM non si limitano a rispondere: con strumenti autorizzati possono eseguire task dentro i sistemi aziendali. Disponibilità e integrazioni dipendono dai moduli installati.

  • Tool use e workflow multi-step
  • Agenti specializzati per dominio
  • Accesso controllato a database, CRM, ERP
  • Ticketing, file system, email, calendari
  • Workflow approvativi

Private Coding Assistant

Modulo opzionale

La stessa infrastruttura come alternativa privata ai servizi AI di coding in cloud, con il codice che non lascia la rete aziendale.

  • Generazione e spiegazione codice
  • Code review e debugging
  • Analisi repository
  • Generazione SQL
  • Documentazione interna e assistenza DevOps

Enterprise AI Search

Pianificato

Ricerca unificata che estende la base documentale di RAG Enterprise ad altre sorgenti aziendali.

  • Documenti e file server
  • Knowledge base e intranet
  • Database e applicazioni interne
  • Email, CRM, ERP, ticket

Voice e riunioni

Dove il locale conta di più, perché le registrazioni sono fra i dati più sensibili.

2 capability

Voice AI

Pianificato

STT, LLM e TTS possono girare localmente quando la configurazione hardware lo consente: la voce dei clienti e del personale non esce dall'infrastruttura.

  • Speech-to-text e trascrizione
  • Trascrizione con riconoscimento speaker
  • Text-to-speech
  • Agenti vocali conversazionali e voicebot
  • Call assistant e integrazione telefonia
  • Automazione vocale customer service

Meeting Intelligence

Pianificato

Le riunioni diventano knowledge base interrogabile, senza passare da servizi di trascrizione esterni.

  • Trascrizione e identificazione speaker
  • Sintesi e decisioni prese
  • Estrazione action item
  • Ricerca semantica sulle riunioni
  • Ingestione nella knowledge base

Generative AI — oltre il testo

L'architettura è pensata per ospitare progressivamente modelli generativi multimodali locali. Disponibilità e resa dipendono da modello e configurazione hardware.

4 capability

Multimodal AI

Pianificato

Modelli capaci di comprendere testo, immagini, documenti, audio e video insieme.

  • Analisi foto e screenshot
  • Visual question answering
  • Document vision e chart understanding
  • Lettura fatture, moduli, scansioni
  • Inspection workflow e video understanding

Image Generation

PianificatoDipende dall'hardware

Generazione e manipolazione immagini in locale per flussi creativi interni.

  • Text-to-image
  • Editing, inpainting e outpainting
  • Varianti e background generation
  • Asset marketing e product visualization

Video Generation

PianificatoDipende dall'hardware

Workload video generativi. Non dichiariamo benchmark né disponibilità immediata: dipendono da modello e hardware.

  • Text-to-video e image-to-video
  • Editing video assistito
  • Sintesi e comprensione video
  • Clip automatiche
  • Contenuti marketing e formazione interna

Audio & Music

Roadmap

Modulo futuro per generazione ed elaborazione audio.

  • Text-to-audio e sound generation
  • Generazione musicale
  • Enhancement e trasformazione audio
  • Analisi audio

Processi aziendali

Dove l'AI locale smette di essere uno strumento e diventa parte del flusso di lavoro.

5 capability

Workflow & Automation

Pianificato

Evoluzione verso una piattaforma di automazione AI locale. L'obiettivo è ridurre la dipendenza da SaaS di automazione AI esterni, non sostituire integralmente strumenti come Make o Zapier.

  • Classificazione documenti ed estrazione dati
  • Elaborazione email e gestione richieste
  • Generazione report e preparazione documenti
  • Workflow approvativi e agentic workflow
  • Task schedulati e integrazioni API

Customer Service & Support AI

Pianificato

Affianca gli operatori invece di sostituirli, e si integra con l'help desk esistente anziché rimpiazzarlo.

  • Knowledge assistant per operatori
  • Classificazione ticket e risposte suggerite
  • Prima risposta automatica
  • Chat e voice agent
  • Integrazione con help desk in uso

Sales & Back Office AI

Pianificato

Carichi di lavoro documentali e commerciali sulla stessa infrastruttura.

  • Sales assistant e generazione proposte
  • Arricchimento CRM
  • Sintesi email e reportistica interna
  • Confronto contratti e analisi procurement
  • Assistente business intelligence

Model Specialisation

Roadmap

Adattamento dei modelli al dominio e al linguaggio dell'azienda, in collegamento con EuLLM Forge.

  • LoRA e QLoRA
  • Fine-tuning e model adaptation
  • Distillazione
  • Modelli verticali di settore
  • Modelli specifici per azienda

AI Operators & Computer Use

Roadmap

In prospettiva, agenti autorizzati potrebbero interagire con applicazioni grafiche, browser e software interni per automatizzare flussi ripetitivi. Soggetto ai permessi e alle policy di sicurezza definiti dal cliente.

  • Automazione browser
  • Data entry e compilazione moduli
  • Applicazioni legacy
  • Back-office ripetitivo
  • Trasferimento informazioni fra sistemi
Gli stessi carichi di lavoro descritti sopra, visti come piattaforma unica: dall'hardware locale a EuLLM, a RAG Enterprise, fino ai servizi AI.

Locale come default, non locale per forza

Il cuore della proposta è completamente locale: il default della piattaforma è on-premise e l'inferenza gira in sede. Quando però è il cliente a richiederlo, singoli workflow possono integrare servizi AI esterni come estensioni esplicitamente autorizzate. La differenza è che si tratta di una scelta consapevole e circoscritta, non della condizione di partenza.

Cosa si può consolidare sulla stessa infrastruttura

La maggior parte delle aziende paga oggi cinque o sei servizi AI diversi, ciascuno con il proprio contratto, il proprio prezzo a token e il proprio trasferimento di dati. I3K Local AI può sostituire o ridurre la dipendenza da diversi di questi servizi, progressivamente.

Chat AI aziendale
Enterprise search
RAG e knowledge assistant
Coding assistant
Trascrizione e voice AI
Document AI e OCR
Generazione immagini
Workflow automation
AI agents
API AI interne

Non promettiamo di sostituire ogni SaaS AI esterno. Promettiamo un'infrastruttura su cui consolidare, un workload alla volta.

Documenti, database, CRM/ERP e applicazioni interne entrano nell'appliance; da lì escono chat privata, RAG, agenti, voice e API interne. I dati non lasciano l'infrastruttura.

Come funziona il modello

Inferenza locale, costo prevedibile

L'inferenza gira sull'hardware in sede. Nessun costo per token, nessuna sorpresa in fattura quando l'uso cresce. Il costo è l'hardware più la subscription software.

L'hardware è vostro

L'appliance viene acquistata dal cliente, non noleggiata. Resta un asset aziendale anche se un domani cambiate fornitore software.

Acceleratori validati, non vincolo di marca

Lavoriamo con AMD, NVIDIA e altri acceleratori che abbiamo validato sul nostro stack. Se avete un requisito CUDA esplicito, c'è una configurazione dedicata.

Si scala per gradi

Si parte da una singola appliance e si cresce verso multi-GPU o cluster quando la concorrenza lo richiede, senza rifare l'architettura.

Capacity, Performance, Enterprise

Due configurazioni allo stesso prezzo possono servire scopi opposti. La differenza non è "quanto costa" ma "cosa ci fai".

Capacity

Grande quantità di memoria disponibile. Permette di caricare localmente modelli più grandi e lavorare su contesti estesi, privilegiando ciò che entra in memoria rispetto alla reattività.

Performance

Memoria GPU dedicata e bandwidth superiore. Pensata per inferenza più veloce, interattività e più workload concorrenti sulla stessa macchina.

Enterprise

Grande memoria e prestazioni insieme, con memoria ECC. Per installazioni multi-utente e multi-servizio dove l'affidabilità del calcolo non è negoziabile.

Configurazioni pianificate

Prezzi IVA esclusa, indicativi e soggetti a conferma. Ogni configurazione include installazione iniziale, EuLLM, RAG Enterprise e 12 mesi di I3K AI Suite.

Local AI Capacity 128

Ryzen AI Max+ 395 · 128 GB unified memory

da €5.900

Massima capacità di memoria della fascia d'ingresso, con buona efficienza energetica. Per modelli grandi, RAG su corpus estesi e document intelligence dove conta poter tenere tutto in memoria.

Local AI Performance 32

32 GB GPU dedicata · AMD Radeon AI PRO R9700 o hardware equivalente validato

da €5.900

Stessa fascia di prezzo, filosofia opposta: meno memoria ma più velocità. Per AI interattiva, dove il tempo di risposta conta più della dimensione del modello.

Più richiesta

Local AI Performance 64

64 GB di memoria acceleratore aggregata

da €8.900

Il prodotto centrale della gamma. Può unire gli acceleratori per servire modelli più grandi, oppure dedicarli a carichi separati — LLM su uno, vision, embeddings o agenti sull'altro. Infrastruttura AI di reparto.

Local AI CUDA 32

Configurazione NVIDIA · 32 GB

da €9.900

Per workload o applicazioni che richiedono CUDA, che sia per librerie proprietarie, pipeline esistenti o policy interne. Stesso stack software, ecosistema NVIDIA.

Local AI Enterprise 96

96 GB di memoria GPU ECC

da €22.900

Per inferenza su modelli grandi, elevata concorrenza di sessioni e workload enterprise multi-servizio.

Coming soon

Local AI Capacity 192

Fino a 192 GB unified memory

Su preventivo

Configurazione pianificata. Per chi ha bisogno di ancora più capacità di memoria in un singolo nodo.

Non pubblichiamo valori di token/secondo finché non avremo benchmark I3K ed EuLLM misurati direttamente sull'hardware definitivo. Preferiamo dare numeri veri più avanti che numeri comodi adesso.

Cosa succede dopo il primo anno

Incluso nell'acquisto

Hardware, installazione iniziale, EuLLM, RAG Enterprise e 12 mesi di I3K AI Suite nel livello concordato.

Nessun costo per token sull'inferenza locale.

Dal secondo anno la subscription si sceglie in base al numero di utenti licenziati. L'inferenza locale non ha costo per token in nessun livello.

I3K Care

€129/mese

Fino a 25 utenti

  • Aggiornamenti core e security fix
  • Aggiornamenti EuLLM
  • Nuovi model profile certificati
  • Bug fix e supporto tecnico

AI Suite Team

€399/mese

Fino a 100 utenti

  • Tutto quello incluso in I3K Care
  • RAG Enterprise Pro
  • Moduli agenti, document AI e voice licenziati
  • Connettori verso sistemi aziendali
  • Nuove versioni dei moduli acquistati

AI Suite Business

€699/mese

Fino a 250 utenti

  • Tutto quello incluso in AI Suite Team
  • Supporto prioritario
  • Funzionalità enterprise

AI Suite Corporate

€1.190/mese

Fino a 500 utenti

  • Tutto quello incluso in AI Suite Business
  • Dimensionamento su più appliance

AI Suite Enterprise

€1.990/mese

Fino a 1.000 utenti

  • Tutto quello incluso in AI Suite Corporate
  • Architetture cluster multi-nodo

Oltre 1.000 utenti: Custom Enterprise Agreement.

Il numero di utenti riguarda la licenza, non le sessioni simultanee: la concorrenza effettiva si dimensiona sull'hardware e, per organizzazioni grandi, su più appliance o cluster.

Supporto tecnico

Manutenzione software, aggiornamenti e supporto tecnico L2/L3 per il team IT del cliente, secondo il piano di servizio scelto.

Licenza e aggiornamenti

L'appliance acquistata continua a funzionare anche senza rinnovo. Con subscription attiva sono compresi:

  • Aggiornamenti software e di sicurezza
  • Bug fix
  • Aggiornamenti di compatibilità modelli
  • Miglioramenti prestazionali
  • Nuove release dei moduli licenziati
  • Supporto tecnico

Nuovi moduli o nuove linee di prodotto potranno essere licenziati separatamente: la subscription non include automaticamente ogni prodotto futuro I3K.

Costruisci la tua infrastruttura AI privata

Dicci quanti utenti avete, quali workload volete portare in casa e che requisiti avete sui dati. I3K vi propone la configurazione Local AI adatta.

Richiedi accesso al programma

Bastano pochi dati per iniziare. Ti rispondiamo entro due giorni lavorativi.

Tipo di richiesta

Referente

Azienda