AI onboard, non AI ready
Modelli, API locali, RAG e dashboard AION Console già installati e configurati. Non hardware da attrezzare dopo: una macchina pronta entro il suo perimetro di carico.
La AION™ R32 porta lo stack AI on-board su 32 GB di VRAM, con profili ottimizzati per chi parte da uno scope definito. Stessa filosofia della linea AION, fascia di carico più contenuta.
«La potenza è in casa, non in affitto.»
La AION™ R32 è l'ingresso solido alla AI locale: stack AI on-board già configurato, profili tarati sui 32 GB di VRAM. Non è la Pro 48, e lo diciamo chiaro.
Modelli, API locali, RAG e dashboard AION Console già installati e configurati. Non hardware da attrezzare dopo: una macchina pronta entro il suo perimetro di carico.
Modelli e contesti scelti per stare bene nei 32 GB di VRAM: dimensioni e quantizzazioni tarate per risposte fluide, senza spingere la macchina oltre la sua fascia.
Prompt, log e knowledge base restano in casa. Accesso LAN/VPN, nessuna porta pubblica di default, nessun cloud obbligatorio.
Stessa linea e stessa filosofia, ma fascia diversa. La R32 ha meno VRAM e uno scope più contenuto: scegliere bene parte dal sapere cosa NON è.
32 GB di VRAM, profili ottimizzati, ingresso accessibile alla AI locale. Adatta a un primo deployment con scope mirato: assistente locale, RAG su un corpus contenuto, API private per pochi servizi.
Non è la flagship AION™ Pro 48: meno VRAM significa meno carico contemporaneo, modelli più contenuti e nessun profilo long-context spinto. Per carichi più alti, multi-modello pesanti o long-context esteso, la fascia di riferimento è la Pro 48.
Scenari dove uno scope mirato su 32 GB copre bene il bisogno, senza sovradimensionare.
Aziende che vogliono iniziare con la AI privata su uno scope chiaro: un assistente interno, ricerca documentale locale, qualche API. Dati in casa fin dal giorno uno.
Una postazione potente per chi lavora da solo o in piccolo: inferenza locale fluida, RAG sui propri documenti, nessuna dipendenza dal cloud.
Un team che vuole validare la AI on-premise con un investimento contenuto prima di passare a una Pro 48 o a un nodo Node 48 condiviso.
Software stack di AionPremAI™, business unit di AlmaRe Group S.r.l., eseguito in locale dalla workstation. Profili calibrati sulla fascia 32 GB.
Ollama, llama.cpp, Open WebUI integrata, modelli base, API locale.
Endpoint OpenAI-compatible, logging tecnico, model routing entro la fascia 32 GB.
Qdrant/Chroma, embedding, reranker, parser documentali, citazioni. KB privata su corpus contenuto.
Dashboard stato GPU, modelli, servizi, backup, guide e update.
Update controllati, monitoraggio, recovery, assistenza, formazione.
ComfyUI, Stable Diffusion, Whisper, OCR locale. roadmap
Dati indicativi di posizionamento. Configurazione esatta definita nel progetto cliente.
| Voce | KiStation® AION™ R32 |
|---|---|
| VRAM | 32 GB |
| GPU | AMD Radeon AI PRO R9000/R9700 (32 GB, RDNA 4) |
| Sistema | Ubuntu 24.04 LTS · Linux AI Mode (multi-boot Windows dove previsto) |
| Modello | Qwen3.6-35B-A3B · profili ottimizzati per 32 GB (contesto ridotto) |
| Profilo | Profili ottimizzati per 32 GB, scope mirato |
| Stack AI | On-board, già configurato (Core, Inference, RAG, Control, Care) |
| RAG / reranker | RAG con embedding e reranker su corpus contenuto |
| Long-context | Contesti standard. Nessun profilo 1M: il long-context esteso è esclusivo della Pro 48, su validazione |
| API locali | Endpoint OpenAI-compatible in LAN/VPN |
| Modalità Windows | Windows Workstation Mode dove previsto · accesso anche via API |
| Rete | LAN / VPN · nessuna porta pubblica di default |
| Backup | Backup locale config e dati, restore documentato |
| Consegna | Delivery Report · macchina verificata e documentata |
| Supporto | AION Care (Basic / Pro / Enterprise) |
| Fascia | Ingresso · su configurazione |
L'architettura supporta percorsi di conformità GDPR ed EU AI Act, ma non costituisce da sola certificazione legale. Configurazioni, ruoli, log, backup e policy vengono definiti nel progetto cliente.
Lo stesso percorso verificabile della linea, anche nella fascia R32.
Per molti scenari di ingresso sì: assistente locale, RAG su un corpus contenuto, API private per pochi servizi. I profili sono tarati per stare bene nei 32 GB. Per carichi più alti o multi-modello pesanti la fascia di riferimento è la Pro 48.
Meno VRAM (32 vs 48 GB), quindi meno carico contemporaneo, modelli più contenuti e nessun profilo long-context spinto. Stessa linea e stesso stack, fascia di carico diversa.
No. Default LAN/VPN, nessuna porta pubblica aperta di default. I dati restano nel perimetro cliente.
Sì. È un buon pilot per validare la AI on-premise con investimento contenuto, per poi valutare una Pro 48 o un nodo Node 48 condiviso quando lo scope cresce.
Demo reale, numeri misurabili, Delivery Report. Non promettiamo magia: promettiamo una macchina verificata.