Pendra
Piattaforma di inferenza AI sovrana per industrie regolamentate con zero data retention
Pendra è una piattaforma di inferenza gestita per modelli LLM open-weight con infrastruttura sovrana. Offre API compatibili con OpenAI SDK, zero data retention architettonica (prompt e risposte processate solo in RAM), e deployment su GPU proprie o gestite da Pendra in UK. Pensata per settori regolamentati che necessitano conformità GDPR e controllo giurisdizionale dei dati.
Caratteristiche
- Zero data retention: prompts e completions processate in RAM, mai scritte su disco (architetturale, non policy).
- Sovranità giurisdizionale: deployment su compute UK o GPU proprie nel proprio paese, nessun accesso CLOUD Act USA.
- OpenAI SDK compatibility: drop-in replacement, basta cambiare base URL per usare codice client OpenAI esistente.
- Pendra Workers: agenti che girano su GPU proprie (NVIDIA, Apple Silicon, CPU fallback) e si connettono via WebSocket autenticato senza porte in ingresso.
- Modelli open-weight: Llama, Mistral, Qwen, DeepSeek, Gemma, Flux (immagini), Whisper/Parakeet (audio), Nomic/BGE (embeddings).
- DPA e GDPR compliance: Data Processing Agreement standard o custom, supporto DPIA, audit logging granulare (Enterprise).
- Private inference (Pro/Enterprise): crittografia end-to-end, Pendra non detiene mai la chiave di decriptazione.
- Auto data masking (Enterprise): redazione automatica di PII prima che raggiunga il modello.
Pro e contro
Pro
- ✓Zero data retention architettonica (RAM-only processing)
- ✓Compatibilità drop-in con OpenAI SDK (Python, Node.js)
- ✓DPA standard incluso dal piano Pro
- ✓Workers self-hosted su GPU proprie (NVIDIA, Apple Silicon, CPU)
- ✓Piano Free disponibile per uso personale
- ✓Infrastruttura UK sovereign, nessun accesso CLOUD Act USA
Casi d'uso
Domande frequenti
Cos'è Pendra?
Pendra è una piattaforma di inferenza gestita per modelli LLM open-weight, con API compatibili OpenAI SDK e infrastruttura sovrana (UK o GPU proprie). Zero data retention architettonica: prompt e risposte processate solo in RAM.
Quanto costa Pendra?
Piano Free (£0/mese, uso personale, 1 Worker self-hosted), Pro (£99/mese, uso commerciale, fino a 5 Workers), Enterprise (prezzo custom, GPU gestite, supporto dedicato).
C'è un piano gratuito?
Sì, il piano Free è disponibile per uso personale (valutazione, esperimenti locali, hobby project) con 1 Pendra Worker self-hosted. Per uso commerciale serve il piano Pro.
Supporta italiano?
(Risposta da fornire durante la review)
C'è un'API?
Sì, Pendra fornisce un'API OpenAI-compatibile (drop-in replacement) con SDK Python e Node.js. Le richieste passano attraverso l'API Pendra e vengono processate nei Workers.
I miei dati vengono archiviati o loggati?
No. Su tutti i piani, prompts e completions sono processate in RAM e mai memorizzate. È una garanzia architettonica, non una policy configurabile.
Cosa sono i Pendra Workers?
I Workers sono agenti Pendra che girano su GPU proprie (Linux, macOS, Windows) e servono modelli tramite la stessa API dell'infrastruttura gestita. Si connettono al control plane Pendra via WebSocket autenticato, senza aprire porte in ingresso.