Self-hosted

Esegui aScribe su infrastruttura che controlli. Installiamo e configuriamo sul tuo VPS o server; scegli motori locali per massima privacy o provider cloud se vuoi velocità senza GPU.

Server privato sicuro e forma d’onda, aScribe self-hosted

Massima privacy

Costo variabile quasi zero e controllo totale dei dati

Configura la trascrizione con WhisperX e riassunti o ricerca in libreria con un LLM locale via Ollama se la macchina lo consente. Audio e testo restano da te. Nessuna fattura STT/LLM cloud su quel percorso e nessun invio del contenuto grezzo a terzi per quei job.

  • WhisperX su host CPU: praticabile senza GPU per molti carichi professionali
  • Ollama (o altro endpoint locale compatibile OpenAI) per riassunti, chat e embedding secondo l’hardware
  • Paghi VPS ed energia, non i minuti di trascrizione cloud su quel percorso
  • Pensato per legale, sanità e team regolati che rifiutano l’export silenzioso

Ideale quando la domanda non è solo il prezzo, ma dove la registrazione può viaggiare.

Come configuriamo il tuo stack

aScribe è multiprovider per design. In installazione allineiamo i motori a hardware, latenza e policy dati. I nomi corrispondono al prodotto reale.

Motori che configuriamo con te

WhisperXGPU localAssemblyAIDeepgramOllamaOpenAI-compatible

Da voce a testo

VPS CPU: WhisperX

WhisperX gira in locale (da tiny a large-v3-turbo). Su un buon CPU è il percorso on-prem senza GPU: più lento del cloud su file lunghi, ma l’audio non esce dalla macchina.

Con GPU: modelli locali

Con GPU attiviamo modelli locali più pesanti supportati dal prodotto (WhisperX più grande e, a seconda del build, NVIDIA Parakeet, Canary o Voxtral). Più rapido, resta sul tuo hardware.

STT cloud se la policy lo consente

Per throughput senza GPU colleghiamo AssemblyAI, Deepgram o OpenAI Whisper con le tue chiavi. Utile nei picchi; opzionale, non obbligatorio.

Riassunti, chat e ricerca in libreria

LLM locale: Ollama e simili

Riassunti, chat per registrazione e embedding possono puntare a un endpoint locale compatibile OpenAI. Ollama è comune su VPS generosi. Stessa macchina, stesso perimetro di fiducia dell’audio.

LLM cloud se preferisci

Servono modelli più forti o meno RAM locale? Le stesse funzioni puntano a un provider cloud compatibile OpenAI che scegli tu. Gli embedding possono essere indipendenti dalla chat.

Non imponiamo un vendor. La conversazione di install parla prima di policy: tutto locale (WhisperX + Ollama), ibrido o assistito cloud. Poi SMTP, storage e handoff al team.

Perché self-host

Privacy, controllo e archivi duraturi sul tuo host. Elaborazione 100% locale per il sensibile, o mix cloud quando conta la velocità.

Nota licenza

Uso proprio sotto ELv2 è gratuito. Rioffrire aScribe come hosted a terzi richiede licenza commerciale Majorum.

Installazione sul tuo server

Da 649 €: installiamo, configuriamo e consegniamo un’istanza pronta per la produzione su infrastruttura che controlli (ad es. il tuo VPS).

  • Stack Docker sul tuo host secondo accordo
  • Provider STT e LLM in base a CPU, GPU o chiavi cloud che approvi
  • Walkthrough operativo per il tuo team

Manutenzione e supporto

Aiuto ricorrente per upgrade, monitoring e domande. In scope e fatturato a parte.

Avvia una conversazione di installazione

Indicaci CPU vs GPU, lingue e volume, e se serve un percorso tutto locale (WhisperX + Ollama) o aiuto cloud. Definiremo installazione e tempi.