Self-Hosted

Betreiben Sie aScribe auf Infrastruktur, die Sie kontrollieren. Wir installieren und konfigurieren auf Ihrem VPS oder Server; lokale Engines für maximale Privatsphäre oder Cloud-Anbieter, wenn Tempo ohne eigene GPU zählt.

Sicherer privater Server und Wellenform, self-hosted aScribe

Stärkster Datenschutz-Pfad

Fast null variable Kosten, volle Datenkontrolle

Transkription mit WhisperX und Zusammenfassungen oder Bibliothekssuche mit lokalem LLM über Ollama, wenn die Maschine es hergibt. Audio und Text bleiben bei Ihnen. Keine Cloud-STT/LLM-Rechnung auf diesem Pfad und kein Drittpfad für den Rohinhalt dieser Jobs.

  • WhisperX auf CPU-Hosts: ohne GPU für viele professionelle Lasten machbar
  • Ollama (oder anderer lokaler OpenAI-kompatibler Endpoint) für Summaries, Chat und Embeddings je nach Hardware
  • Sie zahlen VPS und Strom, nicht die Cloud-Minuten-Transkription auf diesem Pfad
  • Für Recht, Medizin und regulierte Teams, die stillen Datenexport ablehnen

Ideal, wenn es nicht nur um Preis geht, sondern wohin die Aufnahme reisen darf.

So konfigurieren wir Ihren Stack

aScribe ist multiprovider. Bei der Installation stimmen wir Engines auf Hardware, Latenz und Datenpolitik ab. Die Namen entsprechen dem echten Produkt.

Engines, die wir mit Ihnen konfigurieren

WhisperXGPU localAssemblyAIDeepgramOllamaOpenAI-compatible

Sprache zu Text

CPU-VPS: WhisperX

WhisperX läuft lokal (tiny bis large-v3-turbo). Auf solidem CPU-Host ist das der On-Prem-Weg ohne GPU: langsamer als Cloud bei langen Dateien, aber Audio verlässt die Box nicht.

GPU vorhanden: lokale Modelle

Mit GPU aktivieren wir schwerere lokale Modelle, die das Produkt unterstützt (größeres WhisperX und je nach Build NVIDIA Parakeet, Canary oder Voxtral). Schneller, bleibt auf Ihrer Hardware.

Cloud-STT wenn erlaubt

Für Durchsatz ohne GPU verdrahten wir AssemblyAI, Deepgram oder OpenAI Whisper mit Ihren Keys. Nützlich bei Lastspitzen; optional, nicht Pflicht.

Summaries, Chat und Bibliothekssuche

Lokales LLM: Ollama und Co.

Summaries, Chat pro Aufnahme und Embeddings können einen lokalen OpenAI-kompatiblen Endpoint nutzen. Ollama ist auf großzügigem VPS üblich. Gleiche Maschine, gleiche Vertrauensgrenze wie das Audio.

Cloud-LLM wenn gewünscht

Stärkere Modelle oder weniger lokaler RAM? Dieselben Features zeigen auf einen OpenAI-kompatiblen Cloud-Anbieter Ihrer Wahl. Embeddings können getrennt vom Chat laufen.

Wir zwingen keinen Vendor. Das Install-Gespräch klärt zuerst die Politik: voll lokal (WhisperX + Ollama), hybrid oder cloud-unterstützt. Dann SMTP, Speicher und Übergabe an Ihr Team.

Warum Self-Host

Privatsphäre, Kontrolle und langlebige Archive auf Ihrem Host. Voll lokal für Sensibles, oder Cloud-Mix wenn Tempo zählt.

Lizenzhinweis

Eigenes Nutzen unter ELv2 ist kostenlos. aScribe als Hosted-Service für Dritte erfordert kommerzielle Majorum-Lizenz.

Installation auf Ihrem Server

Ab 649 €: wir installieren, konfigurieren und übergeben eine produktionsreife Instanz auf Infrastruktur, die Sie kontrollieren (z. B. Ihr VPS).

  • Docker-Stack auf Ihrem Host laut Vereinbarung
  • STT- und LLM-Provider passend zu CPU, GPU oder Cloud-Keys, die Sie freigeben
  • Operativer Walkthrough für Ihr Team

Wartung & Support

Wiederkehrende Hilfe für Upgrades, Monitoring und Fragen. Begrenzt und separat fakturiert.

Installationsgespräch starten

Sagen Sie CPU vs. GPU, Sprachen und Volumen und ob Sie einen voll lokalen Pfad (WhisperX + Ollama) oder Cloud-Hilfe brauchen. Wir klären Installation und Zeitplan.