Betreiben Sie aScribe auf Infrastruktur, die Sie kontrollieren. Wir installieren und konfigurieren auf Ihrem VPS oder Server; lokale Engines für maximale Privatsphäre oder Cloud-Anbieter, wenn Tempo ohne eigene GPU zählt.
Transkription mit WhisperX und Zusammenfassungen oder Bibliothekssuche mit lokalem LLM über Ollama, wenn die Maschine es hergibt. Audio und Text bleiben bei Ihnen. Keine Cloud-STT/LLM-Rechnung auf diesem Pfad und kein Drittpfad für den Rohinhalt dieser Jobs.
WhisperX auf CPU-Hosts: ohne GPU für viele professionelle Lasten machbar
Ollama (oder anderer lokaler OpenAI-kompatibler Endpoint) für Summaries, Chat und Embeddings je nach Hardware
Sie zahlen VPS und Strom, nicht die Cloud-Minuten-Transkription auf diesem Pfad
Für Recht, Medizin und regulierte Teams, die stillen Datenexport ablehnen
Ideal, wenn es nicht nur um Preis geht, sondern wohin die Aufnahme reisen darf.
So konfigurieren wir Ihren Stack
aScribe ist multiprovider. Bei der Installation stimmen wir Engines auf Hardware, Latenz und Datenpolitik ab. Die Namen entsprechen dem echten Produkt.
WhisperX läuft lokal (tiny bis large-v3-turbo). Auf solidem CPU-Host ist das der On-Prem-Weg ohne GPU: langsamer als Cloud bei langen Dateien, aber Audio verlässt die Box nicht.
GPU vorhanden: lokale Modelle
Mit GPU aktivieren wir schwerere lokale Modelle, die das Produkt unterstützt (größeres WhisperX und je nach Build NVIDIA Parakeet, Canary oder Voxtral). Schneller, bleibt auf Ihrer Hardware.
Cloud-STT wenn erlaubt
Für Durchsatz ohne GPU verdrahten wir AssemblyAI, Deepgram oder OpenAI Whisper mit Ihren Keys. Nützlich bei Lastspitzen; optional, nicht Pflicht.
Summaries, Chat und Bibliothekssuche
Lokales LLM: Ollama und Co.
Summaries, Chat pro Aufnahme und Embeddings können einen lokalen OpenAI-kompatiblen Endpoint nutzen. Ollama ist auf großzügigem VPS üblich. Gleiche Maschine, gleiche Vertrauensgrenze wie das Audio.
Cloud-LLM wenn gewünscht
Stärkere Modelle oder weniger lokaler RAM? Dieselben Features zeigen auf einen OpenAI-kompatiblen Cloud-Anbieter Ihrer Wahl. Embeddings können getrennt vom Chat laufen.
Wir zwingen keinen Vendor. Das Install-Gespräch klärt zuerst die Politik: voll lokal (WhisperX + Ollama), hybrid oder cloud-unterstützt. Dann SMTP, Speicher und Übergabe an Ihr Team.
Warum Self-Host
Privatsphäre, Kontrolle und langlebige Archive auf Ihrem Host. Voll lokal für Sensibles, oder Cloud-Mix wenn Tempo zählt.
Lizenzhinweis
Eigenes Nutzen unter ELv2 ist kostenlos. aScribe als Hosted-Service für Dritte erfordert kommerzielle Majorum-Lizenz.
Installation auf Ihrem Server
Ab 649 €: wir installieren, konfigurieren und übergeben eine produktionsreife Instanz auf Infrastruktur, die Sie kontrollieren (z. B. Ihr VPS).
Docker-Stack auf Ihrem Host laut Vereinbarung
STT- und LLM-Provider passend zu CPU, GPU oder Cloud-Keys, die Sie freigeben
Operativer Walkthrough für Ihr Team
Wartung & Support
Wiederkehrende Hilfe für Upgrades, Monitoring und Fragen. Begrenzt und separat fakturiert.
Sagen Sie CPU vs. GPU, Sprachen und Volumen und ob Sie einen voll lokalen Pfad (WhisperX + Ollama) oder Cloud-Hilfe brauchen. Wir klären Installation und Zeitplan.