Faites tourner aScribe sur une infrastructure que vous contrôlez. Nous installons et configurons sur votre VPS ou serveur ; vous choisissez des moteurs locaux pour le maximum de confidentialité, ou des fournisseurs cloud pour la vitesse sans GPU.
Coût variable quasi nul, contrôle total des données
Configurez la transcription avec WhisperX et les résumés ou la recherche bibliothèque avec un LLM local via Ollama si la machine le permet. Audio et texte restent de votre côté. Pas de facture STT/LLM cloud sur ce chemin, et pas d’envoi du contenu brut à un tiers pour ces traitements.
WhisperX sur hôtes CPU : viable sans GPU pour beaucoup de charges professionnelles
Ollama (ou autre endpoint local compatible OpenAI) pour résumés, chat et embeddings selon le matériel
Vous payez le VPS et l’électricité, pas la minute de transcription cloud sur ce chemin
Pensé pour le juridique, le médical et les équipes régulées qui refusent l’export silencieux
Idéal quand la question n’est pas seulement le coût, mais où l’enregistrement a le droit d’aller.
Comment nous configurons votre stack
aScribe est multi-fournisseurs par conception. À l’installation, nous alignons les moteurs sur le matériel, la latence et la politique de données. Les noms ci-dessous correspondent au produit réel.
WhisperX tourne en local (tailles tiny à large-v3-turbo). Sur un bon CPU, c’est le chemin on-prem sans GPU : plus lent que le cloud pour de longs fichiers, mais l’audio ne quitte pas la machine.
GPU disponible : modèles locaux
Avec GPU, nous pouvons activer des modèles locaux plus lourds supportés par le produit (WhisperX plus large, et selon le build NVIDIA Parakeet, Canary ou Voxtral). Plus rapide, toujours sur votre matériel.
STT cloud si la politique le permet
Pour du débit sans GPU, nous branchons AssemblyAI, Deepgram ou OpenAI Whisper avec vos clés. Utile en pic de charge ; optionnel, jamais imposé.
Résumés, chat et recherche bibliothèque
LLM local : Ollama et équivalents
Résumés, chat par enregistrement et embeddings peuvent viser un endpoint local compatible OpenAI. Ollama est un choix courant sur un VPS généreux. Même machine, même frontière de confiance que l’audio.
LLM cloud si vous le préférez
Besoin de modèles plus puissants ou moins de RAM locale ? Les mêmes fonctions pointent vers un fournisseur cloud compatible OpenAI de votre choix. Les embeddings peuvent être séparés du chat.
Nous n’imposons pas un éditeur. La conversation d’install porte d’abord sur la politique : tout local (WhisperX + Ollama), hybride, ou assisté cloud. Puis SMTP, stockage et passation pour votre équipe.
Pourquoi l’auto-hébergement
Confidentialité, contrôle et archives durables sur votre hôte. Traitement 100 % local pour le sensible, ou mélange cloud quand la vitesse prime.
Note de licence
Usage interne sous ELv2 gratuit. Proposer aScribe en hébergement à des tiers exige une licence commerciale Majorum.
Installation sur votre serveur
À partir de 649 € : nous installons, configurons et livrons une instance prête pour la production sur une infrastructure que vous contrôlez (par ex. votre VPS).
Stack Docker sur votre hôte, selon accord
Fournisseurs STT et LLM selon CPU, GPU ou clés cloud que vous validez
Passage opérationnel pour votre équipe
Maintenance et support
Aide récurrente pour mises à jour, supervision et questions. cadrée et facturée à part.
Indiquez CPU vs GPU, langues et volume, et si vous visez un chemin 100 % local (WhisperX + Ollama) ou une aide cloud. Nous cadrons l’installation et le planning.
Nous utilisons des cookies pour la sécurité essentielle du formulaire de contact et, si vous acceptez, un cookie de préférence de langue. Politique de confidentialité