Un système de transcription de réunions et de questions/réponses utilisant Whisper en local avec support du français.
- Transcription audio locale avec Whisper
- Support natif du français
- Système de Q&A avec embeddings CamemBERT
- Gestion automatique de la mémoire GPU
- Stockage vectoriel avec Qdrant
- Python 3.8.1 ou supérieur
- Poetry pour la gestion des dépendances
- Docker et Docker Compose pour Qdrant
- GPU recommandé (mais pas obligatoire)
- FFmpeg installé sur le système
- Cloner le dépôt :
git clone <repo_url>
cd VocalLens-AI- Installer les dépendances avec Poetry :
poetry install- Démarrer Qdrant :
docker-compose up -d- Lancer l'application :
poetry run python app.pyPOST /transcribe
- Input: Fichier audio (WAV)
- Output: Transcription et métadonnées
POST /query
- Input: Question en texte
- Output: Résultats pertinents avec scores
L'application s'adapte automatiquement à votre matériel :
- Sélection automatique du modèle Whisper selon la mémoire GPU
- Optimisation des ressources pour Qdrant
- Gestion intelligente de la mémoire
Consultez le CHANGELOG.md pour suivre les évolutions du projet.
[Votre licence ici]