AIBit-Découvrez des projets open source AIBit-Découvrez des projets open source
Projets Open SourceWeb Scraping & DonnéesAgents IA & AutomatisationOutils et ressources IA
Plus
Apprentissage et tutorielsRecherche et benchmarks IADéveloppement et SécuritéWeb & InfrastructureMédias et création de contenuMatériel et Edge AIRessources pour startups
AIBit-Découvrez des projets open source › Outils et ressources IA› IA Voix & Audio

19 septembre 2026

VoiceStudio : un atelier d’IA vocale entièrement local et open source

Découvrez VoiceStudio, une alternative locale à ElevenLabs pour le clonage vocal, le doublage, la dictée, la transcription et les livres audio dans 646 langues.

  • 14 sept. 2026

    YuE2 : génération musicale ouverte avec partitions modifiables et agents IA

    YuE2 transforme des paroles et des prompts de style en partitions musicales modifiables, en chansons de qualité comparable aux modèles de pointe, en reprises zero-shot et en révisions pilotées par des agents.

  • 14 sept. 2026

    VoiceStudio : une alternative open source et entièrement locale à ElevenLabs

    VoiceStudio apporte le clonage vocal, le doublage, la dictée, la transcription et les livres audio sur votre matériel grâce à 16 moteurs TTS et 11 moteurs ASR.

  • 30 août 2026

    StemDeck : Séparation audio IA 6 pistes gratuite et locale avec Demucs et Tauri

    StemDeck est un studio d'extraction de stems open source et local-first qui isole la voix, la batterie, la basse, la guitare et le piano, sans abonnement cloud ni téléversement de données.

  • 14 août 2026

    HOT-Step CPP : Génération de musique IA locale avec C++ et GGML

    Générez de la musique stéréo 48 kHz localement avec HOT-Step CPP, une interface C++/GGML riche en fonctionnalités pour ACE-Step, outils audio, plugins et entraînement de modèles.

  • 2 août 2026

    Inflect v2 : TTS local texte-vers-forme d'onde à 3,96 M et 9,36 M de paramètres

    Inflect v2 offre un TTS anglais complet à 24 kHz dans deux modèles compacts (3,96 M et 9,36 M de paramètres) sans vocodeur externe. Explorez l'architecture, l'évaluation et le déploiement sur CPU.

  • 2 août 2026

    KittenTTS : Synthèse vocale de pointe en moins de 25 Mo fonctionnant sur CPU

    KittenTTS offre une synthèse vocale de haute qualité avec des modèles aussi petits que 25 Mo, fonctionnant entièrement sur CPU. Découvrez comment l'utiliser, son API et pourquoi elle compte pour l'IA en périphérie.

  • 30 juil. 2026

    CrispASR : Un binaire C++ pour 53 modèles ASR et 51 modèles TTS

    CrispASR est un moteur vocal C++ unifié basé sur ggml, prenant en charge 53 modèles ASR et 51 modèles TTS sans dépendance Python. Exécutez Cohere Transcribe, Parakeet, Voxtral, Qwen3 et bien d'autres à partir d'une seule interface en ligne de commande.

  • 22 juil. 2026

    FluidAudio : Exécutez les modèles audio IA de pointe localement sur les appareils Apple avec CoreML

    FluidAudio est un SDK Swift permettant d'exécuter des modèles de pointe de reconnaissance vocale, synthèse vocale, diarisation des locuteurs et détection d'activité vocale entièrement sur l'appareil grâce au Neural Engine d'Apple. Cet article explore ses capacités, son architecture et comment l'intégrer dans vos applications.

  • 22 juil. 2026

    SpeechRecognition : Une bibliothèque Python complète pour la reconnaissance vocale

    Découvrez SpeechRecognition, une bibliothèque Python polyvalente prenant en charge plusieurs moteurs et API de reconnaissance vocale, en ligne et hors ligne, avec des exemples pratiques et des conseils de dépannage.

  • 11 juil. 2026

    Speech Swift : Kit vocal IA sur appareil pour Apple Silicon

    Découvrez Speech Swift, un kit open source pour la reconnaissance vocale, la synthèse vocale, la traduction parole-à-parole, la détection d'activité vocale et la diarisation sur Apple Silicon avec MLX et CoreML.

  • 6 juin 2026

    Miso TTS 8B : Un modèle de synthèse vocale open-source de haute qualité

    Miso TTS 8B est un modèle de synthèse vocale open-source de pointe avec 8 milliards de paramètres, offrant une génération vocale très émotive et des capacités de clonage vocal.

Précédent 1 / 4 Suivant

Outils d'IA sélectionnés, projets open source, tutoriels et ressources pour les développeurs travaillant avec l'intelligence artificielle.

Conditions d'utilisation Politique de confidentialité © 2026 AIBit-Découvrez des projets open source