2 août 2026
KittenTTS offre une synthèse vocale de haute qualité avec des modèles aussi petits que 25 Mo, fonctionnant entièrement sur CPU. Découvrez comment l'utiliser, son API et pourquoi elle compte pour l'IA en périphérie.
CrispASR est un moteur vocal C++ unifié basé sur ggml, prenant en charge 53 modèles ASR et 51 modèles TTS sans dépendance Python. Exécutez Cohere Transcribe, Parakeet, Voxtral, Qwen3 et bien d'autres à partir d'une seule interface en ligne de commande.
Apprenez à entraîner un modèle de vision-langage de 65 millions de paramètres à partir de zéro en seulement 2 heures pour moins de 3 $, avec le code complet et les détails du jeu de données.
Apprenez à utiliser la compétence geo-seo-claude pour Claude Code afin d'auditer et d'optimiser les sites web pour les moteurs de recherche alimentés par l'IA comme ChatGPT, Claude et Perplexity.
OpenDrop est un outil en ligne de commande Python qui implémente le protocole Apple AirDrop, permettant le partage de fichiers avec des appareils iOS et macOS via Wi-Fi.
Découvrez comment les plongements par couche des modèles Gemma de Google permettent à un modèle de langage de 28,9 millions de paramètres de fonctionner entièrement sur une puce ESP32-S3 à 8 $, générant du texte à 9,5 tokens par seconde.
scriptc de Vercel Labs compile du TypeScript ordinaire en binaires natifs petits et rapides, sans Node ni V8. Découvrez comment cela fonctionne, ce qui est compilé et comment il se compare à Go et Rust.
Palmier Pro est un éditeur vidéo open-source, natif Swift pour macOS, qui intègre l'IA générative et la collaboration d'agents basée sur MCP directement dans la timeline.
FluidAudio est un SDK Swift permettant d'exécuter des modèles de pointe de reconnaissance vocale, synthèse vocale, diarisation des locuteurs et détection d'activité vocale entièrement sur l'appareil grâce au Neural Engine d'Apple. Cet article explore ses capacités, son architecture et comment l'intégrer dans vos applications.
OpenDrop est un outil en ligne de commande qui implémente le protocole Apple AirDrop en Python, permettant le partage de fichiers entre appareils via Wi-Fi, y compris avec les appareils Apple.
Découvrez SpeechRecognition, une bibliothèque Python polyvalente prenant en charge plusieurs moteurs et API de reconnaissance vocale, en ligne et hors ligne, avec des exemples pratiques et des conseils de dépannage.
Un tutoriel pratique pour construire, pré-entraîner et aligner un LLM Transformer de zéro en utilisant PyTorch, couvrant SFT, DPO, PPO et GRPO.