La version bêta 0.14 de Vocalinux ajoute des raccourcis clavier et des correctifs pour Wayland

Vocalinux, un outil open source de reconnaissance vocale pour Linux, a publié sa version bêta 0.14 le 16 juillet. Cette mise à jour améliore l'ergonomie grâce à des raccourcis personnalisables et une meilleure prise en charge des sessions Wayland. Elle élargit également les options pour les modèles de transcription à distance.

La nouvelle version permet aux utilisateurs de configurer des raccourcis clavier via le menu des paramètres. Les combinaisons prennent désormais en charge les touches Ctrl, Alt, Maj et Super associées à des lettres ou des chiffres.

Sous GNOME Wayland, l'insertion de texte fonctionne de nouveau avec un moteur XKB standard. Le moteur whisper.cpp ne sollicite plus par défaut tous les cœurs de processeur sur les ordinateurs portables hybrides Intel et AMD.

Les utilisateurs d'API distantes peuvent désormais accéder aux modèles FunASR et SenseVoice via des points de terminaison compatibles avec OpenAI. L'application reste entièrement locale sous licence GPL-3.0, les données vocales étant conservées sur la machine de l'utilisateur.

Vocalinux prend en charge plusieurs moteurs, dont whisper.cpp par défaut, ainsi que des options pour PyTorch, NVIDIA, VOSK et des serveurs distants. Il s'exécute depuis la zone de notification pour dicter du texte dans n'importe quel champ.

Articles connexes

Illustration of a woman using ChatGPT voice features on a tablet in a living room setting.
Image générée par IA

OpenAI déploie de nouveaux modèles vocaux GPT-Live pour ChatGPT

Rapporté par l'IA Image générée par IA

OpenAI a commencé à publier deux modèles vocaux mis à jour pour ChatGPT qui permettent d'écouter et de parler simultanément. Ces changements visent à créer des conversations plus naturelles.

Canonical a présenté Myna, un outil d'IA en phase de développement pour la dictée vocale sur Ubuntu qui fonctionne entièrement sur le matériel local. Cette fonctionnalité est prévue pour Ubuntu 26.10, dont la sortie est programmée pour octobre. Elle utilise un système « push-to-talk » et privilégie la confidentialité en conservant tout le traitement sur l'appareil.

Rapporté par l'IA

Anthropic a mis à jour le mode vocal de Claude pour qu'il fonctionne avec des modèles plus puissants et prenne en charge les connexions à des applications tierces.

Ce site utilise des cookies

Nous utilisons des cookies pour l'analyse afin d'améliorer notre site. Lisez notre politique de confidentialité pour plus d'informations.
Refuser