Vocalinux 0.14ベータ版、キーボードショートカット追加とWaylandの修正を実施

Linux向けオープンソース音声認識ツール「Vocalinux」が、7月16日に0.14ベータ版をリリースしました。今回のアップデートでは、カスタマイズ可能なショートカット機能によりユーザビリティが向上したほか、Waylandセッションへの対応が改善されています。また、リモート文字起こしモデルの選択肢も拡充されました。

新しいリリースでは、設定メニューからキーボードショートカットを構成できるようになりました。Ctrl、Alt、Shift、Superキーと文字や数字を組み合わせた設定が可能です。GNOME Wayland環境では、ベアXKBエンジン使用時のテキスト入力機能が復旧しました。また、ハイブリッド構成のIntelおよびAMD搭載ノートPCにおいて、whisper.cppエンジンがデフォルトですべてのCPUコアを使用する問題も修正されています。リモートAPI利用者は、OpenAI互換エンドポイントを通じてFunASRおよびSenseVoiceモデルにアクセスできるようになりました。なお、本アプリはGPL-3.0ライセンスのもとで引き続き完全にローカルで動作し、音声データはユーザーの端末内に保持されます。Vocalinuxはデフォルトのwhisper.cppに加え、PyTorch、NVIDIA、VOSK、リモートサーバーなどの複数のエンジンをサポートしており、システムトレイから起動してあらゆるテキストフィールドに音声入力を行うことが可能です。

関連記事

Illustration of a woman using ChatGPT voice features on a tablet in a living room setting.
AIによって生成された画像

OpenAI rolls out new GPT-Live voice models for ChatGPT

AIによるレポート AIによって生成された画像

OpenAI has begun releasing two updated voice models for ChatGPT that allow simultaneous listening and speaking. The changes aim to create more natural conversations.

Canonical has introduced Myna, an early-stage AI tool for voice dictation on Ubuntu that runs entirely on local hardware. The feature is planned for Ubuntu 26.10, scheduled for release in October. It uses a push-to-talk system and focuses on privacy by keeping all processing on the device.

AIによるレポート

Anthropic has upgraded its Claude voice mode to run on more powerful models and support connections to third-party apps.

このウェブサイトはCookieを使用します

サイトを改善するための分析にCookieを使用します。詳細については、プライバシーポリシーをお読みください。
拒否