Vocalinux, Linux işletim sistemi için özel olarak geliştirilmiş, açık kaynaklı ve gizlilik odaklı bir sesle yazma uygulamasıdır. Bu uygulama, kullanıcıların konuşmalarını doğrudan odaklanmış masaüstü uygulamasına (tarayıcı, metin düzenleyici, ofis uygulaması, terminal, mesajlaşma istemcisi vb.) metin olarak eklemesine olanak tanır. Windows ve macOS'taki yerleşik sesle yazma özelliklerine benzer bir iş akışı sunar, ancak tamamen Linux için tasarlanmıştır ve varsayılan olarak konuşmayı yerel olarak işler.
Uygulama, bağımsız bir transkripsiyon aracı olarak çalışmak yerine arka planda çalışır ve yapılandırılabilir bir klavye kısayolu ile etkinleştirilir. Kullanıcılar, kaydı açıp kapatabilir veya bas-konuş (push-to-talk) modunu kullanarak mikrofona konuşabilir. Bu işlem için herhangi bir hesap, abonelik veya bulut hizmetine ihtiyaç yoktur; tüm mikrofon kayıtları bilgisayarınızda kalır ve internet bağlantısı olmadan çalışır.
Vocalinux, üç farklı yerel konuşma tanıma motorunu destekler: whisper.cpp, OpenAI Whisper ve VOSK. Varsayılan motor olarak whisper.cpp kullanılır ve Whisper konuşma tanıma modelinin optimize edilmiş yerel bir uygulamasını sunar. Kullanıcılar, donanımlarına, tercih ettikleri dile veya performans gereksinimlerine göre başka bir motor seçebilir. Sistemin GPU'su tarafından desteklendiğinde Vulkan hızlandırması da kullanılabilir, bu da konuşma tanımanın AMD, Intel ve NVIDIA grafik donanımında çalışmasını sağlar.
Uygulama, hem X11 hem de Wayland oturumlarını destekler. Metin enjeksiyonu, özellikle Wayland'in klavye girişini simüle etme yeteneklerini sınırlaması nedeniyle iki ekran sistemi arasında önemli ölçüde farklılık gösterebilir. Ana sesle yazma özelliklerine ek olarak, Vocalinux bir sistem tepsisi simgesi, yapılandırılabilir ses ipuçları, otomatik başlatma desteği, grafiksel bir ayar arayüzü ve özelleştirilebilir klavye kısayolları içerir. Kısayol desteği, ABD dışı klavye düzenlerini de kapsar ve iki etkinleştirme modu arasında seçim yapılabilir.
Vocalinux çevrimdışı öncelikli olmasına rağmen, isteğe bağlı bir uzaktan mod da içerir. Ses dosyalarını ticari bir sağlayıcıya göndermek yerine, kullanıcılar uygulamayı kendilerinin işlettiği bir transkripsiyon sunucusuna yönlendirebilir. Desteklenen seçenekler arasında OpenAI uyumlu HTTP uç noktaları ve whisper.cpp ile sağlanan sunucu uygulaması bulunur; FunASR ve SenseVoice gibi ek motorlar da uyumlu sunucu yapılandırmaları aracılığıyla kullanılabilir. Kurulum, projenin etkileşimli kabuk yükleyicisi, Flatpak veya Arch AUR aracılığıyla Ubuntu, Debian, Fedora, Arch ve openSUSE gibi popüler Linux dağıtımlarında yapılabilir.