Dictado por voz local para Linux. Hablás, ParlAR escribe en la aplicación que tenés abierta.
Sin cuenta. Sin telemetría. El reconocimiento de voz corre en tu computadora.
English: README.en.md
- Dictado en cualquier aplicación. Mantené el atajo, hablá y soltalo: el texto aparece donde está el cursor (editor, navegador, chat, terminal).
- Dos formas de dictar. Mantener el atajo mientras hablás, o un doble toque para dictado continuo hasta que vuelvas a hacer doble toque.
- Cancelar sin escribir.
Escdescarta lo que todavía no se escribió. - Por frases o incremental. Por frases escribe al hacer una pausa; Incremental va escribiendo mientras hablás.
- Comandos de voz para borrar la última oración, detener el dictado o hacer saltos de línea (ver Comandos de voz).
- Palabras y nombres propios. Le podés indicar términos, siglas o nombres que tiene que reconocer mejor.
- Configuración en una ventana propia, con un ícono en la bandeja del sistema y un indicador visual mientras dictás.
- Funciona con GuionAR, el teleprompter: si está abierto, sigue tu voz sin configurar nada.
| Estado | |
|---|---|
| Linux con X11 | Soportado. Validado en Fedora con X11. |
| Linux con Wayland | Funciona con limitaciones: el atajo global lo tiene que asignar tu escritorio (ver Wayland). No fue validado a mano. |
| Procesador (CPU) | Soportado en cualquier equipo. Es el modo por defecto si no hay GPU compatible. |
| GPU NVIDIA | Opcional. Si está disponible, ParlAR la usa para transcribir más rápido. |
| Debian/Ubuntu y Fedora | Distribuciones con instrucciones de instalación. |
| Windows, macOS | No soportados. |
Requisitos: Linux x86_64 con glibc 2.28 o posterior, Python 3.12, 3.13
o 3.14 con el módulo venv (lo trae la mayoría de las distribuciones
actuales) y un micrófono que funcione en tu escritorio. No hace falta
compilador. Espacio: unos 450 MB por versión instalada (al actualizar se
conserva la anterior hasta la siguiente actualización), más el modelo de voz
(unos 500 MB con el modelo small) y, con GPU NVIDIA, unos 2,5 GB para sus
librerías. El instalador exige al menos 2 GB libres para instalar (6 GB si
va a instalar el soporte para GPU NVIDIA; con --cpu-only alcanza con 2 GB)
y no guarda las descargas en la caché de pip.
ParlAR se instala desde la release publicada: un archivo con todo lo
necesario para tu cuenta de usuario. El instalador deja ParlAR con su propio
entorno y agrega la entrada al menú de aplicaciones. No hace falta sudo
salvo para los paquetes del sistema.
1. Paquetes del sistema
# Debian / Ubuntu
sudo apt install python3 python3-venv libportaudio2 python3-tk python3-gi \
gir1.2-gtk-3.0 libnotify-bin xdotool xclip wtype wl-clipboard
# Fedora
sudo dnf install python3 portaudio python3-tkinter python3-gobject gtk3 \
libnotify xdotool xclip wtype wl-clipboard2. Descargar desde la página de
releases el archivo
parlar-<versión>-linux-x86_64.tar.gz y SHA256SUMS, en la misma carpeta.
3. Verificar que la descarga esté completa y sin modificaciones:
sha256sum -c --ignore-missing SHA256SUMSTiene que responder OK para el archivo descargado.
4. Extraer e instalar
tar -xzf parlar-*-linux-x86_64.tar.gz
cd parlar-*/
./install.sh --preload-model--preload-model descarga el modelo de voz durante la instalación (varios
cientos de MB). Sin esa opción se descarga la primera vez que abrís ParlAR.
Si el instalador detecta una GPU NVIDIA compatible, instala también lo
necesario para usarla; --cpu-only lo evita.
Para que ParlAR pueda iniciarse solo al entrar a tu sesión, instalá con:
./install.sh --preload-model --install-serviceDespués lo activás o desactivás desde Configuración → Aplicación.
5. Abrir ParlAR desde el menú de aplicaciones.
La carpeta extraída ya no hace falta después de instalar: podés borrarla.
ParlAR queda en ~/.local/share/parlar y los comandos parlar, parlarctl
y parlar-uninstall en ~/.local/bin.
Buscá ParlAR en el menú de aplicaciones. Al abrirlo:
- se abre la ventana de Configuración;
- ParlAR queda funcionando en segundo plano, listo para dictar, aunque cierres esa ventana.
Si ParlAR ya estaba funcionando, abrirlo desde el menú sólo trae la Configuración. También podés abrirla con un clic en el ícono de la bandeja.
El menú del ícono muestra el estado y permite Pausar, abrir Configuración…, Reiniciar y Salir.
El atajo predeterminado es Ctrl derecho + tecla Super/Windows derecha. Podés cambiarlo en Configuración → Dictado. Si venís de una versión anterior, ParlAR conserva el atajo que ya tenías; la Configuración muestra el vigente.
| Acción | Qué pasa |
|---|---|
| Mantener el atajo | Empieza a escuchar en el momento. |
| Soltar el atajo | Termina y escribe lo que dijiste. |
| Doble toque rápido | Dictado continuo: escucha hasta el próximo doble toque. |
Esc |
Cancela lo pendiente. No borra lo que ya se escribió. |
Mientras dictás aparece un indicador chico que no toma el foco de la aplicación en la que estás escribiendo.
Se reconocen sólo cuando la frase completa es el comando:
| Decí | Hace |
|---|---|
| «borrar la última oración» | Borra la última oración que escribió ParlAR, cuando es seguro hacerlo. |
| «detener dictado» | Termina el dictado. |
| «nueva línea», «salto de línea» | Salto de línea. * |
| «nuevo párrafo», «punto y aparte» | Párrafo nuevo. * |
| «enviar», «mandar mensaje» | Presiona Enter. * |
* Los comandos que presionan Enter están desactivados por defecto: en
una terminal o un chat, una frase mal reconocida podría ejecutar o enviar
algo. Para activarlos, agregá "comando_enviar": true en
~/.config/parlar/config.json y reiniciá ParlAR. Leé
SECURITY.md antes de hacerlo.
Wayland no permite que una aplicación capture un atajo global. Asigná un atajo personalizado en la configuración de teclado de tu escritorio (GNOME, KDE y otros lo permiten) que ejecute:
~/.local/bin/parlarctl alternar
Cada pulsación inicia o termina el dictado. Si tu escritorio pide una ruta
completa, usá /home/TU_USUARIO/.local/bin/parlarctl alternar.
Los cambios se guardan desde la ventana. Algunos se aplican al momento y otros piden reiniciar ParlAR; la ventana lo indica y ofrece el botón Reiniciar ParlAR.
Dictado
- Atajo de dictado: cambiar la combinación o volver a la predeterminada.
- Estrategia: Por frases o Incremental.
- Reescritura: Sin reescritura, Formal, Conciso o Correo.
- Idioma: código como
esoen. Vacío detecta el idioma. - Palabras y nombres: términos que ParlAR debería reconocer mejor, uno por línea.
Micrófono
- Elegir el micrófono o usar el predeterminado del sistema.
- Probar micrófono para ver el nivel antes de dictar. Ese audio no se guarda.
GuionAR
- Estado de la conexión con GuionAR.
- Integrar con GuionAR y Usar GuionAR como salida exclusiva (ver Usar con GuionAR).
Aplicación
- Indicador: mostrarlo u ocultarlo, y elegir dónde aparece.
- Iniciar ParlAR al iniciar sesión: disponible si instalaste con
--install-service. - Conservar transcripciones: guarda una copia local de cada dictado. Apagado por defecto.
Avanzado
- Modelo: tamaño del modelo de voz. Más grande suele ser más preciso y más lento.
- Acelerador: Automático, CPU o NVIDIA CUDA. Automático usa la GPU si está disponible y si no el procesador.
- Precisión de cálculo: formato numérico del modelo. Automático funciona bien en la mayoría de los casos.
- Método de escritura: cómo se entrega el texto (automático, X11, Wayland, teclado virtual o sólo portapapeles).
La configuración se guarda en ~/.config/parlar/config.json.
GuionAR es un teleprompter que puede seguir tu voz mientras leés un guion, o mostrar lo que dictás en vivo.
- No hay que configurar nada. Si GuionAR está abierto, ParlAR se conecta solo. No importa cuál abras primero.
- Sigue tu voz en vivo: GuionAR recibe lo que vas diciendo mientras hablás, no sólo al terminar cada frase.
- Si GuionAR no está abierto, ParlAR funciona normalmente. Si lo cerrás y lo volvés a abrir, ParlAR se reconecta sin reiniciarse.
- Salida exclusiva (activada por defecto): mientras GuionAR está conectado, ParlAR le envía el dictado sólo a GuionAR y no escribe en la aplicación que tenés abierta. Sin GuionAR, escribe normalmente. El cambio se aplica desde la siguiente frase.
- Para desactivar la integración, apagá Integrar con GuionAR en Configuración → GuionAR.
Lo que se dicta mientras GuionAR está cerrado no se le envía después.
- El reconocimiento de voz es local. El audio se procesa en tu computadora y no se envía a ningún servicio.
- El audio no se guarda.
- Sin telemetría, sin cuenta.
- Transcripciones opcionales. Sólo si activás Conservar
transcripciones: se guardan como texto sin cifrar en
~/.local/share/parlar/sesiones/, accesibles sólo para tu usuario. ParlAR no las borra; las borrás vos. - Registros. Los mensajes de diagnóstico incluyen estados y tiempos, no audio ni texto dictado.
- Configuración en
~/.config/parlar/config.json. - Red. La instalación y la primera descarga del modelo usan internet. Después, dictar no la necesita.
- Reescritura con Ollama (opcional, apagada). Si configurás un modelo de Ollama para reescribir el texto, ParlAR le envía ese texto. Por defecto apunta a un Ollama en tu propia computadora; si configurás una dirección remota, el texto sale de tu equipo hacia ese servicio.
- El portapapeles y la aplicación de destino son programas aparte: ParlAR no controla qué hacen con el texto que reciben.
Los detalles del modelo de seguridad están en SECURITY.md.
Descargá y verificá la release nueva como en la instalación, extraela y
ejecutá su instalador con las mismas opciones que usaste antes (por ejemplo
--install-service):
tar -xzf parlar-*-linux-x86_64.tar.gz
cd parlar-*/
./install.shLa versión nueva se instala al lado de la actual y sólo se activa cuando quedó completa y validada. Si algo falla, la versión que tenías sigue funcionando sin cambios. Tu configuración, tu atajo y tus transcripciones se conservan.
Después, Salir desde el menú de la bandeja y volvé a abrir ParlAR desde
el menú de aplicaciones. Si lo usás como servicio:
systemctl --user restart parlar.service.
Si tenías ParlAR 1.0.x instalado desde una copia del repositorio, el instalador nuevo lo reconoce y lo reemplaza sin tocar tu configuración ni tus transcripciones. La copia del repositorio ya no hace falta.
parlar --version muestra la versión instalada.
Cerrá ParlAR (Salir en el menú de la bandeja) y ejecutá:
parlar-uninstallNo necesita la carpeta de la release. Si ~/.local/bin no está en tu
PATH: ~/.local/share/parlar/uninstall.sh.
Elimina: la aplicación instalada y sus versiones, los comandos parlar,
parlarctl y parlar-uninstall, la entrada del menú, el ícono y, si
existía, el inicio automático con la sesión.
Conserva: tu configuración (~/.config/parlar/) y las transcripciones
guardadas (~/.local/share/parlar/sesiones/).
Para borrar también tu configuración y tus transcripciones:
parlar-uninstall --purge-dataModelo de voz: queda en la caché de Hugging Face
(~/.cache/huggingface/), que otras aplicaciones pueden compartir, así que
ninguna opción la borra. Para eliminar sólo los modelos que usa ParlAR:
rm -rf ~/.cache/huggingface/hub/models--Systran--faster-whisper-*- No aparece en el menú o el comando
parlarno existe. Cerrá y volvé a abrir la sesión. Si usás la terminal, agregá~/.local/bina tuPATH. - No escucha, o escucha el micrófono equivocado. En Configuración → Micrófono elegí el dispositivo y usá Probar micrófono.
- Escucha pero no escribe nada. Comprobá que no esté activa la salida exclusiva con GuionAR abierto. Si no, probá otro Método de escritura en Configuración → Avanzado; Portapapeles te deja el texto para pegarlo a mano.
- En Wayland el atajo no hace nada. Es esperado: asigná el atajo desde tu escritorio (ver Wayland).
Escaparece como^[en una terminal. ParlAR cancela igual, pero no puede impedir que la tecla también llegue a la aplicación. Es una limitación conocida.- No ves el ícono en la bandeja. Algunos escritorios (por ejemplo GNOME) necesitan una extensión de indicadores. ParlAR funciona igual; la Configuración se abre desde el menú de aplicaciones.
- No arranca solo al iniciar sesión. Activá Iniciar ParlAR al iniciar
sesión en Configuración → Aplicación. Si no está disponible, reinstalá
con
--install-service. - Va lento. En Configuración → Avanzado probá un modelo más chico, o revisá que el Acelerador use la GPU si tenés una NVIDIA.
- El instalador dice que tu Python no es compatible. Cada release
incluye lo necesario para las versiones de Python que indica el mensaje.
Instalá una de ellas (por ejemplo
python3.13desde tu distribución) y volvé a ejecutar./install.sh; el instalador la busca solo. - Aviso de PortAudio al instalar. Instalá
libportaudio2(Debian/Ubuntu) oportaudio(Fedora); sin esa librería ParlAR no puede usar el micrófono.
- Linux únicamente. Validado a mano en Fedora con X11; Wayland no fue validado a mano.
- En Wayland no hay atajo global propio: se usa un atajo del escritorio.
Esccancela el dictado pero también puede llegar a la aplicación que tiene el foco.- ParlAR no puede confirmar que la aplicación de destino haya insertado el texto. Por seguridad, «borrar la última oración» no actúa cuando no hay certeza de qué se escribió.
- Como todo reconocimiento de voz, puede equivocarse o, con ruido de fondo, escribir cosas que nadie dijo. ParlAR filtra algunos casos conocidos, pero no todos.
- Si hay otras voces en el ambiente, ParlAR también las transcribe.
- Las transcripciones guardadas no están cifradas.
ParlAR es una aplicación mantenida como producto. Este repositorio contiene su código fuente y está organizado principalmente para instalarla, usarla e inspeccionar el código, no como un proyecto de desarrollo comunitario. Por eso no hay guía de contribución ni roadmap público.
El código fuente está en este repositorio y se publica bajo licencia MIT. Para usar ParlAR, instalá la release.
- Errores, problemas de instalación o de compatibilidad: abrí un issue y elegí el tipo que corresponda.
- Vulnerabilidades de seguridad: no las publiques en un issue. Seguí SECURITY.md.