Dictar en Windows – sin conexión, directamente en cualquier programa
Piensas más rápido de lo que escribes. Pulsa el atajo, habla, púlsalo otra vez — el texto aparece justo donde está el cursor: en Outlook, Word, el navegador o el chat. El reconocimiento de voz funciona con Whisper o Parakeet en tu propio equipo. Ni la grabación ni el texto se suben a ningún sitio.
No hace falta cuenta · Gratis en el idioma de tu sistema
Windows 10 o superior · Sin permisos de administrador · Sin cuenta
Escribir es el cuello de botella
Sabes exactamente lo que tiene que decir el correo. Solo necesitas doce minutos para escribirlo.
Aplicaciones de dictado hay muchas. La mayoría tiene tres inconvenientes: envían tu voz a un servidor, cobran cada mes y son una aplicación aparte — dictas allí, copias el texto y lo pegas en otro sitio.
Celerando no tiene una ventana para hablar. El texto aparece directamente en el programa en el que ya estás trabajando.
Tres pasos, y no hay un cuarto
En cualquier parte de Windows, sin importar qué programa esté en primer plano.
Con normalidad. Sin comandos ni pausas en puntos concretos.
El texto está donde estaba el cursor. Sin copiar, sin pegar, sin cambiar de ventana. ¿Prefieres mantener pulsado y soltar? A partir de Business también hay pulsar para hablar.
Dos motores, 99 idiomas — todo en tu PC
Celerando reconoce la voz con dos motores de código abierto. Ambos funcionan en local y la aplicación los descarga directamente de Hugging Face:
99 idiomas, cinco tamaños de modelo desde Tiny (75 MB) hasta Large v3 Turbo (1,6 GB). Funciona en la CPU, con CUDA en tarjetas NVIDIA y con Vulkan en cualquier otra tarjeta gráfica. El motor de todas las ediciones.
25 idiomas europeos con detección automática, latencia muy baja, apto para streaming. Funciona en cualquier tarjeta gráfica DirectX 12 — AMD, Intel o NVIDIA. A partir de Business.
Gratis: el idioma de tu sistema con Whisper Base. A partir de Pro: los 99 idiomas de Whisper, libre elección de modelo, aceleración por GPU. A partir de Business: detección automática del idioma y Parakeet.
- Alemán
- Inglés
- Español
- Francés
- Italiano
- Portugués
- Neerlandés
- Polaco
- Checo
- Danés
- Sueco
- Noruego
- Finés
- Húngaro
- Rumano
- Griego
- Turco
- Ruso
- Ucraniano
- Árabe
- Hebreo
- Hindi
- Chino
- Japonés
- Coreano
- Vietnamita
- Tailandés
- Indonesio
… y 71 más. El idioma se fija por dictado o — a partir de Business — se detecta automáticamente.
Los modelos: se descargan una vez y después funcionan sin conexión
Los modelos se descargan una sola vez desde la propia aplicación y después quedan en tu perfil de usuario — sin permisos de administrador. Whisper Base es el predeterminado y se descarga al activar la entrada de voz; los demás los eliges en la configuración.
A partir de ahí el reconocimiento de voz no necesita ninguna conexión. Tren, avión, sótano, red corporativa aislada — el dictado sigue funcionando.
| Modelo | Descarga | Para qué |
|---|---|---|
| Whisper Tiny | 75 MB | Notas muy rápidas, la precisión más baja |
| Whisper Base (predeterminado) | 141 MB | Todoterreno sólido, funciona en cualquier PC sin tarjeta gráfica |
| Whisper Small | 466 MB | Buena precisión, todavía apto para CPU |
| Whisper Medium / Medium q5 | 1,5 GB / 539 MB | Alta precisión, GPU recomendada — q5 es la variante para equipos con 8 GB de RAM |
| Whisper Large v3 Turbo / Turbo q5 | 1,6 GB / 574 MB | La mejor precisión, GPU muy recomendada |
| Parakeet TDT 0.6B v3 | 2,5 GB | La latencia más baja, 25 idiomas detectados automáticamente — a partir de Business |
El runtime CUDA opcional para tarjetas NVIDIA (unos 70 MB) se descarga de downloads.menterium.net cuando lo eliges en la configuración. Sin él, Celerando usa Vulkan — no es un error, solo otro camino a la misma tarjeta gráfica.
¿Funcionará en tu equipo?
Tres niveles, del portátil de oficina a la estación de trabajo — y ninguno exige una tarjeta gráfica:
Windows 10 (compilación 19041) o Windows 11, 4 GB de RAM, cualquier CPU x86-64. Whisper Tiny y Base funcionan solo con la CPU — incluso en un portátil antiguo.
CPU con AVX2 (Intel desde 2013, AMD desde 2015), 8 GB de RAM, gráficos DirectX 12 de Intel, AMD o NVIDIA. Dictado diario con Small o Medium q5; Parakeet ya funciona aquí.
16 GB de RAM, tarjeta NVIDIA con 4 GB o más de memoria gráfica (CUDA) o una GPU moderna con 6 GB o más. Large v3 Turbo, dictados largos, Smart Modes.
La página Entrada de voz – requisitos tiene un autodiagnóstico: tres clics y sabes qué motor y qué modelo encajan con tu equipo.
«Menterium» no es una palabra. Para Celerando sí.
Todo reconocimiento de voz tropieza con lo mismo: nombres propios, nombres de empresa, nombres de producto y el vocabulario de tu profesión. Dictas tu propio apellido y recibes algo que solo suena parecido.
En el Diccionario personal introduces esas palabras una sola vez — junto con las variantes que el reconocimiento produce por error. A partir de ahí queda fijado.
Funciona en ambos sentidos: los términos se entregan al reconocimiento antes de la transcripción, y las grafías erróneas se corrigen después.
Incluido a partir de Pro.
Del dictado al texto final
Tras el reconocimiento, el texto pasa por tres etapas, todas locales, todas opcionales:
Los símbolos hablados se convierten en caracteres («euro» → €), las abreviaturas se expanden o acortan, tus propias sustituciones mediante expresiones regulares. A partir de Pro.
Un modelo de lenguaje local pone orden: fuera muletillas, dentro la puntuación, suavizar el tono o redactarlo como correo. Normalmente necesita una tarjeta gráfica DirectX 12 con memoria suficiente. A partir de Business.
El texto aparece mientras sigues hablando — fragmento a fragmento, directamente en el programa de destino. A partir de Business, al igual que pulsar para hablar; se activan por separado.
Tu voz no sale de tu equipo
Dictar en la nube significa que tu grabación se transfiere al servidor de otra empresa, se procesa allí y el texto vuelve.
Quien dicta conversaciones con clientes, datos de pacientes, expedientes de personal o borradores de contrato se mueve en el terreno del secreto profesional y el RGPD. Un servicio en la nube a menudo no puede autorizarse para eso.
Celerando procesa la grabación y el texto en tu PC. Lo único que contacta la aplicación: la descarga de cada modelo que elijas, la comprobación de actualizaciones, un único aviso de instalación en el primer arranque y —solo si lo eliges en la configuración— el runtime CUDA opcional. Contiene un identificador de instalación aleatorio, un hash abreviado de la huella del dispositivo y las versiones de la app y de Windows — sin cuenta, sin nombre, sin contenidos. El servidor no guarda la dirección IP en claro: un hash de ella se borra a las 48 horas, mientras que la ubicación aproximada derivada de ella (país, región, ciudad con radio de precisión) se conserva con el registro durante 24 meses. El audio y el texto nunca forman parte de ello. Cualquier monitor de red lo confirma.
El historial de transcripciones opcional (a partir de Pro) guarda texto y grabación únicamente en tu perfil de usuario — desactivado por defecto.
Celerando y el dictado por voz de Windows comparados
Windows incluye su propio dictado por voz con Win + H. La diferencia no está en si funciona — sino en dónde.
| Celerando | Dictado de Windows (Win + H) | Apps de dictado en la nube | |
|---|---|---|---|
| Dónde se reconoce | En tu PC | En servidores de Microsoft (reconocimiento de voz en línea) | En los servidores del proveedor |
| Internet necesario | Nunca al dictar; solo descargas, actualizaciones y el aviso inicial | En cada dictado | En cada dictado |
| Motor | Whisper o Parakeet, modelo a elegir a partir de Pro | Microsoft, no seleccionable | Propietario |
| Idiomas | 99 (Whisper, desde Pro), 25 con autodetección (Parakeet, desde Business) | Según el paquete de idioma instalado | Según el servicio |
| Tus propios términos | Diccionario personal, reglas, Smart Modes | — | Según el servicio |
| Precio | Gratis (idioma del sistema), Pro 29,99 € una sola vez | Incluido en Windows | Normalmente 7–15 € al mes |
A fecha de septiembre de 2026. El dictado de Windows está perfectamente bien para notas ocasionales — la única pregunta es si tu dictado puede ir a un servidor ajeno.
Cuando escribir no es una opción
Tenosinovitis, lesiones por esfuerzo repetitivo, tendinitis. Dictar deja de ser una comodidad y pasa a ser la condición para seguir trabajando.
Hablar casi siempre resulta más fácil que escribir.
Correos, actas, documentación, notas.
Paga una vez. No cada mes.
Herramientas de dictado comparables cuestan entre 7 y 15 € al mes. Al cabo de un año superas los 100 €, y la factura no se detiene.
Celerando Pro cuesta 29,99 € una sola vez. Las actualizaciones dentro de la versión están incluidas.
Preguntas frecuentes sobre el dictado sin conexión
¿El dictado funciona sin internet?
Sí, por completo. El modelo de voz se descarga una vez desde la propia aplicación — Whisper Base, con 141 MB, es el predeterminado; el mayor modelo Whisper ocupa 1,6 GB y Parakeet 2,5 GB — y después queda en tu perfil de usuario. El reconocimiento en sí no abre ninguna conexión; puedes probarlo en modo avión.
¿Qué idiomas reconoce?
Con Whisper, 99 idiomas — entre ellos alemán, inglés, español, francés, italiano, portugués, neerlandés, polaco, turco, ruso, ucraniano, árabe, chino, japonés y coreano. El idioma de tu sistema es gratis; los 99, a partir de Pro. A partir de Business, Celerando detecta el idioma automáticamente y Parakeet añade 25 idiomas europeos con latencia muy baja.
Whisper o Parakeet — ¿qué motor debo usar?
Whisper es el predeterminado: más idiomas, la mayor variedad de modelos, acelerado con CUDA en tarjetas NVIDIA. Parakeet compensa si tienes una tarjeta gráfica AMD o Intel o quieres el menor retardo — 25 idiomas europeos con detección automática, apto para streaming. Parakeet está incluido a partir de Business.
¿Cuánto ocupa la descarga y dónde se guardan los modelos?
Whisper va de 75 MB (Tiny) a 1,6 GB (Large v3 Turbo), Parakeet ocupa 2,5 GB y el runtime CUDA opcional añade unos 70 MB. Los modelos vienen directamente de Hugging Face y se guardan en tu perfil de usuario de Windows, en %LOCALAPPDATA%\Menterium\Celerando — sin permisos de administrador, y se pueden borrar desde la aplicación.
¿Necesito una tarjeta gráfica?
No. Whisper Tiny, Base y Small funcionan en la CPU, incluso en un PC de oficina antiguo. Una tarjeta gráfica hace prácticos los modelos grandes: NVIDIA mediante CUDA, todas las demás mediante Vulkan; Parakeet usa cualquier tarjeta DirectX 12. La aceleración por GPU está incluida a partir de Pro. Si eliges CUDA sin el runtime instalado, Celerando recurre a Vulkan — sin error, sin interrupción.
¿Se guarda mi voz en algún sitio?
Fuera de tu equipo, no. El historial de transcripciones opcional (a partir de Pro) guarda texto y grabación en tu perfil de usuario para que un dictado no se pierda si cae en la ventana equivocada — está desactivado por defecto y se puede vaciar en cualquier momento.
¿En qué programas funciona el dictado?
En todos los que admiten entrada de texto — Outlook, Word, navegadores, Teams, Slack, editores, formularios. Celerando inserta el texto por defecto mediante el portapapeles y Ctrl+V; para escritorio remoto y terminales hay un modo que escribe carácter a carácter.
¿Cuánto puede durar una grabación?
En la versión gratuita, 30 segundos por grabación. A partir de Pro, sin límite.
¿El texto aparece mientras hablo?
Eso es el modo streaming, incluido a partir de Business — el texto aparece fragmento a fragmento mientras hablas. En Free y Pro el texto se inserta en cuanto detienes la grabación.
¿Qué son los Smart Modes?
Un modelo de lenguaje local que retoca el texto reconocido — quitar muletillas, poner puntuación, suavizar el tono, redactarlo como correo. Los modelos (como Llama 3.2 3B o Mistral 7B) funcionan mediante DirectML en una tarjeta gráfica DirectX 12 con memoria suficiente; para equipos sin ella hay un modelo pequeño para CPU que basta para puntuación y un ligero pulido. A partir de Business.
¿Sirve para despachos, consultas y empresas sujetas a secreto profesional?
El punto de partida es distinto al de un servicio en la nube: no hay ningún tercero que procese la grabación o el texto y, por tanto, ningún encargado del tratamiento al que haya que vincular por contrato. Si eso basta en tu caso lo decide vuestra revisión de protección de datos — esta página aporta los datos técnicos para ello.
¿Necesito permisos de administrador?
No. Celerando se instala en tu perfil de usuario, y los modelos también.