Modelos locales

Modelos locales de transcripción y resumen, con límites claros.

HushMemo separa los modelos de voz a texto de los modelos de resumen. Los modelos de transcripción convierten el audio en texto; los modelos de resumen convierten las transcripciones revisadas en notas, TODOs, correos electrónicos y plantillas.

Transcripción

Modelos de voz a texto

Elija un modelo de transcripción basado en el almacenamiento, la velocidad y la precisión. Los modelos más pequeños son más rápidos; Los modelos más grandes pueden manejar grabaciones más complejas con mejores resultados.

Transcripción más rápida

Whisper Tiny

Modelo pequeño de voz a texto para borradores rápidos y notas de voz cortas.

Tamaño~75 MB
IdiomasPlurilingüe
VelocidadLa más rápida
DescargarManual

Lo mejor para:Pensamientos rápidos, recordatorios breves, borradores y dispositivos con almacenamiento limitado.

Rápido y compacto, pero menos preciso con ruido, acentos, reuniones largas o vocabulario de dominio.

Transcripción equilibrada

Whisper Base

Modelo de transcripción local equilibrado para grabaciones cotidianas.

Tamaño~142 MB
IdiomasPlurilingüe
VelocidadRápido
DescargarAutomático

Lo mejor para:Reuniones, llamadas, conferencias, entrevistas y notas de voz donde la velocidad sigue siendo importante.

Un valor predeterminado práctico después de la descarga. Las transcripciones importantes aún deben revisarse antes de resumirlas o compartirlas.

Mayor precisión

Whisper Small

Modelo de transcripción local de mayor precisión para un audio más largo y desordenado.

Tamaño~466 MB
IdiomasPlurilingüe
VelocidadMás lento
DescargarManual

Lo mejor para:Reuniones más largas, conferencias, entrevistas, oradores mixtos y grabaciones con más detalle.

Utiliza más tiempo de almacenamiento y procesamiento. Es posible que las grabaciones largas aún necesiten una revisión sección por sección.

Resúmenes

Modelos de resumen y plantilla.

Después de la transcripción, los modelos de resumen locales organizan el texto revisado en resultados estructurados, como notas de reuniones, tareas, correos electrónicos y notas de estudio.

Recomendado

Gemma 3 1B

Modelo de resumen local equilibrado para notas cotidianas.

Tamaño529 MB
Contexto2,048 tokens
Tiempo de ejecuciónGPU preferido
DescargarAutomático

Lo mejor para:Reuniones, resúmenes rápidos, extracción de TODO y transcripciones de corta a media.

Se ejecuta localmente después de la descarga. Las grabaciones largas pueden necesitar resúmenes más breves o revisiones fragmentadas.

Preferido para chino

Qwen 2.5 1.5B

Resúmenes en chino de mayor calidad con una ventana de contexto más grande.

Tamaño1.49 GB
Contexto4,096 tokens
Tiempo de ejecuciónCPU preferido
DescargarManual

Lo mejor para:Reuniones chinas, notas de consulta y plantillas con más estructura.

Descarga manual opcional. Un tamaño de archivo más grande significa más almacenamiento y mayor tiempo de procesamiento.

Alta calidad

Gemma 4 E2B

Opte por el modelo de alta calidad para contextos más extensos y plantillas complejas.

Tamaño2.41 GB
Contexto8,192 tokens
Tiempo de ejecuciónGPU preferido
DescargarManual

Lo mejor para:Transcripciones más largas, análisis de voz más profundos y plantillas de varias secciones.

Descarga manual opcional. Puede ser más lento y debe usarse en dispositivos con suficiente almacenamiento libre y RAM.