로컬 모델

명확한 처리 범위를 갖춘 로컬 전사·요약 모델

HushMemo는 음성 인식 모델과 요약 모델을 구분합니다. 전사 모델은 오디오를 텍스트로 바꾸고, 요약 모델은 검토한 녹취록을 메모, TODO, 이메일, 템플릿으로 구성합니다.

전사

음성 인식 모델

저장 공간, 속도, 정확성을 기준으로 전사 모델을 선택하세요. 작은 모델이 더 빠릅니다. 더 큰 모델은 더 나은 결과로 더 복잡한 녹음을 처리할 수 있습니다.

가장 빠른 전사

Whisper Tiny

빠른 초안 및 짧은 음성 메모를 위한 소규모 음성-텍스트 모델.

사이즈~75 MB
언어다국어
속도가장 빠름
다운로드수동

최적의 용도:빠른 생각, 짧은 알림, 초안 및 저장 공간이 제한된 기기.

빠르고 간결하지만 소음, 악센트, 긴 회의 또는 도메인 어휘로 인해 정확도가 떨어집니다.

균형 잡힌 전사

Whisper Base

일상적인 녹음을 위한 균형 잡힌 로컬 전사 모델입니다.

사이즈~142 MB
언어다국어
속도빠름
다운로드자동

최적의 용도:속도가 여전히 중요한 회의, 통화, 강의, 인터뷰, 음성 메모.

다운로드 후 사용하기 좋은 기본 선택입니다. 중요한 녹취록은 요약하거나 공유하기 전에 반드시 검토하세요.

정확도 향상

Whisper Small

더 길고 복잡한 오디오를 위한 정확도가 높은 로컬 전사 모델입니다.

사이즈~466 MB
언어다국어
속도느리게
다운로드수동

최적의 용도:더 자세한 내용을 담은 장기간의 회의, 강의, 인터뷰, 혼합 연사 및 녹음.

저장 및 처리 시간이 더 많이 사용됩니다. 긴 녹음에는 여전히 섹션별 검토가 필요할 수 있습니다.

요약

요약 및 템플릿 모델

전사 후 로컬 요약 모델은 검토된 텍스트를 회의 메모, 작업, 이메일 및 학습 메모와 같은 구조화된 출력으로 구성합니다.

기본값 권장

Gemma 3 1B

일상적인 메모를 위한 균형 잡힌 로컬 요약 모델입니다.

사이즈529 MB
컨텍스트2,048 tokens
런타임GPU 선호
다운로드자동

최적의 용도:회의, 빠른 요약, TODO 추출 및 단기 및 중간 녹취록.

다운로드 후 로컬로 실행됩니다. 긴 녹음에는 더 짧은 요약이나 분할된 검토가 필요할 수 있습니다.

중국어에 적합

Qwen 2.5 1.5B

더 큰 컨텍스트 창을 갖춘 고품질 중국어 요약.

사이즈1.49 GB
컨텍스트4,096 tokens
런타임CPU 선호
다운로드수동

최적의 용도:중국어 회의, 상담 메모, 구조가 복잡한 템플릿에 적합합니다.

선택적 수동 다운로드. 파일 크기가 클수록 저장 공간이 늘어나고 처리 시간이 길어집니다.

고품질

Gemma 4 E2B

더 긴 컨텍스트와 복잡한 템플릿을 위한 고품질 모델을 선택하세요.

사이즈2.41 GB
컨텍스트8,192 tokens
런타임GPU 선호
다운로드수동

최적의 용도:더 긴 녹취록, 더 심층적인 음성 분석 및 다중 섹션 템플릿.

선택적 수동 다운로드. 속도가 느려질 수 있으므로 여유 저장 공간과 RAM이 충분한 기기에서 사용해야 합니다.