roar-jar90 downloadsCapture, transcribe, summarize, and archive voice meeting notes with local or cloud AI providers.
Obsidian 우측 사이드바에서 음성 녹음, 실시간 전사, 템플릿 기반 요약, 원문 보관을 처리하는 플러그인입니다.
현재 macOS에서 가장 많이 검증됐고, Windows는 auto / windows-speech / openai 구조와 fallback 경로까지 반영돼 있지만 아직 실제 Windows 장비에서 최종 검증되지는 않았습니다.



녹음 시작, 일시정지, 녹음 종료auto / macOS Local Speech / Windows Speech / OpenAI STT 경로 지원manifest.json: Obsidian 플러그인 메타데이터main.js: 플러그인 로직styles.css: 우측 사이드바 UI 스타일versions.json: 버전 정보scripts/: macOS STT 보조 스크립트.obsidian/plugins/voice-summary-workflow/ 아래로 복사합니다.Reload app without saving를 실행합니다.설정 > Community plugins에서 Voice Workflow를 활성화합니다.설정 > Voice Workflow 설정 > 시작 시 사이드바 자동 열기를 켭니다.플러그인 설정에서 아래 항목을 확인합니다.
STT ProviderAuto: macOS는 로컬 Speech, Windows는 Speech 누적본, 그 외는 OpenAI STTmacOS Local Speech: macOS 로컬 전사Windows Speech: Windows 실시간 전사 누적본 + OpenAI fallbackOpenAI Compatible: OpenAI 호환 STT APISource LanguageTranslate To KoreanAI ProviderOpenAIOllamaClaudeGemini권장 조합:
macOS Local SpeechGemini 또는 Claude 또는 OpenAIOllamaOllama 예시:
ollama pull qwen3AI Provider를 Ollama Local로 선택합니다.Ollama Base URL은 기본값 http://localhost:11434를 사용합니다.Ollama Model에 받은 모델 이름을 입력합니다. 예: qwen3참고: Ollama는 요약/번역 LLM Provider입니다. 음성 전사는 macOS Local Speech, Windows Speech, OpenAI Compatible STT 중 하나를 사용합니다.
Windows 권장 조합:
Auto 또는 Windows SpeechGemini 또는 Claude 또는 OpenAIVoice Workflow 패널을 엽니다.참여자 녹음/전사 동의 확인을 체크합니다.음성인식 탭에서 녹음을 시작합니다.녹음 종료를 누르면 최종 전사가 정리됩니다.요약 탭에서 템플릿을 선택하거나 요청사항을 직접 입력합니다.현재 노트, 기존 노트, 신규 노트 중 선택합니다.현재 전사 요약 저장을 누르면:원문 전사 및 저장 내역 섹션 아래에 오디오와 원문 전사가 보관됩니다.요청사항 입력으로 직접 요약 형식을 지정할 수 있습니다.요약 노트는 대략 아래 구조로 저장됩니다.
---
type: voice-meeting-note
meeting_title: "3월 21일 회의 정리"
meeting_date: 2026-03-21
meeting_source: manual
participants: ["홍길동", "김철수"]
agenda: "출시 일정과 담당자 확정"
recording_started_at: 2026-03-21T01:33:00.000Z
recording_ended_at: 2026-03-21T01:43:00.000Z
duration_seconds: 600
consent_confirmed: true
consent_method: "manual"
stt_provider: "macOS Local Speech"
stt_model: "macOS Speech.framework"
ai_provider: "Ollama Local"
summary_model: "qwen3"
agent_instruction: "meeting"
audio_file: "Voice Workflow/Audio/20260321-103346 회의 정리.wav"
transcript_language: "Korean"
transcript_chars: 1234
강의명: ""
교수님: ""
날짜:
주요주제내용: ""
tags:
- lecture
---
# 📝 강의 내용
...
## 원문 전사 및 저장 내역
### 2026-03-21 10:33:46 기록
- 생성 시각: 2026-03-21 10:33:46
- 주제: 로컬 인터프리테이션과 암 예측
- 언어: Korean
**음성 파일**
![[Voice Workflow/Audio/20260321-103346 무제 1.wav]]
경로: [[Voice Workflow/Audio/20260321-103346 무제 1.wav]]
**원문 전사**
이 사람이 병력 이런 정보들이 있고...
Speech.framework 기반 전사를 사용합니다.Speech Recognition 권한 허용이 필요할 수 있습니다.Auto를 선택하면 Windows에서는 Windows Speech 경로를 우선 사용합니다.SpeechRecognition 누적본을 사용합니다.녹음 시작을 누른 뒤에만 마이크 오디오를 녹음합니다.Voice Workflow/Audio 폴더에 WAV 파일로 저장됩니다.macOS Local Speech와 Windows Speech 경로는 가능한 로컬/시스템 전사를 우선 사용합니다.OpenAI Compatible API STT를 선택하면 녹음 오디오가 설정한 OpenAI 호환 STT 서버로 전송됩니다.http://localhost:11434)은 로컬 서버 호출이며 별도 API Key가 필요하지 않습니다.scripts/macos-transcribe.js를 osascript로 실행합니다.node --check main.jsgit diff --checkmanifest.json의 버전과 정확히 같아야 합니다. 예: 0.4.0main.js, manifest.json, styles.css를 개별 파일로 첨부해야 합니다.community-plugins.json 제출 entry의 id, name, author, description은 manifest.json과 일치해야 합니다.manifest.json의 isDesktopOnly가 true로 설정되어 있습니다.MIT License. 자세한 내용은 LICENSE 파일을 확인하세요.