whisper-windows-mcp 2.2.0 → 2.2.2
This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
- package/LICENSE +20 -1
- package/LICENSE-COMMERCIAL.md +58 -0
- package/PRIVACY.es.md +135 -0
- package/PRIVACY.id.md +135 -0
- package/PRIVACY.ja.md +135 -0
- package/PRIVACY.ko.md +135 -0
- package/PRIVACY.md +135 -0
- package/PRIVACY.pl.md +135 -0
- package/PRIVACY.pt-BR.md +135 -0
- package/PRIVACY.ro.md +135 -0
- package/PRIVACY.uk.md +135 -0
- package/PRIVACY.vi.md +135 -0
- package/README.es.md +393 -0
- package/README.id.md +393 -0
- package/README.ja.md +402 -397
- package/README.ko.md +393 -0
- package/README.md +393 -388
- package/README.pl.md +393 -0
- package/README.pt-BR.md +393 -0
- package/README.ro.md +393 -0
- package/README.uk.md +393 -0
- package/README.vi.md +393 -0
- package/ROADMAP.es.md +200 -0
- package/ROADMAP.id.md +289 -0
- package/ROADMAP.ja.md +301 -268
- package/ROADMAP.ko.md +286 -0
- package/ROADMAP.pl.md +198 -0
- package/ROADMAP.pt-BR.md +286 -0
- package/ROADMAP.ro.md +200 -0
- package/ROADMAP.uk.md +290 -0
- package/ROADMAP.vi.md +286 -0
- package/SECURITY.es.md +47 -0
- package/SECURITY.id.md +47 -0
- package/SECURITY.ja.md +47 -0
- package/SECURITY.ko.md +47 -0
- package/SECURITY.md +14 -2
- package/SECURITY.pl.md +47 -0
- package/SECURITY.pt-BR.md +47 -0
- package/SECURITY.ro.md +47 -0
- package/SECURITY.uk.md +47 -0
- package/SECURITY.vi.md +47 -0
- package/TROUBLESHOOTING.es.md +323 -0
- package/TROUBLESHOOTING.id.md +323 -0
- package/TROUBLESHOOTING.ko.md +323 -0
- package/TROUBLESHOOTING.pl.md +323 -0
- package/TROUBLESHOOTING.pt-BR.md +323 -0
- package/TROUBLESHOOTING.ro.md +323 -0
- package/TROUBLESHOOTING.uk.md +323 -0
- package/TROUBLESHOOTING.vi.md +323 -0
- package/glama.json +6 -0
- package/package.json +10 -3
- package/patch_roadmaps.py +72 -0
|
@@ -0,0 +1,323 @@
|
|
|
1
|
+
# whisper-windows-mcp — 문제 해결
|
|
2
|
+
|
|
3
|
+
---
|
|
4
|
+
|
|
5
|
+
## 빠른 체크리스트
|
|
6
|
+
|
|
7
|
+
더 자세히 살펴보기 전에 다음을 모두 확인하세요:
|
|
8
|
+
|
|
9
|
+
- `claude_desktop_config.json`의 경로에 **백슬래시 두 개** 사용 (`C:\\whisper\\...`)
|
|
10
|
+
- `WHISPER_CLI_PATH`에 지정된 경로에 `whisper-cli.exe`가 존재
|
|
11
|
+
- `WHISPER_MODEL`에 지정된 경로에 모델 `.bin` 파일이 존재
|
|
12
|
+
- FFmpeg가 설치되어 접근 가능 (명령 프롬프트에서 `ffmpeg -version` 작동)
|
|
13
|
+
- 설정 편집 후 Claude Desktop을 **완전히 재시작** (창만 닫지 말고 시스템 트레이에서 종료)
|
|
14
|
+
- 설정 → 개발자에서 whisper 서버가 **실행 중** (초록색 배지)으로 표시
|
|
15
|
+
|
|
16
|
+
---
|
|
17
|
+
|
|
18
|
+
## "whisper에 연결되지 않음" 또는 도구를 사용할 수 없음
|
|
19
|
+
|
|
20
|
+
**가장 흔한 원인:** 설정 편집 후 Claude Desktop을 완전히 재시작하지 않은 경우.
|
|
21
|
+
|
|
22
|
+
1. 시스템 트레이의 Claude 아이콘 우클릭 → 종료
|
|
23
|
+
2. Claude Desktop 재실행
|
|
24
|
+
3. 설정 → 개발자로 이동하여 whisper 옆의 초록색 **실행 중** 배지 확인
|
|
25
|
+
|
|
26
|
+
여전히 표시되지 않는 경우:
|
|
27
|
+
|
|
28
|
+
1. `claude_desktop_config.json`에서 JSON 구문 오류 확인 (쉼표 누락, 중괄호 불일치 등)
|
|
29
|
+
2. 모든 경로에 백슬래시가 두 개 사용되었는지 확인
|
|
30
|
+
3. Claude Desktop에서 `check_config`를 실행하여 진단 정보 확인
|
|
31
|
+
|
|
32
|
+
---
|
|
33
|
+
|
|
34
|
+
## 큰 모델에서 download_model 타임아웃
|
|
35
|
+
|
|
36
|
+
Claude Desktop은 MCP 도구 호출에 4분의 타임아웃을 설정합니다. 느린 연결에서 대형 모델 다운로드가 이를 초과할 수 있습니다.
|
|
37
|
+
|
|
38
|
+
**파일 크기:**
|
|
39
|
+
- `large-v3` — 2.9 GB
|
|
40
|
+
- `large-v3-turbo` — 1.6 GB
|
|
41
|
+
- `large-v3-q5_0` — 1.1 GB
|
|
42
|
+
- `large-v3-turbo-q5_0` — 547 MB
|
|
43
|
+
- `medium.en` — 1.5 GB
|
|
44
|
+
- `medium.en-q5_0` — 514 MB
|
|
45
|
+
|
|
46
|
+
빠른 연결(100 Mbps 이상)에서는 large-v3도 4분 이내에 다운로드됩니다. 느린 연결에서는 브라우저나 PowerShell을 사용하여 직접 다운로드하고 파일을 모델 디렉터리에 수동으로 배치하세요:
|
|
47
|
+
|
|
48
|
+
```powershell
|
|
49
|
+
# 예시 — large-v3-turbo 직접 다운로드
|
|
50
|
+
Invoke-WebRequest -Uri "https://huggingface.co/ggerganov/whisper.cpp/resolve/main/ggml-large-v3-turbo.bin" `
|
|
51
|
+
-OutFile "C:\whisper\models\ggml-large-v3-turbo.bin"
|
|
52
|
+
```
|
|
53
|
+
|
|
54
|
+
그 다음 `switch_model ggml-large-v3-turbo.bin`으로 활성화하세요.
|
|
55
|
+
|
|
56
|
+
---
|
|
57
|
+
|
|
58
|
+
## `check_config`에서 whisper-cli.exe를 찾지 못함
|
|
59
|
+
|
|
60
|
+
설정의 경로가 파일이 실제로 있는 위치와 일치하지 않습니다.
|
|
61
|
+
|
|
62
|
+
파일 존재 확인:
|
|
63
|
+
```
|
|
64
|
+
dir C:\whisper\Release\whisper-cli.exe
|
|
65
|
+
```
|
|
66
|
+
|
|
67
|
+
다른 위치에 있다면 설정의 `WHISPER_CLI_PATH`를 실제 경로로 업데이트하세요.
|
|
68
|
+
|
|
69
|
+
---
|
|
70
|
+
|
|
71
|
+
## `check_config`에서 FFmpeg를 찾지 못함
|
|
72
|
+
|
|
73
|
+
FFmpeg가 설치되지 않았거나 시스템 PATH에 없습니다.
|
|
74
|
+
|
|
75
|
+
winget으로 설치:
|
|
76
|
+
```
|
|
77
|
+
winget install ffmpeg
|
|
78
|
+
```
|
|
79
|
+
|
|
80
|
+
또는 [ffmpeg.org](https://ffmpeg.org/download.html)에서 다운로드하여 압축을 풀고 `bin` 폴더를 시스템 PATH에 추가하세요.
|
|
81
|
+
|
|
82
|
+
설치 후 새 명령 프롬프트에서 확인:
|
|
83
|
+
```
|
|
84
|
+
ffmpeg -version
|
|
85
|
+
```
|
|
86
|
+
|
|
87
|
+
FFmpeg를 비표준 위치에 설치한 경우 Claude Desktop 설정에서 `FFMPEG_PATH` 환경 변수를 설정하세요:
|
|
88
|
+
```json
|
|
89
|
+
"env": {
|
|
90
|
+
"FFMPEG_PATH": "C:\\ffmpeg\\bin\\ffmpeg.exe"
|
|
91
|
+
}
|
|
92
|
+
```
|
|
93
|
+
|
|
94
|
+
---
|
|
95
|
+
|
|
96
|
+
## 전사 출력이 `[FOREIGN]` 태그로 가득 찬 경우
|
|
97
|
+
|
|
98
|
+
**원인:** 영어 전용 모델(예: `ggml-medium.en.bin`)을 비영어 음성에 사용하고 있습니다. 영어 전용 모델은 다른 언어를 처리할 수 없으며 처리할 수 없는 모든 세그먼트에 `[FOREIGN]`을 출력합니다.
|
|
99
|
+
|
|
100
|
+
**해결 방법:** `ggml-large-v3.bin` — 다국어 모델을 다운로드하여 사용하세요. 비영어 전사, 자동 언어 감지, 번역에는 이 모델이 필요합니다.
|
|
101
|
+
|
|
102
|
+
```
|
|
103
|
+
https://huggingface.co/ggerganov/whisper.cpp/resolve/main/ggml-large-v3.bin
|
|
104
|
+
```
|
|
105
|
+
|
|
106
|
+
`C:\whisper\models\`에 저장하고 설정 업데이트:
|
|
107
|
+
```json
|
|
108
|
+
"WHISPER_MODEL": "C:\\whisper\\models\\ggml-large-v3.bin"
|
|
109
|
+
```
|
|
110
|
+
|
|
111
|
+
또는 `transcribe_audio`나 `generate_subtitles`의 `model` 파라미터를 사용하여 전사별로 재정의하세요.
|
|
112
|
+
|
|
113
|
+
> **참고:** 영어 전용 모델(`*.en.bin`)은 영어 콘텐츠에 더 빠르고 정확하지만 다른 언어는 전혀 처리할 수 없습니다. 다국어 콘텐츠를 작업하는 경우 하드웨어에 관계없이 `large-v3`이 올바른 모델입니다.
|
|
114
|
+
|
|
115
|
+
---
|
|
116
|
+
|
|
117
|
+
## 전사 결과가 없거나 빈 파일인 경우
|
|
118
|
+
|
|
119
|
+
**가능한 원인:**
|
|
120
|
+
|
|
121
|
+
1. **언어에 맞지 않는 모델** — 영어 전용 모델(`*.en.bin`)은 다른 언어를 전사할 수 없습니다. 다국어 콘텐츠에는 `ggml-large-v3.bin`을 사용하세요.
|
|
122
|
+
|
|
123
|
+
2. **음질이 너무 낮음** — 매우 낮은 비트레이트 파일(예: AMR-NB 코덱을 사용하는 오래된 `.3gp` 휴대폰 녹음, 약 12kbps)은 whisper가 처리하기 어려울 수 있습니다. 잡음이 많은 환경(배경 소음, 울림, 먼 거리 화자)도 어렵습니다. 작은 모델보다 열화된 음성을 더 잘 처리하는 `large-v3`를 시도해 보세요.
|
|
124
|
+
|
|
125
|
+
3. **파일이 무음이거나 손상된 경우** — 파일에서 `analyze_media`를 실행하여 FFprobe가 유효한 오디오 스트림을 감지하는지 확인하세요.
|
|
126
|
+
|
|
127
|
+
4. **변환 실패** — 파일이 WAV로 올바르게 변환되지 않을 수 있습니다. 먼저 수동으로 변환해 보세요:
|
|
128
|
+
```
|
|
129
|
+
ffmpeg -i yourfile.3gp -ar 16000 -ac 1 output.wav
|
|
130
|
+
```
|
|
131
|
+
그런 다음 WAV를 직접 전사하세요.
|
|
132
|
+
|
|
133
|
+
---
|
|
134
|
+
|
|
135
|
+
## 파일명에 특수 문자나 Unicode가 있을 때 백그라운드 작업 실패
|
|
136
|
+
|
|
137
|
+
**원인:** 경로에 Unicode 문자(한국어, 일본어, 중국어, 이모지, 괄호 등) 또는 특정 특수 문자가 포함되어 있으면 whisper-cli.exe가 출력 파일을 쓸 수 없습니다.
|
|
138
|
+
|
|
139
|
+
**현재 해결 방법:** 전사 전에 파일 이름을 ASCII 문자만 사용하도록 바꾸세요. 필요하다면 이후에 다시 바꾸면 됩니다.
|
|
140
|
+
|
|
141
|
+
```
|
|
142
|
+
ren "한국어_파일명.mp4" "temp_transcribe.mp4"
|
|
143
|
+
```
|
|
144
|
+
|
|
145
|
+
**상태:** 알려진 버그입니다. 출력을 정제된 임시 경로를 통해 라우팅하고 완료 후 올바른 목적지로 이동하는 수정이 계획되어 있습니다.
|
|
146
|
+
|
|
147
|
+
---
|
|
148
|
+
|
|
149
|
+
## 백그라운드 작업이 "실패"로 표시되고 출력이 없는 경우
|
|
150
|
+
|
|
151
|
+
**가능한 원인:**
|
|
152
|
+
|
|
153
|
+
1. **Unicode 파일명** — 위 참고.
|
|
154
|
+
|
|
155
|
+
2. **모델 경로 잘못됨** — 분리된 프로세스는 수정된 경로를 상속하지 않습니다. `check_config`를 실행하여 경로를 확인하세요.
|
|
156
|
+
|
|
157
|
+
3. **프로세스가 종료된 경우** — whisper-cli.exe가 작업 중 수동으로 종료되면 출력 파일이 존재하지 않습니다. 다시 시도하세요.
|
|
158
|
+
|
|
159
|
+
4. **VRAM 부족** — VRAM이 적은 GPU에서 대형 모델이 조용히 실패할 수 있습니다. 더 작은 모델을 사용해 보세요.
|
|
160
|
+
|
|
161
|
+
5. **파일 변환 실패** — WAV 파일을 직접 전사하여 문제가 변환에 있는지 전사에 있는지 확인해 보세요.
|
|
162
|
+
|
|
163
|
+
---
|
|
164
|
+
|
|
165
|
+
## 백그라운드 전사에서 SRT 출력이 생성되지 않음
|
|
166
|
+
|
|
167
|
+
**원인:** 백그라운드 모드(`transcribe_audio`의 `background=true`)는 현재 `.txt` 출력만 생성합니다. 백그라운드 모드의 SRT 포맷은 아직 구현되지 않았습니다.
|
|
168
|
+
|
|
169
|
+
**해결 방법:** 약 4분 미만의 파일에는 블로킹 모드로 `generate_subtitles`를 사용하세요. 더 긴 파일의 경우 먼저 백그라운드 모드로 `.txt`를 전사한 다음 SRT가 필요하면 같은 파일에서 `generate_subtitles`를 실행하세요 (다시 전사됩니다).
|
|
170
|
+
|
|
171
|
+
**상태:** 백그라운드 모드의 SRT 지원은 향후 릴리스에서 계획되어 있습니다.
|
|
172
|
+
|
|
173
|
+
---
|
|
174
|
+
|
|
175
|
+
## GPU가 사용되지 않음 (CPU가 50% 이상으로 높게 사용됨)
|
|
176
|
+
|
|
177
|
+
**원인:** 표준 whisper.cpp 릴리스에 포함된 CPU 전용 바이너리를 사용하고 있습니다.
|
|
178
|
+
|
|
179
|
+
**해결 방법:** [릴리스 페이지](https://github.com/eviscerations/whisper-windows-mcp/releases/tag/v1.4.0)에서 Vulkan 활성화된 빌드를 다운로드하여 `C:\whisper\Release\`에 압축을 해제하세요.
|
|
180
|
+
|
|
181
|
+
GPU 가속이 활성화되었는지 확인:
|
|
182
|
+
- Claude에게 `check_system` 요청
|
|
183
|
+
- 출력에서 `✅ Vulkan binary: ggml-vulkan.dll found` 확인
|
|
184
|
+
- 전사 중 작업 관리자 → 성능 → GPU에서 GPU 사용률이 15–30%로 올라가는지 확인
|
|
185
|
+
|
|
186
|
+
---
|
|
187
|
+
|
|
188
|
+
## `check_system`에서 VRAM 양이 잘못 표시됨
|
|
189
|
+
|
|
190
|
+
알려진 Windows 제한 사항입니다. `wmic` 명령은 레지스트리에서 VRAM을 읽는데, 많은 AMD 카드에서 실제 VRAM의 절반 값이 표시됩니다. 8GB HBM2를 가진 Vega 56은 일반적으로 4GB로 표시됩니다. 이것은 표시 문제일 뿐입니다 — whisper는 추론 중 실제 물리적 VRAM을 완전히 사용합니다.
|
|
191
|
+
|
|
192
|
+
---
|
|
193
|
+
|
|
194
|
+
## "전사가 이미 진행 중" 오류
|
|
195
|
+
|
|
196
|
+
이전 작업의 `whisper-cli.exe` 프로세스가 실행 중입니다. 완료를 기다리거나:
|
|
197
|
+
|
|
198
|
+
1. 작업 관리자 → 세부 정보 탭 열기
|
|
199
|
+
2. `whisper-cli.exe` 찾기
|
|
200
|
+
3. 우클릭 → 작업 끝내기
|
|
201
|
+
|
|
202
|
+
그 다음 다시 시도하세요.
|
|
203
|
+
|
|
204
|
+
---
|
|
205
|
+
|
|
206
|
+
## 자동 언어 감지가 틀린 경우
|
|
207
|
+
|
|
208
|
+
Whisper의 자동 감지는 음성의 처음 30초에서 실행됩니다. 파일 시작 부분이 대부분의 내용과 다른 언어로 되어 있으면 감지가 틀릴 수 있습니다.
|
|
209
|
+
|
|
210
|
+
**해결 방법:** 자동 감지에 의존하지 말고 언어를 명시적으로 지정하세요 (예: `language=ko`).
|
|
211
|
+
|
|
212
|
+
---
|
|
213
|
+
|
|
214
|
+
## 자막 생성이 전체적으로 "(외국어로 말하는 중)"이 되는 경우
|
|
215
|
+
|
|
216
|
+
Whisper가 음성을 감지했지만 전사할 수 없습니다. 가장 흔한 원인:
|
|
217
|
+
|
|
218
|
+
1. **잘못된 모델** — 비영어 음성에 영어 전용 모델 사용 중. `large-v3`를 사용하세요.
|
|
219
|
+
|
|
220
|
+
2. **음질** — 잡음이 많은 환경(주방, 군중, 울림)은 medium 모델에서 어려울 수 있습니다. `large-v3`를 시도해 보세요.
|
|
221
|
+
|
|
222
|
+
3. **혼합 언어** — 두 언어가 교대로 사용되는 파일은 단일 언어 설정에서 소수 언어가 자리 표시자로 표시됩니다.
|
|
223
|
+
|
|
224
|
+
---
|
|
225
|
+
|
|
226
|
+
## 자막 번역이 영어로만 출력되는 경우
|
|
227
|
+
|
|
228
|
+
이것은 의도된 동작입니다. Whisper의 내장 `--translate` 플래그는 **영어로만** 번역합니다. 다른 대상 언어로의 번역은 `.srt` 파일 내용을 별도로 처리하세요.
|
|
229
|
+
|
|
230
|
+
---
|
|
231
|
+
|
|
232
|
+
## 배치 전사가 진행을 멈춘 경우
|
|
233
|
+
|
|
234
|
+
`check_batch_progress`를 다시 호출하세요. 여전히 멈춰 있다면:
|
|
235
|
+
|
|
236
|
+
1. 작업 관리자에서 실행 중인 `whisper-cli.exe` 프로세스 확인
|
|
237
|
+
2. `%TEMP%\whisper-mcp-jobs\`에서 작업 로그 확인
|
|
238
|
+
3. 실패한 파일은 배치 보고서에 표시됩니다 — `transcribe_audio`로 개별적으로 다시 실행하세요
|
|
239
|
+
|
|
240
|
+
---
|
|
241
|
+
|
|
242
|
+
## 임시 작업 디렉터리 정리
|
|
243
|
+
|
|
244
|
+
whisper-windows-mcp는 전사 중 `%TEMP%\whisper-mcp-jobs\`에 작업 상태 및 로그 파일을 작성합니다. 이것들은 시간이 지남에 따라 축적되어 디스크 공간을 소비할 수 있습니다. 특히 긴 전사 작업의 `.log` 파일이 그렇습니다.
|
|
245
|
+
|
|
246
|
+
배치나 작업이 완료되고 출력 전사본을 확인한 후 이 디렉터리의 모든 것을 안전하게 삭제할 수 있습니다:
|
|
247
|
+
|
|
248
|
+
```powershell
|
|
249
|
+
Remove-Item "$env:TEMP\whisper-mcp-jobs\*" -Recurse -Force
|
|
250
|
+
```
|
|
251
|
+
|
|
252
|
+
다음 전사 시 디렉터리가 자동으로 다시 생성됩니다. 전사 출력 파일은 여기에 영구적으로 저장되지 않습니다 — 완료 시 소스 디렉터리로 이동됩니다. 작업 메타데이터와 로그만 남습니다.
|
|
253
|
+
|
|
254
|
+
**참고:** 전사가 진행 중인 동안 이 디렉터리를 삭제하지 마세요 — `check_batch_progress`가 작동하려면 배치 상태 파일이 필요합니다.
|
|
255
|
+
|
|
256
|
+
---
|
|
257
|
+
|
|
258
|
+
## 명령줄에서 대규모 무인 배치 처리
|
|
259
|
+
|
|
260
|
+
Claude 없이 밤새 실행하려는 매우 큰 배치의 경우 PowerShell을 사용하세요.
|
|
261
|
+
|
|
262
|
+
**중요:** whisper-cli.exe는 MP4, MKV 또는 대부분의 동영상 포맷을 직접 읽을 수 없습니다. FFmpeg가 각 파일을 먼저 WAV로 변환해야 합니다. whisper는 또한 전사본을 stdout에, 진단 출력을 stderr에 씁니다 — 전사본을 올바르게 캡처하려면 `Start-Process -RedirectStandardOutput`을 사용하세요. `|`로 파이핑하거나 `2>$null`로 stderr를 억제하면 아무것도 캡처되지 않습니다.
|
|
263
|
+
|
|
264
|
+
```powershell
|
|
265
|
+
$whisper = "C:\whisper\Release\whisper-cli.exe"
|
|
266
|
+
$model = "C:\whisper\models\ggml-medium.en.bin"
|
|
267
|
+
$dir = "C:\path\to\your\folder"
|
|
268
|
+
$ffmpeg = "ffmpeg"
|
|
269
|
+
$tmp = "$env:TEMP\whisper_convert.wav"
|
|
270
|
+
|
|
271
|
+
Get-ChildItem "$dir\*.mp4" | ForEach-Object {
|
|
272
|
+
$out = ($_.FullName -replace '\.mp4$', '') + ".txt"
|
|
273
|
+
if (Test-Path $out) {
|
|
274
|
+
Write-Host "SKIP (exists): $($_.Name)"
|
|
275
|
+
return
|
|
276
|
+
}
|
|
277
|
+
Write-Host "Converting: $($_.Name)"
|
|
278
|
+
& $ffmpeg -y -i $_.FullName -ar 16000 -ac 1 -c:a pcm_s16le $tmp 2>$null
|
|
279
|
+
Write-Host "Transcribing: $($_.Name)"
|
|
280
|
+
$wArgs = "-m `"$model`" -f `"$tmp`" --threads 8 --condition-on-previous-text 0 --no-speech-thold 0.6"
|
|
281
|
+
Start-Process -FilePath $whisper -ArgumentList $wArgs -RedirectStandardOutput $out -Wait -NoNewWindow
|
|
282
|
+
Write-Host "Done: $($_.BaseName).txt"
|
|
283
|
+
}
|
|
284
|
+
|
|
285
|
+
Remove-Item $tmp -ErrorAction SilentlyContinue
|
|
286
|
+
Write-Host "All done."
|
|
287
|
+
```
|
|
288
|
+
|
|
289
|
+
파일 유형에 맞게 `*.mp4`를 `*.mkv`, `*.m4a` 등으로 변경하세요. `Test-Path` 건너뛰기 확인으로 인해 중단 후 스크립트를 재실행해도 이미 완료된 파일은 다시 처리되지 않습니다.
|
|
290
|
+
|
|
291
|
+
이것은 각 소스 파일 옆에 `.txt` 파일을 씁니다. 나중에 `analyze_media`나 `start_batch`를 실행하면 MCP 도구가 이것들을 이미 전사된 것으로 인식합니다.
|
|
292
|
+
|
|
293
|
+
---
|
|
294
|
+
|
|
295
|
+
## 설정 파일 위치
|
|
296
|
+
|
|
297
|
+
```
|
|
298
|
+
C:\Users\사용자명\AppData\Roaming\Claude\claude_desktop_config.json
|
|
299
|
+
```
|
|
300
|
+
|
|
301
|
+
`AppData`가 보이지 않는 경우: 파일 탐색기에서 보기 → 표시 → 숨김 항목을 활성화하세요.
|
|
302
|
+
|
|
303
|
+
---
|
|
304
|
+
|
|
305
|
+
## 완전한 작동 설정 예시
|
|
306
|
+
|
|
307
|
+
```json
|
|
308
|
+
{
|
|
309
|
+
"mcpServers": {
|
|
310
|
+
"whisper": {
|
|
311
|
+
"command": "npx",
|
|
312
|
+
"args": ["-y", "whisper-windows-mcp"],
|
|
313
|
+
"env": {
|
|
314
|
+
"WHISPER_CLI_PATH": "C:\\whisper\\Release\\whisper-cli.exe",
|
|
315
|
+
"WHISPER_MODEL": "C:\\whisper\\models\\ggml-medium.en.bin",
|
|
316
|
+
"FFMPEG_PATH": "ffmpeg"
|
|
317
|
+
}
|
|
318
|
+
}
|
|
319
|
+
}
|
|
320
|
+
}
|
|
321
|
+
```
|
|
322
|
+
|
|
323
|
+
`FFMPEG_PATH`의 기본값은 `ffmpeg`(PATH에 있다고 가정)입니다. FFmpeg가 비표준 위치에 설치된 경우에만 명시적으로 설정하세요.
|
|
@@ -0,0 +1,323 @@
|
|
|
1
|
+
# whisper-windows-mcp — Rozwiązywanie problemów
|
|
2
|
+
|
|
3
|
+
---
|
|
4
|
+
|
|
5
|
+
## Szybka lista kontrolna
|
|
6
|
+
|
|
7
|
+
Przed głębszym śledztwem zweryfikuj wszystkie poniższe punkty:
|
|
8
|
+
|
|
9
|
+
- Ścieżki w `claude_desktop_config.json` używają **podwójnych ukośników odwrotnych** (`C:\\whisper\\...`)
|
|
10
|
+
- `whisper-cli.exe` istnieje pod ścieżką podaną w `WHISPER_CLI_PATH`
|
|
11
|
+
- Plik modelu `.bin` istnieje pod ścieżką podaną w `WHISPER_MODEL`
|
|
12
|
+
- FFmpeg jest zainstalowany i dostępny (`ffmpeg -version` działa w wierszu poleceń)
|
|
13
|
+
- Claude Desktop został **w pełni uruchomiony ponownie** po edycji konfiguracji (wyjście z zasobnika systemowego, a nie tylko zamknięcie okna)
|
|
14
|
+
- Serwer whisper wyświetla się jako **uruchomiony** (zielony znaczek) w Ustawieniach → Deweloper
|
|
15
|
+
|
|
16
|
+
---
|
|
17
|
+
|
|
18
|
+
## "whisper nie jest połączony" lub brak dostępnych narzędzi
|
|
19
|
+
|
|
20
|
+
**Najczęstsza przyczyna:** Claude Desktop nie został w pełni uruchomiony ponownie po edycji konfiguracji.
|
|
21
|
+
|
|
22
|
+
1. Kliknij prawym przyciskiem myszy ikonę Claude w zasobniku systemowym → Wyjdź
|
|
23
|
+
2. Ponownie otwórz Claude Desktop
|
|
24
|
+
3. Przejdź do Ustawień → Deweloper i sprawdź zielony znaczek **uruchomiony** obok whisper
|
|
25
|
+
|
|
26
|
+
Jeśli nadal nie wyświetla się:
|
|
27
|
+
|
|
28
|
+
1. Otwórz `claude_desktop_config.json` i sprawdź błędy składni JSON (brakujące przecinki, niezgodne nawiasy klamrowe)
|
|
29
|
+
2. Upewnij się, że wszystkie ścieżki używają podwójnych ukośników odwrotnych
|
|
30
|
+
3. Uruchom `check_config` w Claude Desktop, aby uzyskać diagnostykę
|
|
31
|
+
|
|
32
|
+
---
|
|
33
|
+
|
|
34
|
+
## download_model przekracza limit czasu dla dużych modeli
|
|
35
|
+
|
|
36
|
+
Claude Desktop ma 4-minutowy limit czasu dla wywołań narzędzi MCP. Pobieranie dużych modeli przy wolnym połączeniu może go przekroczyć.
|
|
37
|
+
|
|
38
|
+
**Rozmiary plików:**
|
|
39
|
+
- `large-v3` — 2,9 GB
|
|
40
|
+
- `large-v3-turbo` — 1,6 GB
|
|
41
|
+
- `large-v3-q5_0` — 1,1 GB
|
|
42
|
+
- `large-v3-turbo-q5_0` — 547 MB
|
|
43
|
+
- `medium.en` — 1,5 GB
|
|
44
|
+
- `medium.en-q5_0` — 514 MB
|
|
45
|
+
|
|
46
|
+
Przy szybkim połączeniu (100 Mbps+) nawet large-v3 pobiera się w mniej niż 4 minuty. Przy wolniejszych połączeniach użyj przeglądarki lub PowerShell do bezpośredniego pobierania i umieść plik w katalogu modeli ręcznie:
|
|
47
|
+
|
|
48
|
+
```powershell
|
|
49
|
+
# Przykład — bezpośrednie pobieranie large-v3-turbo
|
|
50
|
+
Invoke-WebRequest -Uri "https://huggingface.co/ggerganov/whisper.cpp/resolve/main/ggml-large-v3-turbo.bin" `
|
|
51
|
+
-OutFile "C:\whisper\models\ggml-large-v3-turbo.bin"
|
|
52
|
+
```
|
|
53
|
+
|
|
54
|
+
Następnie użyj `switch_model ggml-large-v3-turbo.bin` do aktywacji.
|
|
55
|
+
|
|
56
|
+
---
|
|
57
|
+
|
|
58
|
+
## `check_config` raportuje brak whisper-cli.exe
|
|
59
|
+
|
|
60
|
+
Ścieżka w konfiguracji nie odpowiada rzeczywistej lokalizacji pliku.
|
|
61
|
+
|
|
62
|
+
Zweryfikuj istnienie pliku:
|
|
63
|
+
```
|
|
64
|
+
dir C:\whisper\Release\whisper-cli.exe
|
|
65
|
+
```
|
|
66
|
+
|
|
67
|
+
Jeśli jest gdzie indziej, zaktualizuj `WHISPER_CLI_PATH` w konfiguracji, aby odpowiadał rzeczywistej ścieżce.
|
|
68
|
+
|
|
69
|
+
---
|
|
70
|
+
|
|
71
|
+
## `check_config` raportuje brak FFmpeg
|
|
72
|
+
|
|
73
|
+
FFmpeg nie jest zainstalowany lub nie ma go w systemowym PATH.
|
|
74
|
+
|
|
75
|
+
Instalacja przez winget:
|
|
76
|
+
```
|
|
77
|
+
winget install ffmpeg
|
|
78
|
+
```
|
|
79
|
+
|
|
80
|
+
Lub pobierz z [ffmpeg.org](https://ffmpeg.org/download.html), wypakuj i dodaj folder `bin` do systemowego PATH.
|
|
81
|
+
|
|
82
|
+
Po instalacji otwórz nowy wiersz poleceń i zweryfikuj:
|
|
83
|
+
```
|
|
84
|
+
ffmpeg -version
|
|
85
|
+
```
|
|
86
|
+
|
|
87
|
+
Jeśli zainstalowałeś FFmpeg w niestandardowej lokalizacji, ustaw zmienną środowiskową `FFMPEG_PATH` w konfiguracji Claude Desktop:
|
|
88
|
+
```json
|
|
89
|
+
"env": {
|
|
90
|
+
"FFMPEG_PATH": "C:\\ffmpeg\\bin\\ffmpeg.exe"
|
|
91
|
+
}
|
|
92
|
+
```
|
|
93
|
+
|
|
94
|
+
---
|
|
95
|
+
|
|
96
|
+
## Wynik transkrypcji jest pełen tagów `[FOREIGN]`
|
|
97
|
+
|
|
98
|
+
**Przyczyna:** Używasz modelu tylko angielskiego (np. `ggml-medium.en.bin`) na audio w innym języku niż angielski. Modele tylko angielskie nie mogą przetwarzać innych języków i wypisują `[FOREIGN]` jako placeholder dla każdego segmentu, którego nie mogą obsłużyć.
|
|
99
|
+
|
|
100
|
+
**Rozwiązanie:** Pobierz i użyj `ggml-large-v3.bin` — modelu wielojęzycznego. Jest to wymagane do jakiejkolwiek transkrypcji innej niż angielska, automatycznego wykrywania języka lub tłumaczenia.
|
|
101
|
+
|
|
102
|
+
```
|
|
103
|
+
https://huggingface.co/ggerganov/whisper.cpp/resolve/main/ggml-large-v3.bin
|
|
104
|
+
```
|
|
105
|
+
|
|
106
|
+
Zapisz w `C:\whisper\models\` i zaktualizuj konfigurację:
|
|
107
|
+
```json
|
|
108
|
+
"WHISPER_MODEL": "C:\\whisper\\models\\ggml-large-v3.bin"
|
|
109
|
+
```
|
|
110
|
+
|
|
111
|
+
Lub zastąp dla każdej transkrypcji używając parametru `model` w `transcribe_audio` lub `generate_subtitles`.
|
|
112
|
+
|
|
113
|
+
> **Uwaga:** Modele tylko angielskie (`*.en.bin`) są szybsze i dokładniejsze dla treści angielskich, ale całkowicie nie radzą sobie z innymi językami. Jeśli pracujesz z treściami wielojęzycznymi, `large-v3` jest właściwym modelem niezależnie od sprzętu.
|
|
114
|
+
|
|
115
|
+
---
|
|
116
|
+
|
|
117
|
+
## Transkrypcja nie produkuje wyników lub pusty plik
|
|
118
|
+
|
|
119
|
+
**Możliwe przyczyny:**
|
|
120
|
+
|
|
121
|
+
1. **Zły model dla języka** — Modele tylko angielskie (`*.en.bin`) nie mogą transkrybować innych języków. Używaj `ggml-large-v3.bin` dla treści wielojęzycznych.
|
|
122
|
+
|
|
123
|
+
2. **Zbyt niska jakość audio** — Pliki o bardzo niskiej przepływności (np. stare nagrania telefoniczne `.3gp` używające kodeka AMR-NB ~12kbps) mogą być na granicy możliwości whispera. Hałaśliwe środowiska (hałas w tle, echo, odlegli mówcy) są również trudne. Spróbuj `large-v3`, który lepiej radzi sobie z degradowanym audio.
|
|
124
|
+
|
|
125
|
+
3. **Plik jest cichy lub uszkodzony** — Uruchom `analyze_media` na pliku, aby sprawdzić czy FFprobe wykrywa prawidłowy strumień audio.
|
|
126
|
+
|
|
127
|
+
4. **Błąd konwersji** — Plik może nie konwertować się do WAV poprawnie. Spróbuj najpierw ręcznie przekonwertować:
|
|
128
|
+
```
|
|
129
|
+
ffmpeg -i yourfile.3gp -ar 16000 -ac 1 output.wav
|
|
130
|
+
```
|
|
131
|
+
Następnie transkrybuj WAV bezpośrednio.
|
|
132
|
+
|
|
133
|
+
---
|
|
134
|
+
|
|
135
|
+
## Zadanie w tle nie działa dla plików ze znakami specjalnymi lub Unicode w nazwie
|
|
136
|
+
|
|
137
|
+
**Przyczyna:** whisper-cli.exe nie może zapisać pliku wyjściowego gdy ścieżka zawiera znaki Unicode (polskie, japońskie, chińskie, emoji, nawiasy itp.) lub niektóre znaki specjalne.
|
|
138
|
+
|
|
139
|
+
**Aktualne obejście:** Zmień nazwę pliku, aby używał tylko znaków ASCII przed transkrypcją, a następnie zmień nazwę z powrotem jeśli to konieczne.
|
|
140
|
+
|
|
141
|
+
```
|
|
142
|
+
ren "plik_po_polsku.mp4" "temp_transcribe.mp4"
|
|
143
|
+
```
|
|
144
|
+
|
|
145
|
+
**Status:** Jest to znany błąd. Planowana jest poprawka, która będzie kierować wyjście przez oczyszczoną tymczasową ścieżkę i przenosić wynik do właściwego miejsca docelowego po zakończeniu.
|
|
146
|
+
|
|
147
|
+
---
|
|
148
|
+
|
|
149
|
+
## Zadanie w tle pokazuje "błąd" bez wyników
|
|
150
|
+
|
|
151
|
+
**Możliwe przyczyny:**
|
|
152
|
+
|
|
153
|
+
1. **Nazwa pliku Unicode** — Patrz wyżej.
|
|
154
|
+
|
|
155
|
+
2. **Zła ścieżka modelu** — Odłączony proces nie dziedziczy poprawionych ścieżek. Uruchom `check_config`, aby zweryfikować ścieżki.
|
|
156
|
+
|
|
157
|
+
3. **Proces został zakończony** — Jeśli whisper-cli.exe został ręcznie zakończony w trakcie zadania, plik wyjściowy nie będzie istniał. Spróbuj ponownie.
|
|
158
|
+
|
|
159
|
+
4. **Niewystarczająca VRAM** — Duże modele na GPU z małą VRAM mogą po cichu kończyć się błędem. Spróbuj mniejszego modelu.
|
|
160
|
+
|
|
161
|
+
5. **Błąd konwersji pliku** — Spróbuj transkrybować plik WAV bezpośrednio, aby ustalić czy problem leży w konwersji czy transkrypcji.
|
|
162
|
+
|
|
163
|
+
---
|
|
164
|
+
|
|
165
|
+
## Transkrypcja w tle nie produkuje wyników SRT
|
|
166
|
+
|
|
167
|
+
**Przyczyna:** Tryb w tle (`background=true` w `transcribe_audio`) obecnie produkuje tylko wyjście `.txt`. Format SRT w trybie w tle nie jest jeszcze zaimplementowany.
|
|
168
|
+
|
|
169
|
+
**Obejście:** Dla plików poniżej ~4 minut użyj `generate_subtitles` w trybie blokującym. Dla dłuższych plików najpierw transkrybuj w trybie w tle, aby uzyskać `.txt`, następnie jeśli potrzebujesz SRT użyj `generate_subtitles` na tym samym pliku (będzie transkrybować ponownie).
|
|
170
|
+
|
|
171
|
+
**Status:** Obsługa SRT w trybie w tle jest planowana na przyszłe wydanie.
|
|
172
|
+
|
|
173
|
+
---
|
|
174
|
+
|
|
175
|
+
## GPU nie jest używany (CPU zablokowany powyżej 50%)
|
|
176
|
+
|
|
177
|
+
**Przyczyna:** Uruchamiasz binarium tylko CPU, które jest dostarczane ze standardowym wydaniem whisper.cpp.
|
|
178
|
+
|
|
179
|
+
**Rozwiązanie:** Pobierz kompilację z włączonym Vulkan ze [strony wydań](https://github.com/eviscerations/whisper-windows-mcp/releases/tag/v1.4.0) i wypakuj do `C:\whisper\Release\`.
|
|
180
|
+
|
|
181
|
+
Zweryfikuj, czy akceleracja GPU jest aktywna:
|
|
182
|
+
- Poproś Claude o uruchomienie `check_system`
|
|
183
|
+
- Szukaj `✅ Vulkan binary: ggml-vulkan.dll found` w wynikach
|
|
184
|
+
- Obserwuj Menedżer zadań → Wydajność → GPU podczas transkrypcji — wykorzystanie GPU powinno wzrosnąć do 15–30%
|
|
185
|
+
|
|
186
|
+
---
|
|
187
|
+
|
|
188
|
+
## `check_system` raportuje błędną ilość VRAM
|
|
189
|
+
|
|
190
|
+
Jest to znane ograniczenie Windows. Polecenie `wmic` odczytuje VRAM z rejestru, który na wielu kartach AMD raportuje połowę fizycznej VRAM. Vega 56 z 8GB HBM2 zazwyczaj będzie pokazywać 4GB. Jest to tylko problem wyświetlania — whisper używa pełnej fizycznej VRAM podczas wnioskowania.
|
|
191
|
+
|
|
192
|
+
---
|
|
193
|
+
|
|
194
|
+
## Błąd "Transkrypcja już w toku"
|
|
195
|
+
|
|
196
|
+
Proces `whisper-cli.exe` działa z poprzedniego zadania. Poczekaj na jego zakończenie lub:
|
|
197
|
+
|
|
198
|
+
1. Otwórz Menedżer zadań → zakładka Szczegóły
|
|
199
|
+
2. Znajdź `whisper-cli.exe`
|
|
200
|
+
3. Kliknij prawym przyciskiem myszy → Zakończ zadanie
|
|
201
|
+
|
|
202
|
+
Następnie spróbuj ponownie.
|
|
203
|
+
|
|
204
|
+
---
|
|
205
|
+
|
|
206
|
+
## Automatyczne wykrywanie języka jest błędne
|
|
207
|
+
|
|
208
|
+
Automatyczne wykrywanie Whisper działa na pierwszych 30 sekundach audio. Jeśli plik zaczyna się w innym języku niż większość jego zawartości, wykrywanie może być błędne.
|
|
209
|
+
|
|
210
|
+
**Rozwiązanie:** Podaj język jawnie (np. `language=pl`) zamiast polegać na automatycznym wykrywaniu.
|
|
211
|
+
|
|
212
|
+
---
|
|
213
|
+
|
|
214
|
+
## Generowanie napisów produkuje "(mówi w obcym języku)" przez cały film
|
|
215
|
+
|
|
216
|
+
Whisper wykrył mowę, ale nie mógł transkrybować. Najczęstsze przyczyny:
|
|
217
|
+
|
|
218
|
+
1. **Zły model** — Używanie modelu tylko angielskiego na audio w innym języku. Użyj `large-v3`.
|
|
219
|
+
|
|
220
|
+
2. **Jakość audio** — Hałaśliwe środowiska (kuchnie, tłumy, echo) mogą pokonać model medium. Spróbuj `large-v3`.
|
|
221
|
+
|
|
222
|
+
3. **Mieszane języki** — Pliki z dwoma językami naprzemiennie będą miały mniejszościowy język zastąpiony placeholderami przy ustawieniu jednego języka.
|
|
223
|
+
|
|
224
|
+
---
|
|
225
|
+
|
|
226
|
+
## Tłumaczenie napisów produkuje tylko angielski
|
|
227
|
+
|
|
228
|
+
Jest to zamierzone zachowanie. Wbudowana flaga `--translate` Whisper tłumaczy tylko **na angielski**. Dla tłumaczenia na inne języki docelowe przetwórz zawartość pliku `.srt` osobno.
|
|
229
|
+
|
|
230
|
+
---
|
|
231
|
+
|
|
232
|
+
## Wsadowa transkrypcja przestała się posuwać
|
|
233
|
+
|
|
234
|
+
Wywołaj ponownie `check_batch_progress`. Jeśli nadal utknęła:
|
|
235
|
+
|
|
236
|
+
1. Sprawdź Menedżer zadań pod kątem działającego procesu `whisper-cli.exe`
|
|
237
|
+
2. Sprawdź logi zadań w `%TEMP%\whisper-mcp-jobs\`
|
|
238
|
+
3. Pliki z błędami są oznaczone w raporcie partii — uruchom je indywidualnie przez `transcribe_audio`
|
|
239
|
+
|
|
240
|
+
---
|
|
241
|
+
|
|
242
|
+
## Czyszczenie tymczasowego katalogu zadań
|
|
243
|
+
|
|
244
|
+
whisper-windows-mcp zapisuje pliki stanu zadań i logi w `%TEMP%\whisper-mcp-jobs\` podczas transkrypcji. Gromadzą się one z czasem i mogą zużywać miejsce na dysku, szczególnie pliki `.log` z długich zadań transkrypcji.
|
|
245
|
+
|
|
246
|
+
Po zakończeniu partii lub zadania i zweryfikowaniu transkrypcji wyjściowych możesz bezpiecznie usunąć wszystko w tym katalogu:
|
|
247
|
+
|
|
248
|
+
```powershell
|
|
249
|
+
Remove-Item "$env:TEMP\whisper-mcp-jobs\*" -Recurse -Force
|
|
250
|
+
```
|
|
251
|
+
|
|
252
|
+
Katalog zostanie automatycznie odtworzony przy następnej transkrypcji. Żadne pliki wyjściowe transkrypcji nie są tu przechowywane na stałe — są przenoszone do katalogu źródłowego po zakończeniu. Pozostają tylko metadane zadań i logi.
|
|
253
|
+
|
|
254
|
+
**Uwaga:** Nie usuwaj tego katalogu podczas trwającej transkrypcji — pliki stanu partii są potrzebne do działania `check_batch_progress`.
|
|
255
|
+
|
|
256
|
+
---
|
|
257
|
+
|
|
258
|
+
## Duża nienadzorowana partia z wiersza poleceń
|
|
259
|
+
|
|
260
|
+
Dla bardzo dużych partii, gdzie chcesz uruchomić przez noc bez Claude, użyj PowerShell.
|
|
261
|
+
|
|
262
|
+
**Ważne:** whisper-cli.exe nie może bezpośrednio odczytywać MP4, MKV ani większości formatów wideo. FFmpeg musi wcześniej przekonwertować każdy plik do WAV. Whisper zapisuje również transkrypcję do stdout, a dane diagnostyczne do stderr — użyj `Start-Process -RedirectStandardOutput`, aby poprawnie przechwycić transkrypcję. Używanie pipe `|` lub przekierowywanie stderr przez `2>$null` nic nie przechwytuje.
|
|
263
|
+
|
|
264
|
+
```powershell
|
|
265
|
+
$whisper = "C:\whisper\Release\whisper-cli.exe"
|
|
266
|
+
$model = "C:\whisper\models\ggml-medium.en.bin"
|
|
267
|
+
$dir = "C:\path\to\your\folder"
|
|
268
|
+
$ffmpeg = "ffmpeg"
|
|
269
|
+
$tmp = "$env:TEMP\whisper_convert.wav"
|
|
270
|
+
|
|
271
|
+
Get-ChildItem "$dir\*.mp4" | ForEach-Object {
|
|
272
|
+
$out = ($_.FullName -replace '\.mp4$', '') + ".txt"
|
|
273
|
+
if (Test-Path $out) {
|
|
274
|
+
Write-Host "SKIP (exists): $($_.Name)"
|
|
275
|
+
return
|
|
276
|
+
}
|
|
277
|
+
Write-Host "Converting: $($_.Name)"
|
|
278
|
+
& $ffmpeg -y -i $_.FullName -ar 16000 -ac 1 -c:a pcm_s16le $tmp 2>$null
|
|
279
|
+
Write-Host "Transcribing: $($_.Name)"
|
|
280
|
+
$wArgs = "-m `"$model`" -f `"$tmp`" --threads 8 --condition-on-previous-text 0 --no-speech-thold 0.6"
|
|
281
|
+
Start-Process -FilePath $whisper -ArgumentList $wArgs -RedirectStandardOutput $out -Wait -NoNewWindow
|
|
282
|
+
Write-Host "Done: $($_.BaseName).txt"
|
|
283
|
+
}
|
|
284
|
+
|
|
285
|
+
Remove-Item $tmp -ErrorAction SilentlyContinue
|
|
286
|
+
Write-Host "All done."
|
|
287
|
+
```
|
|
288
|
+
|
|
289
|
+
Zmień `*.mp4` na `*.mkv`, `*.m4a` itp., aby dopasować do typów plików. Sprawdzenie pominięcia `Test-Path` oznacza, że ponowne uruchomienie skryptu po przerwaniu nie będzie ponownie przetwarzać już ukończonych plików.
|
|
290
|
+
|
|
291
|
+
Skrypt zapisuje pliki `.txt` obok każdego źródła. Narzędzia MCP rozpoznają je jako już transkrybowane po uruchomieniu `analyze_media` lub `start_batch`.
|
|
292
|
+
|
|
293
|
+
---
|
|
294
|
+
|
|
295
|
+
## Lokalizacja pliku konfiguracyjnego
|
|
296
|
+
|
|
297
|
+
```
|
|
298
|
+
C:\Users\NazwaUżytkownika\AppData\Roaming\Claude\claude_desktop_config.json
|
|
299
|
+
```
|
|
300
|
+
|
|
301
|
+
Jeśli `AppData` nie jest widoczne: Widok → Pokaż → Ukryte elementy w Eksploratorze plików.
|
|
302
|
+
|
|
303
|
+
---
|
|
304
|
+
|
|
305
|
+
## Pełny przykład działającej konfiguracji
|
|
306
|
+
|
|
307
|
+
```json
|
|
308
|
+
{
|
|
309
|
+
"mcpServers": {
|
|
310
|
+
"whisper": {
|
|
311
|
+
"command": "npx",
|
|
312
|
+
"args": ["-y", "whisper-windows-mcp"],
|
|
313
|
+
"env": {
|
|
314
|
+
"WHISPER_CLI_PATH": "C:\\whisper\\Release\\whisper-cli.exe",
|
|
315
|
+
"WHISPER_MODEL": "C:\\whisper\\models\\ggml-medium.en.bin",
|
|
316
|
+
"FFMPEG_PATH": "ffmpeg"
|
|
317
|
+
}
|
|
318
|
+
}
|
|
319
|
+
}
|
|
320
|
+
}
|
|
321
|
+
```
|
|
322
|
+
|
|
323
|
+
`FFMPEG_PATH` domyślnie przyjmuje wartość `ffmpeg` (zakłada obecność w PATH). Ustaw jawnie tylko jeśli FFmpeg jest zainstalowany w niestandardowej lokalizacji.
|