VoiceMode
MCP-сервер для голосового разговора с Claude Code и другими MCP-агентами: распознавание речи и синтез голоса, локально или через облако
Средний риск
Средний уровень ставим, когда инструмент запускает код, ходит в сеть или читает файлы проекта. Перед установкой посмотрите, что именно он делает.
Почему такой уровень
- Получает доступ к микрофону и воспроизводит звук на устройстве
- В облачном режиме отправляет аудио внешнему сервису распознавания и синтеза
- Устанавливает и запускает локальные сервисы речи
Установка
В терминале, через SkillFoxx CLI
npx skillfoxx add mcp/voicemodeОпределит агенты на машине, проверит риск и зафиксирует версию.
Другие способы установки
Выполните в терминале
claude mcp add --transport stdio voicemode -- uvx voice-mode==8.12.0Или добавьте в файл .mcp.json, в проекте
{
"mcpServers": {
"voicemode": {
"command": "uvx",
"args": [
"voice-mode==8.12.0"
]
}
}
}Если файл уже есть, добавьте сервер внутрь ключа mcpServers.
Ключи и настройки
OPENAI_API_KEYсекрет, необязательная- OpenAI API key for cloud-based STT/TTS (optional - local services can be installed)
VOICEMODE_DEBUGнеобязательная- Enable debug mode with detailed logging (true/false)
VOICEMODE_SKIP_TTSнеобязательная- Skip TTS and show text only for faster response (true/false)
VOICEMODE_PREFER_LOCALнеобязательная- Prefer local services over cloud when available (true/false, default: true)
VOICEMODE_AUDIO_FORMATнеобязательная- Audio format: pcm, mp3, wav, flac, aac, opus (default: pcm)
VOICEMODE_WHISPER_MODELнеобязательная- Whisper model: tiny, base, small, medium, large (default: base)
VOICEMODE_DISABLE_SILENCE_DETECTIONнеобязательная- Disable silence detection for continuous recording (true/false)
Замените значения в угловых скобках своими. Ключи не попадают в ссылки установки и не хранятся у нас.
Кнопка откроет агент и предложит добавить сервер. Если ничего не произошло, скопируйте конфиг ниже.
Добавьте в файл ~/.cursor/mcp.json, для всех проектов
{
"mcpServers": {
"voicemode": {
"command": "uvx",
"args": [
"voice-mode==8.12.0"
]
}
}
}Если файл уже есть, добавьте сервер внутрь ключа mcpServers. Для одного проекта тот же блок кладут в .cursor/mcp.json.
Ключи и настройки
OPENAI_API_KEYсекрет, необязательная- OpenAI API key for cloud-based STT/TTS (optional - local services can be installed)
VOICEMODE_DEBUGнеобязательная- Enable debug mode with detailed logging (true/false)
VOICEMODE_SKIP_TTSнеобязательная- Skip TTS and show text only for faster response (true/false)
VOICEMODE_PREFER_LOCALнеобязательная- Prefer local services over cloud when available (true/false, default: true)
VOICEMODE_AUDIO_FORMATнеобязательная- Audio format: pcm, mp3, wav, flac, aac, opus (default: pcm)
VOICEMODE_WHISPER_MODELнеобязательная- Whisper model: tiny, base, small, medium, large (default: base)
VOICEMODE_DISABLE_SILENCE_DETECTIONнеобязательная- Disable silence detection for continuous recording (true/false)
Замените значения в угловых скобках своими. Ключи не попадают в ссылки установки и не хранятся у нас.
Кнопка откроет агент и предложит добавить сервер. Если ничего не произошло, скопируйте конфиг ниже.
Выполните в терминале
code --add-mcp '{"name":"voicemode","type":"stdio","command":"uvx","args":["voice-mode==8.12.0"]}'Или добавьте в файл .vscode/mcp.json, в проекте
{
"servers": {
"voicemode": {
"type": "stdio",
"command": "uvx",
"args": [
"voice-mode==8.12.0"
]
}
}
}Если файл уже есть, добавьте сервер внутрь ключа servers.
Ключи и настройки
OPENAI_API_KEYсекрет, необязательная- OpenAI API key for cloud-based STT/TTS (optional - local services can be installed)
VOICEMODE_DEBUGнеобязательная- Enable debug mode with detailed logging (true/false)
VOICEMODE_SKIP_TTSнеобязательная- Skip TTS and show text only for faster response (true/false)
VOICEMODE_PREFER_LOCALнеобязательная- Prefer local services over cloud when available (true/false, default: true)
VOICEMODE_AUDIO_FORMATнеобязательная- Audio format: pcm, mp3, wav, flac, aac, opus (default: pcm)
VOICEMODE_WHISPER_MODELнеобязательная- Whisper model: tiny, base, small, medium, large (default: base)
VOICEMODE_DISABLE_SILENCE_DETECTIONнеобязательная- Disable silence detection for continuous recording (true/false)
Замените значения в угловых скобках своими. Ключи не попадают в ссылки установки и не хранятся у нас.
Выполните в терминале
codex mcp add voicemode -- uvx voice-mode==8.12.0Или добавьте в файл ~/.codex/config.toml, для всех проектов
[mcp_servers.voicemode]
command = "uvx"
args = ["voice-mode==8.12.0"]Если файл уже есть, допишите блок в конец.
Ключи и настройки
OPENAI_API_KEYсекрет, необязательная- OpenAI API key for cloud-based STT/TTS (optional - local services can be installed)
VOICEMODE_DEBUGнеобязательная- Enable debug mode with detailed logging (true/false)
VOICEMODE_SKIP_TTSнеобязательная- Skip TTS and show text only for faster response (true/false)
VOICEMODE_PREFER_LOCALнеобязательная- Prefer local services over cloud when available (true/false, default: true)
VOICEMODE_AUDIO_FORMATнеобязательная- Audio format: pcm, mp3, wav, flac, aac, opus (default: pcm)
VOICEMODE_WHISPER_MODELнеобязательная- Whisper model: tiny, base, small, medium, large (default: base)
VOICEMODE_DISABLE_SILENCE_DETECTIONнеобязательная- Disable silence detection for continuous recording (true/false)
Замените значения в угловых скобках своими. Ключи не попадают в ссылки установки и не хранятся у нас.
Выполните в терминале
gemini mcp add -s user voicemode uvx voice-mode==8.12.0Или добавьте в файл ~/.gemini/settings.json, для всех проектов
{
"mcpServers": {
"voicemode": {
"command": "uvx",
"args": [
"voice-mode==8.12.0"
]
}
}
}Если файл уже есть, добавьте сервер внутрь ключа mcpServers.
Ключи и настройки
OPENAI_API_KEYсекрет, необязательная- OpenAI API key for cloud-based STT/TTS (optional - local services can be installed)
VOICEMODE_DEBUGнеобязательная- Enable debug mode with detailed logging (true/false)
VOICEMODE_SKIP_TTSнеобязательная- Skip TTS and show text only for faster response (true/false)
VOICEMODE_PREFER_LOCALнеобязательная- Prefer local services over cloud when available (true/false, default: true)
VOICEMODE_AUDIO_FORMATнеобязательная- Audio format: pcm, mp3, wav, flac, aac, opus (default: pcm)
VOICEMODE_WHISPER_MODELнеобязательная- Whisper model: tiny, base, small, medium, large (default: base)
VOICEMODE_DISABLE_SILENCE_DETECTIONнеобязательная- Disable silence detection for continuous recording (true/false)
Замените значения в угловых скобках своими. Ключи не попадают в ссылки установки и не хранятся у нас.
Добавьте в файл ~/.config/devin/mcp_config.json, для всех проектов
{
"mcpServers": {
"voicemode": {
"command": "uvx",
"args": [
"voice-mode==8.12.0"
]
}
}
}Если файл уже есть, добавьте сервер внутрь ключа mcpServers. В легаси Cascade конфиг MCP лежит в ~/.codeium/windsurf/mcp_config.json.
Ключи и настройки
OPENAI_API_KEYсекрет, необязательная- OpenAI API key for cloud-based STT/TTS (optional - local services can be installed)
VOICEMODE_DEBUGнеобязательная- Enable debug mode with detailed logging (true/false)
VOICEMODE_SKIP_TTSнеобязательная- Skip TTS and show text only for faster response (true/false)
VOICEMODE_PREFER_LOCALнеобязательная- Prefer local services over cloud when available (true/false, default: true)
VOICEMODE_AUDIO_FORMATнеобязательная- Audio format: pcm, mp3, wav, flac, aac, opus (default: pcm)
VOICEMODE_WHISPER_MODELнеобязательная- Whisper model: tiny, base, small, medium, large (default: base)
VOICEMODE_DISABLE_SILENCE_DETECTIONнеобязательная- Disable silence detection for continuous recording (true/false)
Замените значения в угловых скобках своими. Ключи не попадают в ссылки установки и не хранятся у нас.
Бывший Windsurf.
Добавьте в файл cline_mcp_settings.json, для всех проектов
{
"mcpServers": {
"voicemode": {
"command": "uvx",
"args": [
"voice-mode==8.12.0"
]
}
}
}Если файл уже есть, добавьте сервер внутрь ключа mcpServers. Файл настроек открывается в Cline: вкладка MCP Servers, кнопка Configure MCP Servers.
Ключи и настройки
OPENAI_API_KEYсекрет, необязательная- OpenAI API key for cloud-based STT/TTS (optional - local services can be installed)
VOICEMODE_DEBUGнеобязательная- Enable debug mode with detailed logging (true/false)
VOICEMODE_SKIP_TTSнеобязательная- Skip TTS and show text only for faster response (true/false)
VOICEMODE_PREFER_LOCALнеобязательная- Prefer local services over cloud when available (true/false, default: true)
VOICEMODE_AUDIO_FORMATнеобязательная- Audio format: pcm, mp3, wav, flac, aac, opus (default: pcm)
VOICEMODE_WHISPER_MODELнеобязательная- Whisper model: tiny, base, small, medium, large (default: base)
VOICEMODE_DISABLE_SILENCE_DETECTIONнеобязательная- Disable silence detection for continuous recording (true/false)
Замените значения в угловых скобках своими. Ключи не попадают в ссылки установки и не хранятся у нас.
Добавьте в файл .roo/mcp.json, в проекте
{
"mcpServers": {
"voicemode": {
"command": "uvx",
"args": [
"voice-mode==8.12.0"
]
}
}
}Если файл уже есть, добавьте сервер внутрь ключа mcpServers.
Ключи и настройки
OPENAI_API_KEYсекрет, необязательная- OpenAI API key for cloud-based STT/TTS (optional - local services can be installed)
VOICEMODE_DEBUGнеобязательная- Enable debug mode with detailed logging (true/false)
VOICEMODE_SKIP_TTSнеобязательная- Skip TTS and show text only for faster response (true/false)
VOICEMODE_PREFER_LOCALнеобязательная- Prefer local services over cloud when available (true/false, default: true)
VOICEMODE_AUDIO_FORMATнеобязательная- Audio format: pcm, mp3, wav, flac, aac, opus (default: pcm)
VOICEMODE_WHISPER_MODELнеобязательная- Whisper model: tiny, base, small, medium, large (default: base)
VOICEMODE_DISABLE_SILENCE_DETECTIONнеобязательная- Disable silence detection for continuous recording (true/false)
Замените значения в угловых скобках своими. Ключи не попадают в ссылки установки и не хранятся у нас.
Форк Roo Code, папки .roo те же.
Добавьте в файл opencode.json, в проекте
{
"mcp": {
"voicemode": {
"type": "local",
"command": [
"uvx",
"voice-mode==8.12.0"
]
}
}
}Если файл уже есть, добавьте сервер внутрь ключа mcp.
Ключи и настройки
OPENAI_API_KEYсекрет, необязательная- OpenAI API key for cloud-based STT/TTS (optional - local services can be installed)
VOICEMODE_DEBUGнеобязательная- Enable debug mode with detailed logging (true/false)
VOICEMODE_SKIP_TTSнеобязательная- Skip TTS and show text only for faster response (true/false)
VOICEMODE_PREFER_LOCALнеобязательная- Prefer local services over cloud when available (true/false, default: true)
VOICEMODE_AUDIO_FORMATнеобязательная- Audio format: pcm, mp3, wav, flac, aac, opus (default: pcm)
VOICEMODE_WHISPER_MODELнеобязательная- Whisper model: tiny, base, small, medium, large (default: base)
VOICEMODE_DISABLE_SILENCE_DETECTIONнеобязательная- Disable silence detection for continuous recording (true/false)
Замените значения в угловых скобках своими. Ключи не попадают в ссылки установки и не хранятся у нас.
Добавьте в файл ~/.config/zed/settings.json, для всех проектов
{
"context_servers": {
"voicemode": {
"command": "uvx",
"args": [
"voice-mode==8.12.0"
]
}
}
}Если файл уже есть, добавьте сервер внутрь ключа context_servers.
Ключи и настройки
OPENAI_API_KEYсекрет, необязательная- OpenAI API key for cloud-based STT/TTS (optional - local services can be installed)
VOICEMODE_DEBUGнеобязательная- Enable debug mode with detailed logging (true/false)
VOICEMODE_SKIP_TTSнеобязательная- Skip TTS and show text only for faster response (true/false)
VOICEMODE_PREFER_LOCALнеобязательная- Prefer local services over cloud when available (true/false, default: true)
VOICEMODE_AUDIO_FORMATнеобязательная- Audio format: pcm, mp3, wav, flac, aac, opus (default: pcm)
VOICEMODE_WHISPER_MODELнеобязательная- Whisper model: tiny, base, small, medium, large (default: base)
VOICEMODE_DISABLE_SILENCE_DETECTIONнеобязательная- Disable silence detection for continuous recording (true/false)
Замените значения в угловых скобках своими. Ключи не попадают в ссылки установки и не хранятся у нас.
Добавьте в файл .codeassistant/mcp.json, в проекте
{
"mcpServers": {
"voicemode": {
"command": "uvx",
"args": [
"voice-mode==8.12.0"
]
}
}
}Если файл уже есть, добавьте сервер внутрь ключа mcpServers.
Ключи и настройки
OPENAI_API_KEYсекрет, необязательная- OpenAI API key for cloud-based STT/TTS (optional - local services can be installed)
VOICEMODE_DEBUGнеобязательная- Enable debug mode with detailed logging (true/false)
VOICEMODE_SKIP_TTSнеобязательная- Skip TTS and show text only for faster response (true/false)
VOICEMODE_PREFER_LOCALнеобязательная- Prefer local services over cloud when available (true/false, default: true)
VOICEMODE_AUDIO_FORMATнеобязательная- Audio format: pcm, mp3, wav, flac, aac, opus (default: pcm)
VOICEMODE_WHISPER_MODELнеобязательная- Whisper model: tiny, base, small, medium, large (default: base)
VOICEMODE_DISABLE_SILENCE_DETECTIONнеобязательная- Disable silence detection for continuous recording (true/false)
Замените значения в угловых скобках своими. Ключи не попадают в ссылки установки и не хранятся у нас.
Для Claude Code: claude plugin marketplace add mbailey/voicemode, затем claude plugin install voicemode@voicemode, потом /voicemode:install и /voicemode:converse. Как MCP: uvx voice-mode-install, затем claude mcp add --scope user voicemode -- uvx --refresh --from voice-mode voicemode-mcp-launcher.
Другие способы из описания автора
claude plugin marketplace add mbailey/voicemode
claude plugin install voicemode@voicemodeПосле установки выполните /voicemode:install для зависимостей и локальных сервисов, затем /voicemode:converse.
Это чужой код. Посмотрите файлы в репозитории перед установкой.
Что делает
VoiceMode добавляет агенту инструмент разговора: вы говорите в микрофон, агент отвечает голосом. Распознавание речи и синтез можно держать полностью локально через Whisper и Kokoro либо использовать облачные сервисы с OpenAI-совместимым API, переключение между ними прозрачное. Есть определение тишины, чтобы запись останавливалась, когда вы замолчали, и упор на низкую задержку ради ощущения живого диалога. Сервер ставится как плагин Claude Code или как MCP через uvx, работает на Linux, macOS и Windows, включая WSL. Пакет опубликован на PyPI под именем voice-mode.
Для кого. Для разработчиков, которым удобнее говорить с агентом, когда руки или глаза заняты.
Подходит, если
- Хотите вести диалог с Claude Code голосом, а не печатать
- Нужна работа с агентом без экрана: на ходу, за готовкой, при усталости глаз
- Нужен голосовой ввод и вывод без отправки звука в облако, полностью локально
Не подходит, если
- Нет микрофона или колонок, либо в среде нет доступа к звуку
- Нужен только текстовый ввод и голос не нужен
Пример запроса к агенту
Давай перейдем в голосовой режим и обсудим, как переписать этот модульОграничения
Нужны рабочие микрофон и колонки. Локальные сервисы речи требуют ffmpeg, portaudio и подобных зависимостей, а также место на диске и вычислительные ресурсы под модели. Облачный путь через OpenAI требует ключа и из России без VPN недоступен, локальный режим работает без него. В WSL2 для доступа к микрофону нужны пакеты pulseaudio.
Как отключить. Удалите плагин через /plugin или отключите MCP-сервер командой claude mcp remove voicemode. Локальные сервисы речи можно остановить и удалить отдельно.
MCP
- Транспорт
- stdio
- Авторизация
- не нужна
| Переменные окружения | |
|---|---|
| OPENAI_API_KEY секрет | Ключ OpenAI для облачного распознавания и синтеза речи, необязателен, локальный режим работает без него. |
Проверка безопасности
- Получает доступ к микрофону и воспроизводит звук на устройстве
- В облачном режиме отправляет аудио внешнему сервису распознавания и синтеза
- Устанавливает и запускает локальные сервисы речи
Коротко о README
README представляет VoiceMode как способ вести голосовой разговор с Claude Code и другими MCP-агентами. Быстрый старт предлагает два пути: плагин Claude Code через marketplace или установку Python-пакета и подключение MCP через uvx. Среди возможностей естественный диалог, работа офлайн с локальными сервисами речи, низкая задержка, определение тишины и выбор между локальным и облачным режимом. Отдельные разделы описывают системные зависимости по платформам, настройку прав, установку Whisper и Kokoro и типовые проблемы со звуком. Лицензия MIT, пакет на PyPI называется voice-mode.
Частые вопросы
Можно ли работать без интернета и без ключа OpenAI?
Да. С локальными Whisper и Kokoro распознавание и синтез идут на вашей машине. Ключ OpenAI нужен только для облачного пути и работает как запасной вариант.
С какими агентами это работает?
Основной путь это плагин для Claude Code, но сервер общается по протоколу MCP, поэтому подключается и к другим MCP-совместимым агентам.
Похожие
Самостоятельно размещаемая база знаний с блочными ссылками и встроенным MCP-сервером для подключения AI-агентов к заметкам
CLI для всех API Google Workspace с выводом в JSON и набором скиллов для агентов: Drive, Gmail, Calendar, Sheets и другие
Локальный поиск по заметкам, документации и расшифровкам встреч в Markdown: ключевые слова, смысловой поиск и ранжирование, есть MCP
Менеджер задач для AI-разработки: разбирает PRD на задачи с зависимостями и ведет агента по ним через MCP или CLI