VoiceMode

MCP-сервер для голосового разговора с Claude Code и другими MCP-агентами: распознавание речи и синтез голоса, локально или через облако

MCP-серверОфициальный

Средний риск

Средний уровень ставим, когда инструмент запускает код, ходит в сеть или читает файлы проекта. Перед установкой посмотрите, что именно он делает.

Почему такой уровень

  • Получает доступ к микрофону и воспроизводит звук на устройстве
  • В облачном режиме отправляет аудио внешнему сервису распознавания и синтеза
  • Устанавливает и запускает локальные сервисы речи
Все причины и проверки

mbailey/voicemode

Установка

В терминале, через SkillFoxx CLI

npx skillfoxx add mcp/voicemode

Определит агенты на машине, проверит риск и зафиксирует версию.

Другие способы установки

Выполните в терминале

claude mcp add --transport stdio voicemode -- uvx voice-mode==8.12.0

Или добавьте в файл .mcp.json, в проекте

{
  "mcpServers": {
    "voicemode": {
      "command": "uvx",
      "args": [
        "voice-mode==8.12.0"
      ]
    }
  }
}

Если файл уже есть, добавьте сервер внутрь ключа mcpServers.

Ключи и настройки

OPENAI_API_KEYсекрет, необязательная
OpenAI API key for cloud-based STT/TTS (optional - local services can be installed)
VOICEMODE_DEBUGнеобязательная
Enable debug mode with detailed logging (true/false)
VOICEMODE_SKIP_TTSнеобязательная
Skip TTS and show text only for faster response (true/false)
VOICEMODE_PREFER_LOCALнеобязательная
Prefer local services over cloud when available (true/false, default: true)
VOICEMODE_AUDIO_FORMATнеобязательная
Audio format: pcm, mp3, wav, flac, aac, opus (default: pcm)
VOICEMODE_WHISPER_MODELнеобязательная
Whisper model: tiny, base, small, medium, large (default: base)
VOICEMODE_DISABLE_SILENCE_DETECTIONнеобязательная
Disable silence detection for continuous recording (true/false)

Замените значения в угловых скобках своими. Ключи не попадают в ссылки установки и не хранятся у нас.

Установить в Cursor

Кнопка откроет агент и предложит добавить сервер. Если ничего не произошло, скопируйте конфиг ниже.

Добавьте в файл ~/.cursor/mcp.json, для всех проектов

{
  "mcpServers": {
    "voicemode": {
      "command": "uvx",
      "args": [
        "voice-mode==8.12.0"
      ]
    }
  }
}

Если файл уже есть, добавьте сервер внутрь ключа mcpServers. Для одного проекта тот же блок кладут в .cursor/mcp.json.

Ключи и настройки

OPENAI_API_KEYсекрет, необязательная
OpenAI API key for cloud-based STT/TTS (optional - local services can be installed)
VOICEMODE_DEBUGнеобязательная
Enable debug mode with detailed logging (true/false)
VOICEMODE_SKIP_TTSнеобязательная
Skip TTS and show text only for faster response (true/false)
VOICEMODE_PREFER_LOCALнеобязательная
Prefer local services over cloud when available (true/false, default: true)
VOICEMODE_AUDIO_FORMATнеобязательная
Audio format: pcm, mp3, wav, flac, aac, opus (default: pcm)
VOICEMODE_WHISPER_MODELнеобязательная
Whisper model: tiny, base, small, medium, large (default: base)
VOICEMODE_DISABLE_SILENCE_DETECTIONнеобязательная
Disable silence detection for continuous recording (true/false)

Замените значения в угловых скобках своими. Ключи не попадают в ссылки установки и не хранятся у нас.

Установить в VS Code

Кнопка откроет агент и предложит добавить сервер. Если ничего не произошло, скопируйте конфиг ниже.

Выполните в терминале

code --add-mcp '{"name":"voicemode","type":"stdio","command":"uvx","args":["voice-mode==8.12.0"]}'

Или добавьте в файл .vscode/mcp.json, в проекте

{
  "servers": {
    "voicemode": {
      "type": "stdio",
      "command": "uvx",
      "args": [
        "voice-mode==8.12.0"
      ]
    }
  }
}

Если файл уже есть, добавьте сервер внутрь ключа servers.

Ключи и настройки

OPENAI_API_KEYсекрет, необязательная
OpenAI API key for cloud-based STT/TTS (optional - local services can be installed)
VOICEMODE_DEBUGнеобязательная
Enable debug mode with detailed logging (true/false)
VOICEMODE_SKIP_TTSнеобязательная
Skip TTS and show text only for faster response (true/false)
VOICEMODE_PREFER_LOCALнеобязательная
Prefer local services over cloud when available (true/false, default: true)
VOICEMODE_AUDIO_FORMATнеобязательная
Audio format: pcm, mp3, wav, flac, aac, opus (default: pcm)
VOICEMODE_WHISPER_MODELнеобязательная
Whisper model: tiny, base, small, medium, large (default: base)
VOICEMODE_DISABLE_SILENCE_DETECTIONнеобязательная
Disable silence detection for continuous recording (true/false)

Замените значения в угловых скобках своими. Ключи не попадают в ссылки установки и не хранятся у нас.

Выполните в терминале

codex mcp add voicemode -- uvx voice-mode==8.12.0

Или добавьте в файл ~/.codex/config.toml, для всех проектов

[mcp_servers.voicemode]
command = "uvx"
args = ["voice-mode==8.12.0"]

Если файл уже есть, допишите блок в конец.

Ключи и настройки

OPENAI_API_KEYсекрет, необязательная
OpenAI API key for cloud-based STT/TTS (optional - local services can be installed)
VOICEMODE_DEBUGнеобязательная
Enable debug mode with detailed logging (true/false)
VOICEMODE_SKIP_TTSнеобязательная
Skip TTS and show text only for faster response (true/false)
VOICEMODE_PREFER_LOCALнеобязательная
Prefer local services over cloud when available (true/false, default: true)
VOICEMODE_AUDIO_FORMATнеобязательная
Audio format: pcm, mp3, wav, flac, aac, opus (default: pcm)
VOICEMODE_WHISPER_MODELнеобязательная
Whisper model: tiny, base, small, medium, large (default: base)
VOICEMODE_DISABLE_SILENCE_DETECTIONнеобязательная
Disable silence detection for continuous recording (true/false)

Замените значения в угловых скобках своими. Ключи не попадают в ссылки установки и не хранятся у нас.

Выполните в терминале

gemini mcp add -s user voicemode uvx voice-mode==8.12.0

Или добавьте в файл ~/.gemini/settings.json, для всех проектов

{
  "mcpServers": {
    "voicemode": {
      "command": "uvx",
      "args": [
        "voice-mode==8.12.0"
      ]
    }
  }
}

Если файл уже есть, добавьте сервер внутрь ключа mcpServers.

Ключи и настройки

OPENAI_API_KEYсекрет, необязательная
OpenAI API key for cloud-based STT/TTS (optional - local services can be installed)
VOICEMODE_DEBUGнеобязательная
Enable debug mode with detailed logging (true/false)
VOICEMODE_SKIP_TTSнеобязательная
Skip TTS and show text only for faster response (true/false)
VOICEMODE_PREFER_LOCALнеобязательная
Prefer local services over cloud when available (true/false, default: true)
VOICEMODE_AUDIO_FORMATнеобязательная
Audio format: pcm, mp3, wav, flac, aac, opus (default: pcm)
VOICEMODE_WHISPER_MODELнеобязательная
Whisper model: tiny, base, small, medium, large (default: base)
VOICEMODE_DISABLE_SILENCE_DETECTIONнеобязательная
Disable silence detection for continuous recording (true/false)

Замените значения в угловых скобках своими. Ключи не попадают в ссылки установки и не хранятся у нас.

Добавьте в файл ~/.config/devin/mcp_config.json, для всех проектов

{
  "mcpServers": {
    "voicemode": {
      "command": "uvx",
      "args": [
        "voice-mode==8.12.0"
      ]
    }
  }
}

Если файл уже есть, добавьте сервер внутрь ключа mcpServers. В легаси Cascade конфиг MCP лежит в ~/.codeium/windsurf/mcp_config.json.

Ключи и настройки

OPENAI_API_KEYсекрет, необязательная
OpenAI API key for cloud-based STT/TTS (optional - local services can be installed)
VOICEMODE_DEBUGнеобязательная
Enable debug mode with detailed logging (true/false)
VOICEMODE_SKIP_TTSнеобязательная
Skip TTS and show text only for faster response (true/false)
VOICEMODE_PREFER_LOCALнеобязательная
Prefer local services over cloud when available (true/false, default: true)
VOICEMODE_AUDIO_FORMATнеобязательная
Audio format: pcm, mp3, wav, flac, aac, opus (default: pcm)
VOICEMODE_WHISPER_MODELнеобязательная
Whisper model: tiny, base, small, medium, large (default: base)
VOICEMODE_DISABLE_SILENCE_DETECTIONнеобязательная
Disable silence detection for continuous recording (true/false)

Замените значения в угловых скобках своими. Ключи не попадают в ссылки установки и не хранятся у нас.

Бывший Windsurf.

Добавьте в файл cline_mcp_settings.json, для всех проектов

{
  "mcpServers": {
    "voicemode": {
      "command": "uvx",
      "args": [
        "voice-mode==8.12.0"
      ]
    }
  }
}

Если файл уже есть, добавьте сервер внутрь ключа mcpServers. Файл настроек открывается в Cline: вкладка MCP Servers, кнопка Configure MCP Servers.

Ключи и настройки

OPENAI_API_KEYсекрет, необязательная
OpenAI API key for cloud-based STT/TTS (optional - local services can be installed)
VOICEMODE_DEBUGнеобязательная
Enable debug mode with detailed logging (true/false)
VOICEMODE_SKIP_TTSнеобязательная
Skip TTS and show text only for faster response (true/false)
VOICEMODE_PREFER_LOCALнеобязательная
Prefer local services over cloud when available (true/false, default: true)
VOICEMODE_AUDIO_FORMATнеобязательная
Audio format: pcm, mp3, wav, flac, aac, opus (default: pcm)
VOICEMODE_WHISPER_MODELнеобязательная
Whisper model: tiny, base, small, medium, large (default: base)
VOICEMODE_DISABLE_SILENCE_DETECTIONнеобязательная
Disable silence detection for continuous recording (true/false)

Замените значения в угловых скобках своими. Ключи не попадают в ссылки установки и не хранятся у нас.

Добавьте в файл .roo/mcp.json, в проекте

{
  "mcpServers": {
    "voicemode": {
      "command": "uvx",
      "args": [
        "voice-mode==8.12.0"
      ]
    }
  }
}

Если файл уже есть, добавьте сервер внутрь ключа mcpServers.

Ключи и настройки

OPENAI_API_KEYсекрет, необязательная
OpenAI API key for cloud-based STT/TTS (optional - local services can be installed)
VOICEMODE_DEBUGнеобязательная
Enable debug mode with detailed logging (true/false)
VOICEMODE_SKIP_TTSнеобязательная
Skip TTS and show text only for faster response (true/false)
VOICEMODE_PREFER_LOCALнеобязательная
Prefer local services over cloud when available (true/false, default: true)
VOICEMODE_AUDIO_FORMATнеобязательная
Audio format: pcm, mp3, wav, flac, aac, opus (default: pcm)
VOICEMODE_WHISPER_MODELнеобязательная
Whisper model: tiny, base, small, medium, large (default: base)
VOICEMODE_DISABLE_SILENCE_DETECTIONнеобязательная
Disable silence detection for continuous recording (true/false)

Замените значения в угловых скобках своими. Ключи не попадают в ссылки установки и не хранятся у нас.

Форк Roo Code, папки .roo те же.

Добавьте в файл opencode.json, в проекте

{
  "mcp": {
    "voicemode": {
      "type": "local",
      "command": [
        "uvx",
        "voice-mode==8.12.0"
      ]
    }
  }
}

Если файл уже есть, добавьте сервер внутрь ключа mcp.

Ключи и настройки

OPENAI_API_KEYсекрет, необязательная
OpenAI API key for cloud-based STT/TTS (optional - local services can be installed)
VOICEMODE_DEBUGнеобязательная
Enable debug mode with detailed logging (true/false)
VOICEMODE_SKIP_TTSнеобязательная
Skip TTS and show text only for faster response (true/false)
VOICEMODE_PREFER_LOCALнеобязательная
Prefer local services over cloud when available (true/false, default: true)
VOICEMODE_AUDIO_FORMATнеобязательная
Audio format: pcm, mp3, wav, flac, aac, opus (default: pcm)
VOICEMODE_WHISPER_MODELнеобязательная
Whisper model: tiny, base, small, medium, large (default: base)
VOICEMODE_DISABLE_SILENCE_DETECTIONнеобязательная
Disable silence detection for continuous recording (true/false)

Замените значения в угловых скобках своими. Ключи не попадают в ссылки установки и не хранятся у нас.

Добавьте в файл ~/.config/zed/settings.json, для всех проектов

{
  "context_servers": {
    "voicemode": {
      "command": "uvx",
      "args": [
        "voice-mode==8.12.0"
      ]
    }
  }
}

Если файл уже есть, добавьте сервер внутрь ключа context_servers.

Ключи и настройки

OPENAI_API_KEYсекрет, необязательная
OpenAI API key for cloud-based STT/TTS (optional - local services can be installed)
VOICEMODE_DEBUGнеобязательная
Enable debug mode with detailed logging (true/false)
VOICEMODE_SKIP_TTSнеобязательная
Skip TTS and show text only for faster response (true/false)
VOICEMODE_PREFER_LOCALнеобязательная
Prefer local services over cloud when available (true/false, default: true)
VOICEMODE_AUDIO_FORMATнеобязательная
Audio format: pcm, mp3, wav, flac, aac, opus (default: pcm)
VOICEMODE_WHISPER_MODELнеобязательная
Whisper model: tiny, base, small, medium, large (default: base)
VOICEMODE_DISABLE_SILENCE_DETECTIONнеобязательная
Disable silence detection for continuous recording (true/false)

Замените значения в угловых скобках своими. Ключи не попадают в ссылки установки и не хранятся у нас.

Добавьте в файл .codeassistant/mcp.json, в проекте

{
  "mcpServers": {
    "voicemode": {
      "command": "uvx",
      "args": [
        "voice-mode==8.12.0"
      ]
    }
  }
}

Если файл уже есть, добавьте сервер внутрь ключа mcpServers.

Ключи и настройки

OPENAI_API_KEYсекрет, необязательная
OpenAI API key for cloud-based STT/TTS (optional - local services can be installed)
VOICEMODE_DEBUGнеобязательная
Enable debug mode with detailed logging (true/false)
VOICEMODE_SKIP_TTSнеобязательная
Skip TTS and show text only for faster response (true/false)
VOICEMODE_PREFER_LOCALнеобязательная
Prefer local services over cloud when available (true/false, default: true)
VOICEMODE_AUDIO_FORMATнеобязательная
Audio format: pcm, mp3, wav, flac, aac, opus (default: pcm)
VOICEMODE_WHISPER_MODELнеобязательная
Whisper model: tiny, base, small, medium, large (default: base)
VOICEMODE_DISABLE_SILENCE_DETECTIONнеобязательная
Disable silence detection for continuous recording (true/false)

Замените значения в угловых скобках своими. Ключи не попадают в ссылки установки и не хранятся у нас.

Понадобится: uv

Сверено с репозиторием 25 сент. 2026, коммит 126d15e.

Текст для агента

Для Claude Code: claude plugin marketplace add mbailey/voicemode, затем claude plugin install voicemode@voicemode, потом /voicemode:install и /voicemode:converse. Как MCP: uvx voice-mode-install, затем claude mcp add --scope user voicemode -- uvx --refresh --from voice-mode voicemode-mcp-launcher.

Другие способы из описания автора
claude plugin marketplace add mbailey/voicemode
claude plugin install voicemode@voicemode

После установки выполните /voicemode:install для зависимостей и локальных сервисов, затем /voicemode:converse.

Это чужой код. Посмотрите файлы в репозитории перед установкой.

Что делает

VoiceMode добавляет агенту инструмент разговора: вы говорите в микрофон, агент отвечает голосом. Распознавание речи и синтез можно держать полностью локально через Whisper и Kokoro либо использовать облачные сервисы с OpenAI-совместимым API, переключение между ними прозрачное. Есть определение тишины, чтобы запись останавливалась, когда вы замолчали, и упор на низкую задержку ради ощущения живого диалога. Сервер ставится как плагин Claude Code или как MCP через uvx, работает на Linux, macOS и Windows, включая WSL. Пакет опубликован на PyPI под именем voice-mode.

Для кого. Для разработчиков, которым удобнее говорить с агентом, когда руки или глаза заняты.

Подходит, если

  • Хотите вести диалог с Claude Code голосом, а не печатать
  • Нужна работа с агентом без экрана: на ходу, за готовкой, при усталости глаз
  • Нужен голосовой ввод и вывод без отправки звука в облако, полностью локально

Не подходит, если

  • Нет микрофона или колонок, либо в среде нет доступа к звуку
  • Нужен только текстовый ввод и голос не нужен

Пример запроса к агенту

Давай перейдем в голосовой режим и обсудим, как переписать этот модуль

Ограничения

Нужны рабочие микрофон и колонки. Локальные сервисы речи требуют ffmpeg, portaudio и подобных зависимостей, а также место на диске и вычислительные ресурсы под модели. Облачный путь через OpenAI требует ключа и из России без VPN недоступен, локальный режим работает без него. В WSL2 для доступа к микрофону нужны пакеты pulseaudio.

Как отключить. Удалите плагин через /plugin или отключите MCP-сервер командой claude mcp remove voicemode. Локальные сервисы речи можно остановить и удалить отдельно.

MCP

Транспорт
stdio
Авторизация
не нужна
Переменные окружения
Переменные окружения
OPENAI_API_KEY
секрет
Ключ OpenAI для облачного распознавания и синтеза речи, необязателен, локальный режим работает без него.

Проверка безопасности

  • Получает доступ к микрофону и воспроизводит звук на устройстве
  • В облачном режиме отправляет аудио внешнему сервису распознавания и синтеза
  • Устанавливает и запускает локальные сервисы речи

Коротко о README

README представляет VoiceMode как способ вести голосовой разговор с Claude Code и другими MCP-агентами. Быстрый старт предлагает два пути: плагин Claude Code через marketplace или установку Python-пакета и подключение MCP через uvx. Среди возможностей естественный диалог, работа офлайн с локальными сервисами речи, низкая задержка, определение тишины и выбор между локальным и облачным режимом. Отдельные разделы описывают системные зависимости по платформам, настройку прав, установку Whisper и Kokoro и типовые проблемы со звуком. Лицензия MIT, пакет на PyPI называется voice-mode.

Частые вопросы

Можно ли работать без интернета и без ключа OpenAI?

Да. С локальными Whisper и Kokoro распознавание и синтез идут на вашей машине. Ключ OpenAI нужен только для облачного пути и работает как запасной вариант.

С какими агентами это работает?

Основной путь это плагин для Claude Code, но сервер общается по протоколу MCP, поэтому подключается и к другим MCP-совместимым агентам.

Официальный

Самостоятельно размещаемая база знаний с блочными ссылками и встроенным MCP-сервером для подключения AI-агентов к заметкам

MCP-серверСредний риск46,5 тыс.Звезды репозитория
Выбор редакции

CLI для всех API Google Workspace с выводом в JSON и набором скиллов для агентов: Drive, Gmail, Calendar, Sheets и другие

CLIВысокий риск31,2 тыс.Звезды репозитория
Выбор редакции

Локальный поиск по заметкам, документации и расшифровкам встреч в Markdown: ключевые слова, смысловой поиск и ранжирование, есть MCP

CLIСредний рискБез VPN30,1 тыс.Звезды репозитория
Выбор редакции

Менеджер задач для AI-разработки: разбирает PRD на задачи с зависимостями и ведет агента по ним через MCP или CLI

MCP-серверСредний риск28,1 тыс.Звезды репозитория
Foxx AIVoiceMode

Я Foxx AI и уже разобрал этот инструмент. Спросите про установку, настройку или что угодно еще, отвечу простыми словами.