Voice Mode
VoiceMode
Естественные голосовые диалоги с Claude Code (и другими агентами, поддерживающими MCP)
VoiceMode позволяет вести естественные голосовые диалоги с Claude Code. Голос — это не замена печати, а способ взаимодействия, когда печатать неудобно.
Идеально подходит для:
Прогулки на следующую встречу
Приготовления еды во время отладки кода
Отдыха для глаз после долгих часов работы за экраном
Ситуаций, когда вы держите чашку кофе (или собаку)
Любого момента, когда ваши руки или глаза заняты
Демонстрация

Related MCP server: Voice Call MCP Server
Быстрый старт
Требования: Компьютер с микрофоном и динамиками
Вариант 1: Плагин Claude Code (рекомендуется)
Самый быстрый способ начать работу для пользователей Claude Code:
# Add the VoiceMode marketplace
claude plugin marketplace add mbailey/voicemode
# Install VoiceMode plugin
claude plugin install voicemode@voicemode
## Install dependencies (CLI, Local Voice Services)
/voicemode:install
# Start talking!
/voicemode:converseВариант 2: Установщик Python
Устанавливает зависимости и пакет VoiceMode для Python.
# Install UV package manager (if needed)
curl -LsSf https://astral.sh/uv/install.sh | sh
# Run the installer (sets up dependencies and local voice services)
uvx voice-mode-install
# Add to Claude Code
claude mcp add --scope user voicemode -- uvx --refresh voice-mode
# Optional: Add OpenAI API key as fallback for local services
export OPENAI_API_KEY=your-openai-key
# Start a conversation
claude converseДля ручной настройки см. Руководство по началу работы.
Возможности
Естественные диалоги — говорите как обычно, получайте ответы мгновенно
Работа офлайн — опциональные локальные голосовые сервисы (Whisper STT, Kokoro TTS)
Низкая задержка — достаточно быстро, чтобы ощущалось как живой разговор
Умное определение тишины — прекращает запись, когда вы перестаете говорить
Настройки конфиденциальности — работайте полностью локально или используйте облачные сервисы
Совместимость
Платформы: Linux, macOS, Windows (WSL), NixOS Python: 3.10-3.14
Конфигурация
VoiceMode работает сразу после установки. Для настройки:
# Set OpenAI API key (if using cloud services)
export OPENAI_API_KEY="your-key"
# Or configure via file
voicemode config editСм. Руководство по конфигурации для просмотра всех параметров.
Настройка разрешений (опционально)
Чтобы использовать VoiceMode без запросов на разрешение, добавьте в ~/.claude/settings.json:
{
"permissions": {
"allow": [
"mcp__voicemode__converse",
"mcp__voicemode__service"
]
}
}См. Руководство по разрешениям для получения дополнительной информации.
Локальные голосовые сервисы
Для обеспечения конфиденциальности или работы офлайн установите локальные речевые сервисы:
Whisper.cpp — локальное распознавание речи (STT)
Kokoro — локальный синтез речи (TTS) с поддержкой нескольких голосов
Они предоставляют тот же API, что и OpenAI, поэтому VoiceMode легко переключается между ними.
Детали установки
Ubuntu/Debian
sudo apt update
sudo apt install -y ffmpeg gcc libasound2-dev libasound2-plugins libportaudio2 portaudio19-dev pulseaudio pulseaudio-utils python3-devПользователи WSL2: пакеты pulseaudio выше необходимы для доступа к микрофону.
Fedora/RHEL
sudo dnf install alsa-lib-devel ffmpeg gcc portaudio portaudio-devel python3-develmacOS
brew install ffmpeg node portaudioNixOS
# Use development shell
nix develop github:mbailey/voicemode
# Or install system-wide
nix profile install github:mbailey/voicemodeИз исходного кода
git clone https://github.com/mbailey/voicemode.git
cd voicemode
uv tool install -e .Системная установка в NixOS
# In /etc/nixos/configuration.nix
environment.systemPackages = [
(builtins.getFlake "github:mbailey/voicemode").packages.${pkgs.system}.default
];Устранение неполадок
Проблема | Решение |
Нет доступа к микрофону | Проверьте разрешения терминала/приложения. WSL2 требует пакеты pulseaudio. |
UV не найден | Запустите |
Ошибка OpenAI API | Убедитесь, что |
Нет вывода звука | Проверьте системные настройки звука и доступные устройства |
Сохранение аудио для отладки
export VOICEMODE_SAVE_AUDIO=true
# Files saved to ~/.voicemode/audio/YYYY/MM/Документация
Начало работы — полное руководство по настройке
Конфигурация — все переменные окружения
Настройка Whisper — локальное распознавание речи
Настройка Kokoro — локальный синтез речи
Настройка для разработки — руководство для контрибьюторов
Полная документация: voice-mode.readthedocs.io
Ссылки
Веб-сайт: getvoicemode.com
GitHub: github.com/mbailey/voicemode
YouTube: @getvoicemode
Twitter/X: @getvoicemode
Рассылка:
Лицензия
MIT — проект Failmode
mcp-name: com.failmode/voicemode
Tool Schema Changelog
Recent tool additions, removals, and schema changes observed during successful MCP inspections. Dates show when Glama detected each change.
No tool schema history has been recorded yet.
This server cannot be installed
Maintenance
Resources
Unclaimed servers have limited discoverability.
Looking for Admin?
If you are the server author, to access and configure the admin panel.
Related MCP Connectors
A comprehensive Model Context Protocol (MCP) server that enables AI assistants to interact with yo…
- QuallaaOAuthcom.quallaa
Talk to your public-facing AI from any MCP client — Claude, ChatGPT, Cursor, Cline, Windsurf.
AI voice generation: text-to-speech and voice cloning from any MCP client.
Build and manage AI-native customer support agents from Claude or any MCP client.
Related MCP Servers
- AlicenseNot gradedqualityCmaintenanceA Model Context Protocol server that integrates high-quality text-to-speech capabilities with Claude Desktop and other MCP-compatible clients, supporting multiple voice options and audio formats.171MIT
- AlicenseNot gradedqualityDmaintenanceA Model Context Protocol server that enables AI assistants like Claude to initiate and manage real-time voice calls using Twilio and OpenAI's voice models.61MIT
- AlicenseBqualityFmaintenanceAn MCP (Model Context Protocol) server that provides seamless integration between Fish Audio's Text-to-Speech API and LLMs like Claude, enabling natural language-driven speech synthesis.24713MIT
- FlicenseNot gradedqualityNot gradedmaintenanceA local voice interface providing high-performance speech recognition and natural text-to-speech with voice cloning capabilities. It enables AI assistants to speak, listen, and engage in character-based voice conversations through integrated MCP tools.-
Appeared in Searches
Latest Blog Posts
- Who's Calling? MCP Hosts Are an Identity Blind Spot (And the Spec Knows It)By Om-Shree-0709 on .mcpAgent IdentityOAuth 2.1
- Your AI Chatbot Just Exposed Your CEO's Salary to an InternBy Om-Shree-0709 on .Agent IdentityMCP SecurityOAuth Delegation
- Why MCP Servers Need Execution Sandboxing (And Why Your Current Stack Isn't Enough)By Om-Shree-0709 on .Agentic AiPrompt InjectionWebAssembly
MCP directory API
We provide all the information about MCP servers via our MCP API.
curl -X GET 'https://glama.ai/api/mcp/v1/servers/mbailey/voicemode'
If you have feedback or need assistance with the MCP directory API, please join our Discord server