M

MCP录音转录服务器

启用从麦克风录制音频并使用 OpenAI 的 Whisper 模型进行转录的功能。它既可以作为独立的 MCP 服务器运行,也可以作为 Goose AI 代理的扩展。

speech-processing

44 查看 · 2026-07-07 更新

简介

启用从麦克风录制音频并使用 OpenAI 的 Whisper 模型进行转录的功能。它既可以作为独立的 MCP 服务器运行,也可以作为 Goose AI 代理的扩展。

简介

启用从麦克风录制音频并使用 OpenAI 的 Whisper 模型进行转录的功能。它既可以作为独立的 MCP 服务器运行,也可以作为 Goose AI 代理的扩展。

语音记录 MCP 服务器

一个用于录音并使用 OpenAI 的 Whisper 模型进行转录的 MCP 服务器。设计为可以作为 Goose 自定义扩展或独立的 MCP 服务器运行。

功能

  • 从默认麦克风录制音频
  • 使用 Whisper 进行转录
  • 作为自定义扩展与 Goose AI 代理集成
  • 包含常见录音场景的提示

安装

# Install from source git clone https://github.com/DefiBax/voice-recorder-mcp.git cd voice-recorder-mcp pip install -e .

使用方法

作为独立的 MCP 服务器

# Run with default settings (base.en model) voice-recorder-mcp # Use a specific Whisper model voice-recorder-mcp --model medium.en # Adjust sample rate voice-recorder-mcp --sample-rate 44100

使用 MCP Inspector 测试

MCP Inspector 提供了一个交互界面来测试您的服务器:

# Install the MCP Inspector npm install -g @modelcontextprotocol/inspector # Run your server with the inspector npx @modelcontextprotocol/inspector voice-recorder-mcp

与 Goose AI 代理一起使用

  1. 打开 Goose 并进入设置 > 扩展 > 添加 > 命令行扩展

  2. 将名称设置为 voice-recorder

  3. 在命令字段中,输入 voice-recorder-mcp 可执行文件的完整路径:

    /full/path/to/voice-recorder-mcp
    

    或者对于特定模型:

    /full/path/to/voice-recorder-mcp --model medium.en
    

    要找到路径,请运行:

    which voice-recorder-mcp
  4. 对于基本功能不需要环境变量

  5. 开始与 Goose 的对话,并通过以下方式介绍录音机: "我希望你根据 voice-recorder 返回的转录内容采取行动。例如,如果我口述一个计算如 1+1,请返回结果。"

可用工具

  • start_recording:开始从默认麦克风录制音频
  • stop_and_transcribe:停止录制并将音频转录为文本
  • record_and_transcribe:录制指定时长的音频并将其转录

Whisper 模型

此扩展支持多种大小的 Whisper 模型:

模型速度准确性内存占用用例
tiny.en最快最低最小测试、快速转录
base.en日常使用(默认)
small.en中等更好适中良好的平衡
medium.en重要录音
large最慢最高非常高关键转录

.en 后缀表示专门针对英语的模型,这些模型在处理英语内容时更快更准确。

要求

  • Python 3.12+
  • 音频输入设备(麦克风)

配置

您可以使用环境变量配置服务器:

# Set Whisper model export WHISPER_MODEL=small.en # Set audio sample rate export SAMPLE_RATE=44100 # Set maximum recording duration (seconds) export MAX_DURATION=120 # Then run the server voice-recorder-mcp

故障排除

常见问题

  • 没有录制到音频:检查您的麦克风权限和设置
  • 模型下载错误:确保初始模型下载时有稳定的互联网连接
  • 与 Goose 集成:确保命令路径正确
  • 音频质量问题:尝试调整采样率(默认:16000)

贡献

欢迎贡献!请随时提交 Pull Request。

  1. Fork 仓库
  2. 创建你的特性分支 (git checkout -b feature/amazing-feature)
  3. 提交你的更改 (git commit -m '添加一些惊人的功能')
  4. 推送到分支 (git push origin feature/amazing-feature)
  5. 打开一个 Pull Request

许可证

本项目采用 MIT 许可证进行许可 - 详情请参阅 LICENSE 文件。

来源