voice-assistant安装教程:5分钟搞定Python语音助手环境配置
·
voice-assistant安装教程:5分钟搞定Python语音助手环境配置
voice-assistant是一个简单的Python脚本,能够让你通过语音与本地大语言模型进行对话,打造专属的语音交互体验。本教程将带你快速完成环境配置,轻松开启智能语音助手之旅。
📋 准备工作:系统与依赖检查
在开始安装前,请确保你的系统满足以下要求:
- Python 3.8及以上版本
- 足够的存储空间(至少10GB,用于存放模型文件)
- 支持麦克风输入的设备
🔄 第一步:获取项目代码
首先,克隆voice-assistant项目到本地:
git clone https://gitcode.com/gh_mirrors/vo/voice-assistant
cd voice-assistant
📦 第二步:安装依赖包
项目依赖已整理在requirements.txt中,包含了torch、langchain、whisper等核心组件。通过以下命令一键安装:
pip install -r requirements.txt
🎤 第三步:麦克风配置
- 运行麦克风检测工具,查看可用设备列表:
python tools/list_microphones.py
- 编辑main.py文件,设置正确的麦克风索引(第29行):
MIC_IDX = 0 # 将0替换为你的麦克风设备ID
🧠 第四步:模型准备
voice-assistant需要两个关键模型文件:
- 语音识别模型:Whisper Large V3
- 对话模型:LlamaCpp兼容模型(如yi-34b-chat.Q8_0.gguf)
- 创建模型存放目录:
mkdir -p models
-
下载模型文件并放入
models目录(模型下载链接需自行获取) -
配置模型路径(main.py第19-20行):
WHISP_PATH = "models/whisper-large-v3"
MODEL_PATH = "models/yi-34b-chat.Q8_0.gguf"
🌐 第五步:语言设置
根据需要修改main.py第15行的语言配置:
LANG = "CN" # CN表示中文,EN表示英文
🚀 启动语音助手
一切准备就绪!运行主程序开始体验:
python main.py
程序启动后会显示"Listening...",此时你可以开始说话,语音助手会自动识别并生成回应。
❗ 常见问题解决
- 麦克风无法使用:检查麦克风权限,确保main.py中的MIC_IDX设置正确
- 模型加载失败:确认模型文件路径正确,且模型文件完整
- 依赖安装错误:尝试使用虚拟环境或更新pip版本
📚 扩展学习
- 查看prompts/example-cn.txt和prompts/example-en.txt了解提示词模板
- 探索whisper/目录下的语音处理模块源码
- 调整main.py中的录音参数(第23-28行)优化识别效果
通过以上步骤,你已经成功搭建了voice-assistant语音助手环境。现在,你可以通过语音与本地大语言模型进行自然对话,享受便捷的智能交互体验!
更多推荐



所有评论(0)