1. 项目概述:低成本搭建私有有声书生成系统
作为一名长期沉迷有声读物的技术爱好者,我一直在寻找一个完美的本地化TTS(文本转语音)解决方案。市面上大多数在线TTS服务要么按字数收费,要么生成速度慢得令人发指,更别提那些机械感十足的合成音效了。经过多次尝试和踩坑,我终于找到了一套近乎完美的组合方案:基于EasyVoice和cpolar的私有有声书生成系统。
这套系统的核心优势在于:
- 完全免费:不受字数限制,无需订阅付费
- 极低功耗:可在树莓派、玩客云等低功耗设备运行
- 多角色支持:AI智能识别对话角色并分配不同音色
- 流式生成:超长文本也能即时播放,无需等待
- 公网访问:通过内网穿透实现随时随地使用
需要模型API调用? 免费领10W Token,多模型网关一键接入 Claude、DeepSeek 等主流模型。
2. 硬件准备与系统环境搭建
2.1 设备选型与考量
在选择硬件设备时,我主要考虑了以下几个因素:
- 功耗:作为需要24小时运行的服务,低功耗是首要考虑
- 性能:需要足够处理TTS任务的CPU能力
- 成本:尽可能降低初始投入
- 扩展性:支持Docker等容器化部署
经过对比,我最终选择了二手玩客云作为硬件平台:
- 价格:仅需50-80元(二手市场)
- 功耗:实测待机3W左右,满载不超过5W
- 性能:ARMv7架构,1.5GHz四核CPU,1GB内存
- 扩展性:支持刷入第三方系统运行Docker
提示:玩客云的ARMv7架构在软件兼容性上可能存在问题,这也是为什么我们需要特别选择适配了ARMv7的EasyVoice分支版本。
2.2 HiNas系统安装指南
原厂玩客云系统功能有限,我们需要先刷入HiNas系统以获得完整的Linux环境:
-
准备工作:
- 玩客云设备一台
- USB转TTL串口模块(用于调试)
- 网线、电源适配器
- 短接工具(如镊子)
-
刷机步骤:
- 拆机并短接特定触点进入刷机模式
- 使用USB Burning Tool刷入HiNas固件
- 配置网络和基础系统设置
-
系统初始化:
bash复制# 首次登录后修改默认密码
passwd
# 更新软件源
apt update && apt upgrade -y
# 安装基础工具
apt install -y vim curl wget git
完整刷机教程可参考:玩客云刷HiNas系统指南(注:此为示例链接,实际请参考可靠教程)
3. Docker环境配置与EasyVoice部署
3.1 Docker安装与优化
HiNas系统虽然提供了Docker安装选项,但为了获得更好的性能和兼容性,我推荐手动安装最新版Docker:
bash复制# 卸载旧版本(如有)
apt remove docker docker-engine docker.io containerd runc
# 安装依赖
apt install -y apt-transport-https ca-certificates curl gnupg lsb-release
# 添加Docker官方GPG密钥
curl -fsSL https://download.docker.com/linux/debian/gpg | gpg --dearmor -o /usr/share/keyrings/
