Guide

使用教程

从装好到开播,四步走完。中途遇到问题,看最后一节。

你需要准备三样东西 一台装了 Python 3.10+ 的电脑、一个能用的大模型 API Key、一段你自己说话的录音(5 秒以上)。
1

装依赖

在项目根目录执行一次。Windows 用户可以直接双击 install_windows.bat,效果一样。

bash
# 建虚拟环境并装上所有依赖
python -m venv .venv
.venv/Scripts/pip install -r requirements.txt
装完先确认 pip 走的是虚拟环境里的 后面所有命令都要用 .venv/Scripts/python.exe,用系统 python 会报「找不到模块」。
2

填密钥

复制模板后填进你的 Key。这个文件不会被提交到任何仓库。

.env
LLM_API_KEY=sk-你的密钥
LLM_BASE_URL=https://n.lconai.com/v1
LLM_MODEL=gpt-5.6-luna

控制台的设置页也能改这几项,但第一次最好直接改文件 —— 那时界面还打不开。

3

启动,登录控制台

起来之后打开提示的那个地址,第一次点「控制台」会要求登录。

bash
.venv/Scripts/python.exe main.py

# 看到这样就起来了:
#   🌐 Web 控制台: http://127.0.0.1:8765
#   ✅ 弹幕已连接
项值
地址http://127.0.0.1:8765
默认账号admin
默认密码admin369
存放位置config/auth.yaml
改密码请务必顺手改 默认账号是公开的。只要有机会从公网访问这台机器,第一步就该把它换掉。
4

接直播间,开播

控制台的设置页填上弹幕源地址(一般是 ws://127.0.0.1:8888),OBS 里把音频输出选到虚拟声卡,然后回直播页点「开播」。

你要做的事在哪个页面
填弹幕源地址设置 → 直播间
克隆音色、调情绪浓度声音
写人设、口头禅、语气样本人设
选输出设备、压 BGM音频
开播 / 停播直播
做封面、让封面动起来封面

做张封面(不着急,可以最后再做)

开播前想挂一张好看的封面时用它。跟直播那条链路互不影响 —— 不做也能正常开播。

先去设置 → 封面 填两把钥匙 一把是出图的、一把是做视频的。不填的话按钮会明确告诉你"还没填 key",不会默默失败。
你想做什么怎么用
出一张封面写一句今晚想聊什么 → 点「帮我写一句」→ 选尺寸 → 出封面
让它更像你想要的拖几张参考图进虚线框,再出一次
要动起来的版本在结果卡片上点「让它动起来」,写一句要它怎么动
翻上周那张切到这个页面就自动列出来了
视频一般要等 1~10 分钟 这是模型本身的速度,不是卡住了。页面会显示进度,先把页面开着就行。
FAQ

出问题先看这里

主播一直不说话

先看日志面板里有没有 收到 X 条互动。没有的话是弹幕没连上 —— 确认直播伴侣在跑、端口对不对。有的话说明它在判断「这会儿没必要开口」,这是正常行为,调低人设里的沉默阈值即可。

声音听着很假 / 太夸张

八成是情感浓度太高。到「声音」页把「情感浓度」往下拉,0.6 是官方推荐的起点。另外确认「声音修饰」是关着的 —— 一旦动了语速和音高,就会立刻变成变声器。

第一句话要等很久

首次合成要 5~15 秒,之后都是缓存。开播前会自动预热常用短句。如果每次都很慢,检查 cache/ 目录是否可写 —— 磁盘缓存写不进去就只能每次重新合成。

忘密码 / 登不进去

把 config/auth.yaml 删掉重启,会自动重建一份默认账号。连续输错 8 次会锁 60 秒,这是防爆破的,等一会儿自动解除。

点了「出封面」没反应

设置 → 封面填出图的那一把(视频是另一把,做动图时才需要)。 填了还不行就看日志面板最后几行 —— 接口的错误会原样写在那里,通常是余额或者参数不支持。

做出来的视频里画面变了

那不是你想要的「活图」。重写一句运镜提示词,重点写 「镜头几乎别动,只让灯光慢慢呼吸」这类要求 —— 系统自己也会把"构图不许变"的规矩写在提示词最后,但你说得越具体越稳。

准备好了?

剩下的调整都在控制台里,改完不用重启。