Docs

使用文档

从登录到会议软件里出画面,以及 GPU 端安装、管理后台与常见问题。页面右侧内容按左侧目录组织。

快速开始

  1. 登录:用管理员发给你的账号在 登录页 登录。
  2. 进入网页版https://fs.hawkmind.ai/app。页面会先为你分配一台 GPU(顶栏状态从「正在分配 GPU…」变成「GPU 已就绪」)。没有空闲 GPU 时会明确提示原因。
  3. 允许摄像头:首次浏览器会询问摄像头权限,点「允许」。顶栏下拉可选具体摄像头(虚拟摄像头会标注出来,别选它)。
  4. 选人设与背景:右侧「人设」页签点头像即切换,上传正脸照可新增;带「模型」角标的是专属训练模型,整张脸都换成该人物。「背景」页签同理。
  5. 点「开始」:几秒后主画面出现换脸后的结果,右下小窗是原始摄像头。
画面延迟约 0.3–0.5 秒属正常;帧率、单帧耗时、上行码率等指标在画面下方实时显示,反馈问题时截图即可定位。

网页版

网页版把摄像头画面通过 WebRTC 发到 GPU 节点处理后回传,适合看效果、调参数、手机/平板使用。要求:Chrome / Edge / Safari 较新版本,HTTPS(本站已提供)。

人设与专属模型

「人设」页签里有两类人设,网格里混排,点哪个就换成哪个:

照片人设专属训练模型(带「模型」角标)
怎么来上传一张正脸照片即可DeepFaceLive / DeepFaceLab 训练出的 .dfm 模型文件(0.5–2 GB)
换的范围只换五官纹理;脸型、发际线、眉形、胡子仍是你自己的整张脸连同脸型、眉形、胡子都换成该人物
表情、嘴型较弱(张嘴幅度约为真人 6 成)更完整(好的模型能到 8–10 成)
清晰度偏软,靠人脸修复补取决于模型训练质量,同样可叠加人脸修复
速度基准与照片人设相当(RTX 5090 上模型本身 5–12 ms/帧)
适合谁任意人脸、随时新增固定几个人物、要「像」和要表情的场景
专属模型换的是真实存在的人的脸(目前公开的模型几乎都是名人)。使用前请确认你有权使用该人物形象;不要用于误导他人、冒充本人或任何成人内容,这在多数国家和地区属于违法行为。

内置模型

系统预置了 5 个欧美男性模型,是从 10 个公开候选里按同一段测试视频实测挑出来的(看三样:说话时嘴张开的幅度能保留多少、嘴部区域清晰度、有没有色块伪影)。GPU 端首次选中时会自动下载,之后常驻。

模型架构 / 分辨率特点
Chris HemsworthSAEHD 320表情最活(张嘴幅度与真人持平)、最快,推荐先试它
Cillian MurphySAEHD 320表情好、清晰、快
Hugh JackmanSAEHD 384清晰,表情略收敛
Mads MikkelsenSAEHD 384清晰,表情略收敛
Harrison FordAMP 384最清晰,表情好;AMP 架构计算量约为 320 模型的两倍多

去哪里下载更多模型

模型文件是 DeepFaceLive 的 .dfm 格式,一个人物一个文件。公开来源:

添加时粘贴的必须是指向 .dfm 文件的直链(Hugging Face 用 /resolve/main/ 的地址,不是 /blob/ 的网页地址)。文件由 GPU 端自行下载,速度取决于 GPU 端的网络,1 GB 通常 1–3 分钟。

怎么挑选

怎么使用

  1. 「人设」页签 → 网格最后的「添加人设」→ 选「训练模型 · 粘贴 .dfm 下载地址」,粘贴直链,点「下一步」。系统会登记并自动选中它。
  2. 首次选中时卡片上显示「下载中 xx%」,随后「加载模型到 GPU」,一般 1–3 分钟;期间画面继续用当前人设,不会中断。
  3. 就绪后卡片出现预览图和「模型」角标,以后切换只需 1–4 秒。
  4. 模型人设同样可以叠加「人脸修复」「遮挡感知」「换背景」,也能存进预设;肤色会自动匹配到你当前的光线。
  5. 不想要了:卡片左上角「×」删除,模型文件一并清除;内置模型不能删。

浏览器直接连接 GPU 节点时,「添加人设」里还会多一个「上传本机 .dfm 文件」;经本站或桌面版使用时没有这一项(文件太大不适合经隧道上传),请用下载地址方式。

自己训练一个人物

专属模型要用 DeepFaceLab 训练:准备目标人物 5000 张以上不同角度、表情、光照的正脸图(通常从视频抽帧),对手方用官方的 RTM 通用人脸集,训练 100–200 万次迭代(RTX 3090/4090 约 1–3 天),再导出为 .dfm。注意 DeepFaceLab 已停止维护,其 Windows 版依赖旧版 CUDA,RTX 50 系列显卡训不了,需要 30/40 系或租用云 GPU;训练完成的模型在 RTX 50 上正常使用。教程可参考 deepfakevfx.com 的 DeepFaceLab 2.0 Guide 与 DeepFaceLive 仓库的训练说明。

桌面版 & 会议软件

桌面版(下载)与网页版是同一套界面,区别在两端:本机摄像头由程序采集,处理后的画面同时输出到系统虚拟摄像头「AI 换脸摄像头」。

  1. 安装后打开桌面图标,首次要登录账号(登录状态保留 30 天)。
  2. 「设备」页签选物理摄像头(虚拟摄像头已自动排除,避免画面套娃),选画质档位(默认 720p 自动升降)。
  3. 点「开始」,等待状态变成「运行中」。
  4. 在会议软件里选摄像头:Zoom 设置 → 视频 → 摄像头;腾讯会议 设置 → 视频 → 摄像头;飞书 设置 → 音视频 → 摄像头;Teams 设置 → 设备;Google Meet 更多 → 设置 → 视频。都选「AI 换脸摄像头」。
开会期间请让桌面版一直开着——它是画面的来源,关掉后会议里的画面就没了。摄像头同一时间只能被一个程序使用:跑桌面版时关掉占用摄像头的网页或其他软件。

桌面版排错

GPU 端安装

GPU 端是真正做换脸/抠像的程序,装在带 NVIDIA 显卡的机器上。它主动连接本站(出站 WebSocket)并出现在管理后台的 GPU 列表里,之后由系统自动分配给客户端——机器不需要公网 IP、不用开端口、不用证书。客户端默认按「本机 → 局域网 → 远程 → 租用」的顺序自动选 GPU,也可以在网页版/桌面版顶部的 GPU 下拉框手动指定一台对比效果(被其他用户占用的会标出来、不能选)。

要求
显卡NVIDIA RTX 30/40/50 系列,显存 ≥ 12 GB;实测 RTX 5090 720p 约 20fps
系统Windows 10/11 64 位,或 Ubuntu 22.04+(Linux 容器亦可)
驱动支持 CUDA 13 的 NVIDIA 驱动(≥ 580)
网络能访问本站与 HuggingFace(下载模型约 2 GB);上行 ≥ 10 Mbps
磁盘≥ 15 GB(Python 依赖 + 模型)

不需要令牌:装完自动注册

GPU 端启动后会用这台机器的指纹向本站自动注册,出现在管理后台「GPU 节点」页并默认启用,随即可被分配。管理员按主机名、显卡、来源 IP 核对,不认识的机器点拉黑——按机器指纹拒绝,它重装、换目录也连不上;误拉黑可随时解除。只有管理员想预先指定某个节点时,才需要在后台「手动添加」生成令牌并在安装时填入。

Windows

  1. 下载 GPU 端 Windows 安装包,双击安装(需要管理员权限:注册开机自启的计划任务)。安装包自带独立的 Python 运行环境,装在自己的目录里,不会碰这台机器上已有的 Python
  2. 安装向导里本站地址已默认填好 https://fs.hawkmind.ai;节点令牌留空(自动注册)。
  3. 安装结束会自动开始首次初始化:安装 PyTorch(CUDA 13)、ONNX Runtime 等依赖并下载模型,5–15 分钟;窗口里能看到进度,结束后自动启动并注册。
  4. 之后开机自启、断线自动重连;日志在安装目录的 logs\。无人值守安装:FaceSwapGPUNode-Setup.exe /SILENT /PORTAL=https://fs.hawkmind.ai [/TOKEN=令牌] [/PORT=8080] [/DIR=C:\FaceSwapNode]

Linux(含 Docker / 云主机)

mkdir -p /workspace && cd /workspace
curl -fsSL https://fs.hawkmind.ai/dl/node-linux.tar.gz | tar xz
cd webrtc_node
bash install_linux.sh                       # 装依赖 + CUDA 门禁(镜像建议 pytorch/pytorch:2.13.0-cuda13.0-cudnn9-runtime)
export PORTAL_URL=https://fs.hawkmind.ai
# export PORTAL_NODE_TOKEN=…             # 可选:只有要对上后台手动生成的节点时才填,留空即自动注册
export NODE_TOKEN=$(head -c 12 /dev/urandom | xxd -p)     # 本机 server 的内部口令,随机即可
export MANAGE_SERVER=1                       # 由 agent 拉起并看护处理进程
python agent.py

常驻建议用 systemd 或容器的启动脚本循环拉起 python agent.py(退出即重启)。

云端自动租用(Vast.ai)

  1. 管理后台 → 设置 → 填入 Vast.ai API Key,点「测试」看到余额即可;按需调整型号优先级、最高价、地区、空闲超时、最长存活。
  2. 管理后台 → 用户 → 给需要的账号勾选 允许租用,并可设置该账号的最长存活 / 空闲超时。
  3. 用户打开网页版或桌面版时:若没有空闲的已安装节点,系统自动租一台(页面显示进度:寻找挂单 → 启动 → 安装依赖 → 下载模型 → 就绪,通常 5–10 分钟),就绪后自动分配。
  4. 关机:空闲超过设定分钟数自动关;达到最长存活自动关;管理员在「GPU 节点」或「租赁」页可随时手动关。
Vast 账户余额不足时租赁会直接失败并在页面/日志里给出原因,不会静默等待。

管理后台

地址 https://fs.hawkmind.ai/admin,仅管理员账号可进。

账号与权限

字段含义
角色admin 可进后台;user 只能用网页版/桌面版
可用已安装 GPU是否允许分配自有 GPU 节点
允许租用没有空闲节点时是否为该账号自动租云端 GPU(也决定能否复用他人租的空闲节点)
租用最长存活 / 空闲超时该账号触发的租赁的关机规则(分钟);空闲超时 0 = 只手动关

设置与 API Key

Key用途
Vast.ai API Key自动租用 GPU(搜挂单、开机、查日志、销毁、看余额)
OpenRouter API KeyAI 文本/多模态调用(下发给 GPU 节点,供后续 AI 功能使用)
OpenAI API KeyAI 背景匹配主通道(gpt-image-2 出图)
Venice API KeyAI 背景匹配兜底通道
fal.ai Key可选的图像通道

Key 只存在本站数据库,页面只回显尾 4 位;保存后在线节点立即收到更新。

参数说明

界面里每个参数旁的「?」都有详细说明(作用 / 原理 / 范围 / 推荐值 / 症状对应)。最常用的几个:

参数调它解决什么
换背景关掉 = 只换脸、保留真实背景,零边缘伪影、延迟最低
人脸修复 / 修复模型脸偏软→开;gpen_bfr_256 快、codeformer 最真实
局部光照匹配换出来的脸像一块平光的面具、和脖子接不上 → 开(把你脸上的明暗分布搬到换脸结果上,专属模型必开)
表情迁移 / 表情强度 / 迁移区域换脸后表情、嘴型比真人弱 → 开(用你的原始表情重新驱动换脸后的脸;首次开启下载约 340MB;每帧约 +30ms,帧率会降)。嘴张得过头→降强度;眼睛异常→区域改「只下半脸」
遮挡感知手挡脸时手不被换掉;常有手部动作时必开
边缘平滑 / 边缘削除 / 边缘去污肩膀边界抖、毛边、白边
背景调色 / 人物调色AI 背景与房间亮度对不上、换脸后人偏暗
环境光校正让人物带上背景光线的色调(按当前背景生成一次,约 1–2 分钟)

网络与安全

常见问题

「没有可用 GPU」

没有在线的 GPU 节点,或都在使用中。让管理员启动 GPU 端(后台「GPU 节点」页能看到在线状态),或为你的账号开通「允许租用」。

摄像头打不开

浏览器地址栏左侧锁图标 → 摄像头 → 允许;别选「AI 换脸摄像头(虚拟摄像头)」;关掉占用摄像头的其他程序(桌面版、另一个标签页、Zoom、微信)。

信令通了但没有画面

状态卡在「WebRTC: connecting/failed」:客户端与节点之间既不能直连、中继也没通。检查本站 3478/UDP 与 50000–50999/UDP 是否被公司防火墙拦截;或换用手机热点验证。

安装包被浏览器/SmartScreen 拦截

安装包未购买代码签名证书,属于信誉机制的正常提示,按下载页图解点「保留」「仍要运行」;可对照 SHA-256 校验文件未被篡改。

GPU 端装好了但后台看不到

查看 GPU 端日志(Windows 在安装目录 logs\,Linux 看 agent.log):正常会先出现「已自动注册到门户」,再等「server.py 就绪」(首次要下载模型)后连上;「门户拒绝注册」= 这台机器被管理员拉黑;连接被拒 4403 = 节点被停用;确认机器能访问 https://fs.hawkmind.ai。

租用失败

后台「租赁」页有每次的日志:余额不足、没有符合价格/地区的挂单、坏机(会自动换机并拉黑)。