一句话,生成会说话的数字人视频
上传照片或挑选公共数字人,输入文案即可产出播报视频;也支持音频驱动与音色克隆。底层调用 Flyworks / HiFly 数字人 API。
公共数字人播报
照片开口说话
音频驱动口型
声音克隆
1. 选择数字人形象
正在加载形象列表…
来自 Flyworks 公共形象库
2. 输入口播文案
0 字 · 预计 0.0 秒
「AI 写文案」由 DeepSeek 生成,填入后可直接合成视频。
3. 选择音色
正在加载音色列表…
生成过程约需 1–3 分钟,请保持页面打开。
生成结果
待提交- 提交任务
- 排队中
- 合成中
- 完成
左侧配置完成后,点击「开始生成视频」。
最近生成
- 还没有生成记录
这个网站是怎么封装 Skill 的
本页把 flyworks-avatar-video Skill(原脚本 scripts/hifly_client.py)的能力搬到浏览器:前端只做交互,所有对 hfw-api.hifly.cc 的调用都经由同源 /api/* 的 Cloudflare Pages Function 转发,Token 保存在服务端,不会出现在页面源码里。
| Skill 命令 | 网页入口 | 代理接口 |
|---|---|---|
list_public_avatars | 数字人形象列表 | GET /api/avatars |
list_public_voices | 音色列表 | GET /api/voices |
create_video --type tts | 数字人播报 | POST /api/tts |
create_video --type audio | 音频驱动 | POST /api/audio-video |
create_talking_photo | 照片说话 | POST /api/photo-avatar |
clone_voice | 音色克隆 | POST /api/clone-voice |
check_task | 进度轮询 | GET /api/task |
使用步骤
- 选形象:公共数字人库按名称搜索,或上传自己的照片生成专属形象。
- 写文案:中文约 5 字/秒,体验 Token 单条 30 秒以内。
- 挑音色:公共音色开箱可用,克隆音色排在列表最上方。
- 等待合成:任务排队 → 合成 → 完成,页面会自动轮询并在完成后播放视频。
常见问题
- 视频有飞影水印 / 只有 30 秒? 体验 Token 的限制。在「设置」中填入 hifly.cc 获取的个人 API Token 即可解除。
- 照片说话失败? 换一张正面、清晰、无遮挡的半身照重试。
- 任务一直排队? 高峰期排队会变长,可在「最近生成」里稍后回看结果。
设置:API Token
默认使用 Skill 内置的体验 Token(视频带水印、最长 30 秒)。填入自己的 Token 后,请求会以该 Token 调用上游接口;它只保存在你自己的浏览器里。
当前状态:使用体验 Token。
服务信息
本页面为 Skill 的网页封装版本,媒体文件与视频由 Flyworks 云端生成与托管。