飞影数字人视频工坊 flyworks-avatar-video Skill · 网页版
体验 Token

一句话,生成会说话的数字人视频

上传照片或挑选公共数字人,输入文案即可产出播报视频;也支持音频驱动与音色克隆。底层调用 Flyworks / HiFly 数字人 API。

公共数字人播报 照片开口说话 音频驱动口型 声音克隆

1. 选择数字人形象

正在加载形象列表…

来自 Flyworks 公共形象库

2. 输入口播文案

0 字 · 预计 0.0 秒

「AI 写文案」由 DeepSeek 生成,填入后可直接合成视频。

3. 选择音色

正在加载音色列表…

生成过程约需 1–3 分钟,请保持页面打开。

生成结果

待提交
  1. 提交任务
  2. 排队中
  3. 合成中
  4. 完成

左侧配置完成后,点击「开始生成视频」。

最近生成

  • 还没有生成记录

这个网站是怎么封装 Skill 的

本页把 flyworks-avatar-video Skill(原脚本 scripts/hifly_client.py)的能力搬到浏览器:前端只做交互,所有对 hfw-api.hifly.cc 的调用都经由同源 /api/* 的 Cloudflare Pages Function 转发,Token 保存在服务端,不会出现在页面源码里。

Skill 命令网页入口代理接口
list_public_avatars数字人形象列表GET /api/avatars
list_public_voices音色列表GET /api/voices
create_video --type tts数字人播报POST /api/tts
create_video --type audio音频驱动POST /api/audio-video
create_talking_photo照片说话POST /api/photo-avatar
clone_voice音色克隆POST /api/clone-voice
check_task进度轮询GET /api/task

使用步骤

  1. 选形象:公共数字人库按名称搜索,或上传自己的照片生成专属形象。
  2. 写文案:中文约 5 字/秒,体验 Token 单条 30 秒以内。
  3. 挑音色:公共音色开箱可用,克隆音色排在列表最上方。
  4. 等待合成:任务排队 → 合成 → 完成,页面会自动轮询并在完成后播放视频。

常见问题

  • 视频有飞影水印 / 只有 30 秒? 体验 Token 的限制。在「设置」中填入 hifly.cc 获取的个人 API Token 即可解除。
  • 照片说话失败? 换一张正面、清晰、无遮挡的半身照重试。
  • 任务一直排队? 高峰期排队会变长,可在「最近生成」里稍后回看结果。

设置:API Token

默认使用 Skill 内置的体验 Token(视频带水印、最长 30 秒)。填入自己的 Token 后,请求会以该 Token 调用上游接口;它只保存在你自己的浏览器里。

当前状态:使用体验 Token。

服务信息

  • 运行平台Cloudflare Pages + Functions
  • 上游接口hfw-api.hifly.cc/api/v2/hifly
  • 技能来源flyworks-avatar-video (cocoloop)
  • 体验限制30 秒 / 带水印

本页面为 Skill 的网页封装版本,媒体文件与视频由 Flyworks 云端生成与托管。