使用 inference.sh CLI 通过专用模型创建 AI 虚拟形象和数字人说话视频。
通过 inference.sh CLI 使用 P-Video-Avatar、OmniHuman、Fabric 和 PixVerse 等模型创建 AI 虚拟形象和数字人说话视频。
具有可衡量价值的专注工作流。
星标
709
分叉
96
已更新
2026年8月24日
通过 inference.sh CLI 创建 AI 虚拟形象和会说话的头部视频。推荐:P-Video-Avatar(最快、最便宜,内置 TTS)。还有:OmniHuman、Fabric、PixVerse。音频:Inworld TTS-2(支持 100 多种语言、角色情感引导)、ElevenLabs、Kokoro。功能:音频驱动的虚拟形象、文本生成虚拟形象、唇形同步视频、会说话的头部生成、虚拟主持人、UGC 内容。适用场景:AI 主持人、解说视频、虚拟网红、配音、营销视频、UGC 广告、游戏虚拟形象、NPC 对话。触发词:ai avatar, talking head, lipsync, avatar video, virtual presenter, ai spokesperson, 音频驱动视频, heygen alternative, synthesia alternative, talking avatar, lip sync, video avatar, ai presenter, 数字人, ugc, ugc video, ugc ad, avatar ugc
通过 inference.sh CLI 使用相关模型,从肖像图片以及音频或文本脚本生成 AI 头像和会说话的头像视频。
创建 UGC 风格的营销广告和产品演示
制作教育课程视频和虚拟讲解员视频
将现有视频内容配音成多种语言
为社交渠道打造一致的虚拟网红媒体内容
生成企业培训和公司公告视频
创建互动游戏角色和 NPC 对话视频
npx skills add inference-sh/skills@ai-avatar-video主题与功能