• 请不要在回答技术问题时复制粘贴 AI 生成的内容
Liu6
V2EX  ›  程序员

数字人开源模型推荐+魔改方案

  •  
  •   Liu6 · 2 days ago · 1614 views

    ps: 节点有问题,劳烦移动一下。我没找到数字人节点

    视频生视频模型
    1 、音频到视频 1 分钟视频生成时间 3-10 分钟左右
    2 、能跑着,走着说,角度最好能 90 度
    3 、可以批量生成
    4 、交付源代码.能最后封装到给 api 接口
    5 、能支持高清,720P 以上
    6 、除了改嘴型,背景文字和画面不改变
    7 、嘴巴颜色正常,不过红,牙齿清晰

    图生视频
    1 、图片生成视频时间 1 分钟视频生成时间 30 分钟以内
    2 、能跑着,走着说
    3 、可以批量生成
    5 、能支持高清,720P 以上
    6 、手部动作可以调节
    7 、嘴巴颜色正常,不过红,牙齿清晰

    目标: 对口型
    其实最主要的就是质量问题
    目前我也尝试了开源的模型,还是会出现口型会出现模糊,牙齿不清晰, 画面撕裂等 场景可以参考(原视频嘴巴不动, 跑, 跳等)

    求各位大佬分享开源模型+魔改方案
    实在不行购买也行,需要所有的源代码,我这边会封装成 API 。
    不需要考虑硬件问题
    球球啦~

    13 replies    2026-09-03 13:59:29 +08:00
    blueslmj
        1
    blueslmj  
       2 days ago
    我还以为是你推荐。。
    coefu
        2
    coefu  
       2 days ago
    不标价格不够诚意。
    Liu6
        3
    Liu6  
    OP
       2 days ago
    @blueslmj #1 我敲, 我也想推荐。
    Liu6
        4
    Liu6  
    OP
       2 days ago
    @coefu #2 价格你们报价啊。
    manhere
        5
    manhere  
       2 days ago
    开源的基本都是玩具
    hsuehly
        6
    hsuehly  
       2 days ago
    有这方案,我自己都成立公司了
    defunct9
        7
    defunct9  
       2 days ago
    我有,刚弄了一套
    isSamle
        8
    isSamle  
       2 days ago
    你提供硬件,我 SSH 隧道进去研究玩玩
    panxi
        9
    panxi  
       1 day ago
    我自己魔改的 1080P 分辨率 1:0.5 的速度, 前提是第一次得创建缓存,后面推理命中缓存就飞起
    panxi
        10
    panxi  
       1 day ago
    不过就是是单步 U-Net 生成, 最近正在替换成 多步潜空间扩散生成, 提升唇部质量
    Liu6
        11
    Liu6  
    OP
       1 day ago
    @panxi #10 大佬, 求分享
    panxi
        12
    panxi  
       1 day ago
    @Liu6 #11 分享不了一点啊大兄弟,这是真调优版本,玩具才会开源😂😂😂
    Liu6
        13
    Liu6  
    OP
       1 day ago
    @panxi #12 那能否提供一些稍微细一点的思路? 我自己琢磨琢磨。
    About   ·   Help   ·   Advertise   ·   Blog   ·   API   ·   FAQ   ·   Privacy   ·   Solana   ·   950 Online   Highest 6679   ·     Select Language
    创意工作者们的社区
    World is powered by solitude
    VERSION: 3.9.8.5 · 32ms · UTC 19:35 · PVG 03:35 · LAX 12:35 · JFK 15:35
    ♥ Do have faith in what you're doing.