
简介
该用户还未填写简介
擅长的技术栈
可提供的服务
暂无可提供的服务
ComfyUi+MinimaxH3视频模型从部署到生产的系列文章到这里就全部结束了。我们总共用了5章的内容,对MinimaxH3视频模型做了一个完整的介绍和学习。模型的下载、模型的部署、插件的安装、工作流的搭建、提示词Skill的安装,提示词和工作流的具体使用,整个流程我们都进行了详细的说明。

写这一章就是给大家汇报一下,这两天一直没有更新得原因试掉坑里了,还没有上来!所有更新的慢了,希望大家理解

图片是一切的基础! 我们可以想一想,我们用AI的目的有哪些:1、制作人物头像(图片)。2、制作活动海报(图片)。 3、制作电商的宣传物料(图片)。...... n、就算是做视频,要做出商业级可用的视频,也是需要先制作出各分镜头的图片,再用这些图片去制作我们想制作出的视频(这个我们后面讲视频制作的时候再具体的讲)。所以说只有先学好,如何去生成我们想要的图片!我们才会有向更高水平前进的可能。正所谓基础

在第019章里我们生成了一个数字人模特“小一”,本来想着先通过给“小一”换装、换背景,来个大家讲一下图像编辑模型的使用。后来又考虑到图像编辑是一个大的知识点,只是简单搭一个基础的图像编辑模型的工作流的话优点太浅了,太深的话一是我自己目前前的知识储备也有些不够,再一个一下深入到这里面去的话一时半会是出不来的。后来就觉得先来个语音的生成,把数字人的音色给设计出来。下面再去写一段广告词,把数字人要说的话

在上一章我把Qwen3-TTS音色设计工作流所需要的插件和模型都已经准备好了,这一章我们将从零开始去搭建一个音色设计的工作流......

前面我们花费了两章的时间,完成了从下载模型、插件,到最后的音色设计工作流搭建的共工作。因此我们已经拥有了设计音色的能力,接下来就是用我们自己设计的音色,去生成我们想要的音频内容,就是所谓的“声音克隆”。

写这一章就是给大家汇报一下,这两天一直没有更新得原因试掉坑里了,还没有上来!所有更新的慢了,希望大家理解

从7月6号的下午开始,一直到7月10号的下午,整整花费了一周的时间。我终于从IndexTTS2模型的本地部署的坑里爬上来了!不容易呀!给自己点个赞! 最核心的原因是“TensorFlow”这个东西一直在搞鬼......

图片是一切的基础! 我们可以想一想,我们用AI的目的有哪些:1、制作人物头像(图片)。2、制作活动海报(图片)。 3、制作电商的宣传物料(图片)。...... n、就算是做视频,要做出商业级可用的视频,也是需要先制作出各分镜头的图片,再用这些图片去制作我们想制作出的视频(这个我们后面讲视频制作的时候再具体的讲)。所以说只有先学好,如何去生成我们想要的图片!我们才会有向更高水平前进的可能。正所谓基础

通过前面的文章,我们已经可以通过Z-Image去生成模特图片、通过Qwen3-TTS和Index-TTS2去设计模特音色并生成相应的音频。现在人物有了、声音也就有了,就差让人物开口讲话,生成视频了。从今天开始我们将学习一个新的视频模型LTX2.3......









