今天分享一下主流的做AIGC视觉类的产品。也就是AI做视频,做图的产品分享。分享一下小编平时会使用到的一些产品。还有市面上一些主流的做AI视频,AI做图的产品。因为在前面的文章中,我发现评论区有部分同学会问:
1.这个是用什么生成的?
2.豆包可以做吗?
3.哪些可以做这样的AI视频?
4.网站在什么地方? ... 等等这类问题。
所以今天就分享一下各大AIGC相关产品,最好收藏起来,方便下次查阅。
我先介绍一下国产的模型。 第一个那就是我们豆包同志。
豆包
网站直接在浏览器里面搜索豆包即可。


AI创作万金油,啥都能干,但是不是很突出。视频接入的Seedfast,相当于是Seedance2.0的残血版本。SD视频生成模型我想大家都用过,现阶段还是最强的视频模型。

图片模型是接入的是Seedream系列模型。对于图片文字信息要求不高的同学,使用这个模型没什么问题。但是想要生成小编前面的人物详细资产图片可能就有点乱。

具体对比可以看看,提示词都是一样的,只不过提示词的文字信息相对比较多(400字左右),所以这方面还是GPT image 2 更胜一筹。
豆包

GPT image 2

即梦
即梦漫剧第一梯队,基本上现在做漫剧的公司,都用即梦。主要就是即梦的Seedance2.0的发布。字节这方面的技术还是厉害,结合抖音大数据训练模型,让中国的AI模型第一次吊打国外的同类模型。
同样在国内直接在浏览器搜索即梦既可以找到对应的网站。
对应网站


即梦平台就更专业了,因为豆包毕竟原来只是一个语言大模型,后面迭代为了多模态,集成了即梦的部分功能。

即梦我记得我出过一篇详细的教程大家可以看看,也有在网上搜索一下相关教程也是有的。

可能教程有点过时了,但是我看即梦页面也没有大更新,也是可以了解一下的。
既然写都写到即梦了,那还是要说一下,即梦的排队问题和积分缩水问题。排队等待时间老长了,不用vip加速通道的话,一个视频不知道要等到猴年马月。之前小编一个视频等了三天,等了三天视频还生成失败了,然后跟我说视频违反相关规定。
我当时就

但是即梦的Seedance2.0模型还是很不错的。
可以看看小编之前生成的视频。
如果你想要制作AI短视频(几秒那种),不用专业工具的话,即梦其实就够了,甚至豆包就够用了。
可灵
可灵平台,也是非常不错的国产大模型,属于快手AI团体自主研发,在部分视频领域与即梦旗鼓相当,甚至更好。我了解到的是近景人物真实感,这方面的确是要比即梦好些的,如果你想要制作真人短剧,偏向于镜头多数为中景,近景的,并且人物动作幅度不大,那么可灵会比较适合你。

官网地址:

比如抖音上面的AI穿搭视频。
使用方法和即梦平台类似,只是界面布局不同而已。视频,图片,Agent这些都是支持的,也有画布模式。只不过小编一般是使用视频模型,其他并没有深度使用。
国内其他模型
HappyHorse 视频生成模型
快乐马,视频生成模型。也就是前段时间在模型测评榜单上,说是与Seedance2.0旗鼓相当的一款神秘模型。经过后面阿里官宣,HappyHorse是阿里ATH旗下创新事业部研发的模型。

这是HappyHorse 官网地址:

对于视频生成来说,离即梦的Seedance2.0还有一段距离,但是价格对比要友好一点,这也是他的一个优势。


海螺AI
海螺AI是MiniMax公司开发的一款多模态人工智能助手,具备强大的交互能力和实用功能。

官网地址:

在海螺上也可以使用Seedance2.0,而且还比即梦官网使用更加的便宜。

海螺AI小编使用得比较少,感兴趣的同学可以去试试,这里提供一个入口。
国外模型
好,现在看看国外的模型,视频生成上面有谷歌的Veo系列和Omni模型,GPT的Sora,因为Sora对于GPT收支严重不平衡,所以现在已经停止服务了。
其他的视频模型了解得比较少,没有国内视频模型强大。
但是国外的图片生成模型确实独一档的厉害。
GPT imageV2
GPT的新一代旗舰图片生产模型,在图片生成这方面,独一档的存在属于T0级别。

小编之前的很多文章里面用到的图片,其实都来自GPT image V2。 素材来自GPT官网。





等等,GPT imagev2生成的图片,完全可以进行商业化。 比如做产品宣传图,漫剧分镜图,人物,场景资产图等等。
文字信息控制得很好,基本上不会出现信息丢失,也不会出现异形字。(提示词别太多,提示词500字以上,也是有小概率出现异形字的)
Gemini

在GPT image2,没出来之前,gemini的香蕉模型一直的领先行业平均水平。但是香蕉模型在文章把控上完全不及GPT image2. 比如之前生成的一张城市宣传海报。

很明显可以看见多了一个太字。应该是太安逸了而不是太太安逸了。背后一些文字也有一点小瑕疵。
但是GPT image2 的图片文字把控这方面就要好得多。

虽然香蕉模型在文字把控上,不及GPT image2,但图片生成模型也是第二强的存在。
在gemini官网上,除了使用图片模型之外还能使用视频模型-Veo。Veo模型差不多是国外比较强的视频生成模型。

谷歌在前段时间还发布了omni模型,这款模型对现实物理世界的理解的确比较强,对视频的修改能力也是独一档存在。只不过不适合做漫剧,详细的介绍可以看看我之前的文章。

除此之外,谷歌还有一个平台更适合做图片和视频内容平台-Google Flow

这个平台一些谷歌用户好像还不知道,官网地址

这个平台的优势就是可以一次性出多张图。还支持4K下载,但是要高级订阅用户才可以。

视频模型也可以自定义使用哪个模型。

这个就很像,豆包和即梦的关系。 gemini官网就是豆包,这个Google Flow就是即梦,Google Flow对于做图片和视频更加专业。
这个是我很久之前做的一个人物资产图。

而且我发现Google Flow还更新了一波,跟我之前打开的样子不一样了,还有agent模式,我记得之前是没有的。
Midjourney

既然是图片模型,那么怎么能少了我们的MJ。MJ美学风格独一档的存在。其他模型很难模仿MJ生成的图片,哪怕是再精准的提示词都不管用。因为MJ具有成熟的构图、光影、材质、色彩关系。标准模式下面还会加入自己的创意风格。
短板也很明显,文字把控力几乎没有,图片中生成几个简单的中文汉字都不行。如果你要它严格执行复杂指令,比如“某个房间里必须有几个物体、每个物体位置准确、图片上文字不能错”,它经常不如 GPT Image、Gemini 这类更偏指令遵循的模型。
使用成本也比较高,没有免费额度。
这是我之前做的一些图片。








如果你是一个设计师,或者对美学风格要求比较的高话可以试试MJ模型。做AI视频如果要做别具一格的视频风格,也可以在MJ正常人物,场景图片,然后到其他模型中进行风格定义。
聚合平台
前面讲到的都是一些官方平台,下面介绍一些聚合平台。聚合平台个人认为最大的优势就是资源整合,平台的辅助创作工具,可视化工作流。
可以直接使用主流AI模型。

LibTV
LibTV国内做的比较好的AI创作平台。

以画布,节点的形式创作作品—(可视化工作流)

最近上线了导演台。类似3D建模平台,可以更好的把控镜头角度,人物站位

做AI长视频,或者专门想研究AI视频操作的话,可以试试这类AI操作平台。
除此之外,还有其他的一些平台,基础功能都差不多。
Tapnow

和LibTV类似都是面向图片、视频、广告和短片创作的 AI 工作流平台,把多个 AI 模型和创作步骤放到一个可视化画布里,让用户像搭流程一样完成内容生产。
小云雀
也是字节旗下的产品。
主打智能体驱动,一个任务指令就可以跑出一段AI视频,AI视频的素材也是智能体智能创建,管理。你只需要写好提示词就行了。

前段时间很火的《丧尸清道夫》的作者就是在小云雀上制作的。

小云雀也是有画布模式的。只不过模型范围都是字节旗下的模型。

FlovaAI
跟云雀类似

Runninghub

这个平台还接入了一部分ComfyUI的一些功能

ComfyUI
单独介绍一下ComfyUI。前面所有的网站,平台都是云端的,但是ComfyUI是本地部署的。

类似这样的界面。

ComfyUI 可以理解成一个 节点式 AI 绘图 / 视频工作流工具。 小编没有怎么用过,因为需要一定的学习成本和设备成本。
打算深入了解AI视觉制作的话,并且有一定的预算。可以去学学了解一下。
设备方面需要英伟达的显卡,ComfyUI对显存的要求比较高,越高的显存运行效率就越高。
显卡显存,入门 8GB 可以出一些简单的图片,如果需要深度使用的话那么最好是,12GB以上,如果要运行视频模型的话,那么对显存的要求就会更高。这还只是英伟达显卡的要求,其他方面的要求虽然比较低,但是想要配置一台可以正常运行ComfyUI的电脑,加上内存,储存涨价,还是要花费不少的馒头。
最后
AIGC创作平台有很多,文章中提到的也只是一部分。AIGC 视觉工具更新很快,今天觉得某个模型很强,过几个月可能又被新的模型追上。所以这类工具,不太适合用“谁最强”来做唯一判断。各有各的优势,各有各的用户黏性。选择自己喜欢的就行了。
大家可以多试工具,但不要只停留在试工具。最后能做出好作品的,还是对画面、节奏、审美和内容有判断的人。
夜雨聆风