聊一个最近我身边的事,上周认识了一个做大理石生意的老板。
他跟我说想做线上店铺,卖大理石工艺品。然后我俩开始梳理整个业务的流程,以及其中AI的赋能点。
梳理到最后,发现卡点是AI视频。
这与商业模式有关。如果只是一次性做一个短片,那视频制作的边际成本会越来越低。但这个电商业务,需要持续产出产品视频,发在社交媒体上,作为流量入口。
所以,AI生成视频的费用,直接决定了生意是赚是赔。
现在主流视频模型是SeeDance 2.0,效果是真不错,但价格也是真不低。再加上反复抽卡,那成本不知道要翻多少倍。
算到最后,如果真用SeeDance 2.0,那大概率没得赚。
好巧不巧,今天用LibTV的时候,发现上线了新模型MiniMax H3。
价格照SeeDance 2.0砍半,效果还能达到它的80%。
这我必须测试一波,如果效果OK,这生意盈利的可能性大大增加了。
在此之前,给大家介绍一下MiniMax H3。
先给不熟悉的朋友简单介绍Seedance 2.0。这是字节发布的视频生成模型,目前是行业标杆,商业视频标配。生成的视频质量高,画面一致性、稳定性高,指令遵循、复杂任务做得都很好。
缺点就是贵,贼贵。
H3是MiniMax的新模型,首发上线LibTV。它的定位很清晰,更适配真实商业场景,平衡价格与效果。
详细来说,H3支持全模态输入加多参数控制。
文字、图片、视频、音频可以一起喂,把它们当成一整个上下文来理解,能读懂画面里的人物、动作、镜头、声音、情绪和风格,还能对角色、物体、场景、台词、音色分别去调。
这一层能力和Seedance 2.0是对齐的,广告、电商、品牌内容这些主流商业场景,它都接得住。
全模态输入,让H3天生就与创作Agent绝配。两者的上下文能够更好的统一,这也是为什么我要在LibTV体验,这才能发挥H3的极致性能。
此外,MiniMax H3还有一大亮点,就是做后期包装视频,效果超棒。欣赏一下:
好,下面用大理石产品这个真实业务测试。一是看H3接不接得住,二是与SD2做对比,看究竟有多少差距。
我要做一个大理石礼盒套装,里面包含咖啡杯、杯垫、香薰台、小夜灯这4款产品。
先在LibTV把基础造型设计出来。
⬅️ 左划查看全部图片
有了基础产品后,我的思路是上架3个不同版本,每个版本采用不同的大理石材质。然后为不同版本的礼盒套装设计并制作宣传视频。
我把需求告诉LibTV Agent,它直接给我出了完整方案,以及对应的产品图。多图并行生成,速度嗖嗖的。
完整设计如下:
霞纹琥珀 对应原石材质:伊朗特级琥珀米大理石 开采源头:伊朗克尔曼高端暖色系石材矿区,地处古地中海沉积矿带,亿年地质沉淀形成独有琥珀渐变肌理,矿区优质荒料储量稀缺,仅深层矿层可产出无杂裂、色泽均匀的工艺品级原料,是小众高端暖调奢石代表。 艺术美学描述:以通透奶杏为基底,天然晕染出琥珀、浅棕、柔金三层渐变肌理,丝状细纹舒展轻盈,如同日暮霞光凝于石间,温润通透、柔光自带。无浓烈厚重的视觉压迫,兼具烟火温柔与轻奢质感,既有玉石的温润内敛,又有天然石材的纹理层次,适配雅致、轻奢、新中式多重美学风格。
⬅️ 左划查看全部图片
云岫凝霜 对应原石材质:意大利卡拉拉白大理石 开采源头:意大利托斯卡纳卡拉拉阿尔卑斯矿脉,全球顶级白色大理石核心产区,为欧洲皇室、古典雕塑御用石材,矿脉形成于亿年阿尔卑斯造山运动,结晶细腻、纯度极高,仅山顶稀缺矿层可产出工艺品级精料。 艺术美学描述:以纯粹素白为底,肌理温润通透,自带柔光哑光质感,浅淡灰丝纹理如远山云岫、晨霜覆石,线条轻盈疏朗、错落有致。无繁复冗杂纹路,尽显东方极简留白美学,干净克制、清雅脱俗,兼具西方古典雕塑的庄重质感与东方文人的淡泊风骨,是素雅高级风的天花板材质。
⬅️ 左划查看全部图片
黑金曜石 对应原石材质:巴西进口黑金奢石 开采源头:巴西米纳斯吉拉斯州顶级奢石核心矿坑,全球稀缺黑金共生矿脉,开采难度极大、成材率不足10%,矿石自带天然晶体矿脉与鎏金纹理,是高端典藏工艺品、顶奢艺术陈设的专属孤品石材,市场稀缺度极高。 艺术美学描述:深邃曜黑为底,天然琥珀暗调肌理交织细碎鎏金晶体纹路,金黑相融、明暗相生,宛若玄夜星河、曜石凝光。纹理内敛不张扬,奢华不浮夸,自带顶级典藏的尊贵气场,兼具暗黑极简的冷峻质感与鎏金奢石的高阶贵气,是少数能兼顾低调与顶奢的艺术材质。
⬅️ 左划查看全部图片
下面重头戏,开始制作视频。
同样是用LibTV的创作Agent,把需求简单清楚地提给它就好,并且把上面的素材和描述给到它。
Agent会首先定下创作基调,限定整体方向。
并自动设计分镜表。
然后根据分镜内容,生成首帧图和分镜视频。分镜视频全部搞定后,自动剪辑成片。
有问题的地方,直接跟Agent讲就好,不用手动去工作流里调。
下面就是完整工作流,但你完全不用去管这一坨。专业部分交给Agent,咱只需要指挥就好。
霞纹琥珀这个款式,我分别做了两个模型的对比版。分镜表和首帧图相同,单纯看视频生成效果。
MiniMax H3:
SeeDance 2.0:
我意外发现,人物表情和动作方面,H3的效果比SD2更好。用SD2创作过一些视频了,它生成的人物总是不太自然,表情和动作比较僵硬和迟缓,没有真人的灵动感。
还有就是H3不卡真人。之前用SD2做短片的时候,即使是虚拟形象,也经常会审核失败。
不硬吹H3,首次生成效果、指令遵循和一致性方面,确实SD2更胜一筹。
但最终版落地效果上,H3基本能达到SD2同等水平。虽然制作过程中,可能会更多次抽卡和微调,但谁让人家便宜呢!
另外两个款式我也用H3做了成片,大家感受一下。
云岫凝霜
黑金曜石:
上面所有这些,从产品设计到每个款式的宣传片,只花了我一天时间。
SD2、H3这种水平的模型,以及视频创作Agent出现之前,这起码是一两周的工作量,更不用提传统手搓时代了。
这就是 LibTV + MiniMax 的创作效率。
看完真实业务中的测试,可以总结出H3更适合的场景。
高频、走量、反复试错、低成本,这些商业场景,是H3相较于其他模型的舒适区。
比如电商产品宣传片、自媒体短视频、带货视频、品牌投流素材等等。这些场景里,数量和成本的权重大于单条高质量视频。
当然,H3也能干更重的活。TVC广告片、品牌质感大片、创意短片、漫剧、产品交互演示这类,H3也都搞得定。
如果你追求的是那种放大银幕上、每一帧都不能有瑕疵的顶级质感,并且预算充足,我其实更建议用SD2。
工具没有高下,只有合不合手。先想清楚自己的核心需求,就知道怎么选了。
下面聊点宏观的。
AI生文、生图领域,其实已经走进了卷价格的阶段。更准确的说法,应该是越来越多的模型,开始找到自己的定位。
早期卷几个硬性指标,谁在榜单前列谁就NB。现在定位更加细分,有聚焦写文的,有聚焦编程的,有聚焦执行方案的,有聚焦普及大众的,等等。
而打响这一枪的,可能是DeepSeek。
更深层剖析,其实是大众的观念,迈向了更理性的阶段。
从无脑冲最强模型、卷token消耗量,到考虑自己的实际场景、模型适配度、token投产比。
而AI视频领域,由于研发难度和监管问题,一直慢了半拍。
天下苦AI视频价格久矣。
每次给粉丝和群友推荐,冒出最多的问题就是:这太贵了吧。
而打响AI视频这一枪的,就是MiniMax H3。
不是SeeDance 2.0不行了,只是这个市场终于有了第二个认真的选项。后面会有越来越多平价模型入场,把高质量AI视频创作的价格,打到普通大众都用得起。
并且,每家的模型也会有各自的细分定位。画质好的、运镜专业的、真实感强的、一致性高的,等等。
更宏观一点,价格与细分能力,直接影响AI落地的规模化和渗透率,从而提高各行各业的生产力。
对我们这些普通创作者、创业者、小店老板、内容团队来说,落点特别具体。
你不用再攒一大笔预算才敢开机,不用为一条片子的成败提心吊胆。你可以今晚打开LibTV,用一套产品跑八个版本,明天就把视频挂上链接,后天根据数据再迭代一轮。
这种小步快跑的节奏,以前只属于文字和图片,现在轮到视频了。
就像开头讲的,我身边的例子。
上面实测中的设计图和宣传片,我都发给了那个老板,他很满意。我俩重新评估了AI视频成本,感觉这个事有得搞。
如果你也有类似的高频视频生成需求,预算又比较少,真心推荐MiniMax H3。当然,更要配上LibTV的强大创作Agent。
体验地址:https://www.liblib.tv
另外,H3上线这段时间,LibTV推出了限时优惠,2k低至0.2元/秒,768p低至0.1元/秒。
有需求的小伙伴,别错过这个福利,快去把H3放在你的真实场景试试吧。
如果你有任何看法,欢迎在评论区一起讨论
如果有一点收获,可以点赞、转发、推荐文章,关注「AI机器人茶馆」

