MiniMax H3 官方 API 有个很好用的功能:Context-IR
我用同一个提示词、同一张首帧,分别生成了两段 10 秒 768P 视频。第一段直接生成,第二段经过 Context-IR
它能够把提示词 “甜笑后强忍悲伤” 拆成 吸气、笑容僵住、嘴角颤动、吞咽、肩膀下沉,再补上推镜和声音设计
IR 的本质是通过深度解析跨越文本、图像、音频和视频生成更丰富语义细节上下文
对比下来,IR 版强忍悲伤的过程更细,情绪转折也更连续,能够让生成的视频细节更加丰富、真实
@MiniMax_AI @Hailuo_AI