近日,人工智能公司MiniMax正式发布多模态生成模型H3。该模型支持文字、图像、音频及视频输入,可生成最高15秒、2K分辨率的视频,具备强大多模态上下文理解能力。目前已在广告、电商、产品设计等商业场景落地应用。相比同业,H3在768p分辨率下价格约为一半,2K分辨率下仅为三分之一,成本优势显著。分析认为,此举将进一步巩固MiniMax在AI视频生成领域的竞争力,并加速商业化进程。