Chinese AI firm MiniMax launched its advanced H3 video-generation model, capable of processing text, images, video, and audio, intensifying competition with ByteDance and Kuaishou.

Seedance 2.5 and H3 have been designed to create longer content as both companies double down on multimodal context understanding

36氪获悉,MiniMax宣布正式发布MiniMax H3。据介绍,这是一款通用的全模态生成模型,支持对文本、图像、视频、声音组成的多模态上下文的统一理解能力、能够输出具备原生双声道的音视频,最高可支持15s 2K分辨率。MiniMax表示,计划在未来几天内,在符合相关法律法规的前提下,开放模型权重。