Back to Home
AI on Medium··Industry Media

MiniMax H3: video that arrives with its own soundtrack, self-hosted

中文摘要

MiniMax H3 是一个 330 亿参数的全能 Transformer 模型,可在单一潜空间流中同时生成视频与立体声。

English Summary

MiniMax H3 is a 33B parameter omni-transformer that simultaneously predicts video and stereo sound within a single latent stream.

Original Excerpt

A 33-billion-parameter omni-transformer that predicts picture and stereo sound in the same latent stream — running on a DGX Spark in our… Continue reading on Medium »