返回首页
AI on Medium··行业媒体

MiniMax H3: video that arrives with its own soundtrack, self-hosted

中文摘要

MiniMax H3 是一个 330 亿参数的全能 Transformer 模型,可在单一潜空间流中同时生成视频与立体声。

English Summary

MiniMax H3 is a 33B parameter omni-transformer that simultaneously predicts video and stereo sound within a single latent stream.

原文节选

A 33-billion-parameter omni-transformer that predicts picture and stereo sound in the same latent stream — running on a DGX Spark in our… Continue reading on Medium »