返回首页
量子位··国内权威源

何恺明首个语言模型:105M参数,不走GPT自回归老路

中文摘要

CV大佬何恺明发布首个105M参数语言模型,采用非自回归架构,不同于GPT模式。

English Summary

CV expert Kaiming He launched his first 105M parameter language model, avoiding GPT's traditional autoregressive path.

原文节选

顶级CV大佬也来卷LLM?