出现舆情的原因,是社会热切关注大模型是从2022年OpenAI发布ChatGPT(使用GPT3.5模型)开始,导致忽略了前面的GPT-2、GPT-3,了解2018年就有了GPT-1、BERT等情况的更少。大模型正式源头是大家都知道的2017年Transformer架构的提出,思想理论萌芽更早,有人甚至追溯到上个世纪50年代香农提出的(统计)预测下一个单词的熵。当然早期模型的体量都不大,甚至不是Transformer的完全体,比如1.17亿参数的GPT-1放在今天妥妥的是个小模型。中国第一个大模型是智源Wudao1.0,2021年3月发布,研究型的,国内其实相关探索2018年前后就起步了,只是早期有些进展没到可发布的程度。2021年4月发布的盘古大模型也是国内第一个(2020年立项),不过盘古这个属于是第一个产业级大模型,时间在2022年声名鹊起的GPT-3.5前面,但是在2020年5月发布的千亿参数的GPT-3后面。所以盘古的确是中国AI大模型先驱,“中国发布的第一个大模型就是盘古大模型”基本没说错,但“全球先驱”肯定说不上。“全世界都不知道大模型为何物的时候”,转换成“国内相当一部分社会舆论不知道大模型为何物的时候”,准确一点。这次属于表述不严谨,不过说一点没基础也不是。人发言不是大模型做推理,都有说突噜了的时候,是不是可以忽略。