Llama 3 正式登场,AI界的“巨无霸”来袭!🎉
火爆全球的 AI 大模型家族又添新丁,它就是——Llama 3!那个自带神秘力量的AI语言模型,已经踩着七彩祥云,正式C位出道啦!
8B和70B两员大将齐亮相,训练数据量比它的前辈Llama 2狠劲儿升级了不止7倍,达到15Ttoken,上下文扩容到能hold住128K个token,这推理和编码能力,简直像是给AI装上了超时空传送门,嗖一下就把信息处理得明明白白!最最最让人惊喜的是,Llama 3 的中文能力简直不要太强!以后和它对话,直接用中文招呼就行了,再也不用费劲巴拉地翻译成英文了。听说社区还有大佬正在开发中文版,估计很快就能和大家见面。
这位70B猛将,据说它已经在战场上把gpt-3.5-turbo无情碾压,虽然还没达到GPT-4那种登峰造极的地步,但也足以让一众对手瑟瑟发抖!
不过,重头戏还在后面——Llama3家族还有一个隐藏大佬,400B dense模型正低调蓄力中,虽说是目前推理效率的小矮人(毕竟GPT-4那个大家伙可是220B激活的MoE模型,全身上下1.2TB参数,那叫一个壕),但它却自信宣称自己的实力能与GPT-4肩并肩,就问你惊不惊喜?意不意外?别急,几个月后它就要揭开面纱,向世界展示真正的技术!
最近这阵子,国外开源模型界那是锣鼓喧天、鞭炮齐鸣,Command r plus、mistral 8x22b这些大神级模型纷纷崭露头角,再加上咱们今天的主角Llama3,妥妥地吊打国内不少闭源模型,让它们感受到了压力山大!
尤其是那个即将登场的400B大佬,一旦解开束缚,开源阵营怕是要全面碾压国内闭源势力,成为AI江湖的新霸主!当然啦,写古诗这种文艺范儿的事儿,可能它还需要喝几壶茶,读几卷书,修炼一番才能达到咱们本土模型的深厚内功哦!

