6月7日安全的杠杆炒股app,阿里云更新技术博客:发布开源模型Qwen2-72B,阿里云称性能超过美国开源模型Llama3-70B,也超过文心4.0、豆包pro、混元pro等众多中国闭源大模型。所有人均可在魔搭社区和Hugging Face免费下载通义千问最新开源模型。
阿里云援引模型测评榜单OpenCompass,称此前开源的Qwen1.5-110B已领先于文心4.0等一众中国闭源模型。刚刚开源的Qwen2-72B,整体性能相比Qwen1.5-110B又取得了大幅提升。
(图说:在上海人工智能实验室推出的OpenCompass大模型测评榜单上,此前开源的Qwen1.5-110B已领先于文心4.0等一众中国闭源模型)
通义千问Qwen2系列模型大幅提升了代码、数学、推理、指令遵循、多语言理解等能力。在MMLU、GPQA、HumanEval、GSM8K、BBH、MT-Bench、Arena Hard、LiveCodeBench等国际权威测评中,超过美国的Llama3。
通义千问团队在技术博客中披露,Qwen2系列包含5个尺寸的预训练和指令微调模型,Qwen2-0.5B、Qwen2-1.5B、Qwen2-7B、Qwen2-57B-A14B和Qwen2-72B,其中Qwen2-57B-A14B为混合专家模型(MoE)。Qwen2所有尺寸模型都使用了GQA(分组查询注意力)机制,以便让用户体验到GQA带来的推理加速和显存占用降低的优势。
举报 第一财经广告合作,请点击这里此内容为第一财经原创,著作权归第一财经所有。未经第一财经书面授权,不得以任何方式加以使用,包括转载、摘编、复制或建立镜像。第一财经保留追究侵权者法律责任的权利。 如需获得授权请联系第一财经版权部:021-22002972或021-22002335;banquan@yicai.com。 文章作者一财科技
相关阅读 腾讯文生文模型将开源,下一代视频模型时长将超30秒腾讯也开始走大模型开闭源并行路线。
05-17 15:57 马斯克:特斯拉今年将在训练和推理人工智能方面投入约100亿美元5月17日,长兴县教育局工作人员表示,此事件中的(对教室环境所做的)环境检测报告已经出来,(检测结果)是正常的。
04-28 22:06 有望打败闭源模型?阿里、百度、腾讯云厂商抢食开源Llama 3算力开源模型参数有望继续增加,潜在算力需求攀升,云厂商嗅到机会。
04-22 18:10 解码AI|开启大模型“安卓”时刻,Meta刚刚干了一件大事OpenAI如何应对竞争将是下一步看点。
04-19 15:06 李彦宏称大模型领域开源最贵,文心大模型推出一年怎么样了?李彦宏表示安全的杠杆炒股app,大家以前用开源觉得便宜,其实在大模型场景下,开源是最贵的,所以开源模型会越来越落后。
04-16 15:22 一财最热 点击关闭