当前位置：首页 > 人工智能 > 正文

大语言模型综合性能评估报告发布：GPT-4获得毫无悬念的第一

2023-08-10 21:15:52　来源：凤凰科技网　

　　8月10日讯：AI大模型成为今年的热点，OpenAI的ChatGPT一马当先，微软、谷歌、Meta紧随其后，国内科技巨头也迅速跟进，现在国内据说已经有上百款大模型问世了。

　　这么多大模型中，实力到底如何？日前清华大学新闻与传播学院发布了《大语言模型综合性能评估报告》，将国内外的大模型做了一番对比。

　　该报告还探讨了这些模型在不同知识领域，如创意写作、代码编程、舆情分析、历史知识等方面的回答情况，以及其在解决实际问题中的有效性和局限性。

　　从生成质量、使用与性能、安全与合规三个维度，对目前市场上的7个大型语言模型进行了全面的综合评估。

　　在这7款大模型中，GPT-4获得了毫无悬念的第一，第二名是百度的文心一言，其次是GPT-3.5，后面就是Claude、讯飞星火、阿里云的通义千问及昆仑的天工。

　　虽然GPT-4各方面领先，但是对国内用户来说，更懂中文的大模型才是关键，这方面百度的文心一言更好，在部分中文语义理解方面，文心一言以92%的得分率排名榜首，超越讯飞星火、GPT-4。

　　这跟百度的大模型包含大量中文文本有关系，因此能够更好地处理本土文化相关的内容。

原标题：清华发布大模型性能报告：GPT-4第一更懂中文的还是百度

免责声明： IT商业新闻网遵守行业规则，本站所转载的稿件都标注作者和来源。 IT商业新闻网原创文章，请转载时务必注明文章作者和来源“IT商业新闻网”，不尊重本站原创的行为将受到IT商业新闻网的追责，转载稿件或作者投稿可能会经编辑修改或者补充，如有异议可投诉至：post@itxinwen.com

微信公众号：您想你获取IT商业新闻网最新原创内容，请在微信公众号中搜索“IT商业网”或者搜索微信号：itxinwen，或用扫描左侧微信二维码。即可添加关注。

标签：

品牌、内容合作请点这里： 寻求合作 ››

榜单

今日推荐

大语言模型综合性能评估报告发布：GP...

大语言模型综合性能评估报告发布：GPT-4获得毫无悬念的第一

相关阅读RELEVANT

榜单

今日推荐

科技互联