清华上线大模型性能报告：GPT-4第一更懂中文的还是百度

发布时间：2023-08-10 11:09:18 所属栏目：动态来源：

导读：各大 AI 公司积极投入研发资金以推动 ChatGPT 等大型模型的开发与推广。中国互联网公司及政府机构也在加快布局大模型的研究与发展。可以预见的是未来几年内将会有大量不同类型的大模型涌现出来。

这么多大模型中，

各大 AI 公司积极投入研发资金以推动 ChatGPT 等大型模型的开发与推广。中国互联网公司及政府机构也在加快布局大模型的研究与发展。可以预见的是未来几年内将会有大量不同类型的大模型涌现出来。

这么多大模型中，实力到底如何？日前清华大学新闻与传播学院发布了《大语言模型综合性能评估报告》，将国内外的大模型做了一番对比。

该报告还探讨了这些模型在不同知识领域，如创意写作、代码编程、舆情分析、历史知识等方面的回答情况，以及其在解决实际问题中的有效性和局限性。

从生成质量、使用与性能、安全与合规三个维度，对目前市场上的7个大型语言模型进行了全面的综合评估。

在这7款大模型中，GPT-4获得了毫无悬念的第一，第二名是百度的文心一言，其次是GPT-3.5，后面就是人工智能Claude、自然语言处理的讯飞星火、阿里云的通义语音识别的千问及百度昆仑的天工。

虽然GPT-4各方面领先，但是对国内用户来说，更懂中文的大模型才是关键，这方面百度的文心一言更好，在部分中文语义理解方面，文心一言以92%的得分率排名榜首，超越讯飞星火、GPT-4。

这跟百度的大模型包含大量中文文本有关系，因此能够更好地处理本土文化相关的内容。这一点在国内也有不少厂商采用这种方式，例如华为的emui系统，就是基于中文的系统设计。

（编辑：聊城站长网）

【声明】本站内容均来自网络，其相关言论仅代表作者个人观点，不代表本站立场。若无意侵犯到您的权利，请及时与联系站长删除相关内容!

Socks5协议是什么？有	免费格式转换器哪些好
谷歌地图正在被抛弃	物联卡实名后不注销会

清华上线大模型性能报告：GPT-4第一 更懂中文的还是百度

清华上线大模型性能报告：GPT-4第一更懂中文的还是百度