这么多大模型中,实力到底如何?日前清华大学新闻与传播学院发布了《大语言模型综合性能评估报告》,将国内外的大模型做了一番对比。
该报告还探讨了这些模型在不同知识领域,如创意写作、代码编程、舆情分析、历史知识等方面的回答情况,以及其在解决实际问题中的有效性和局限性。
从生成质量、使用与性能、安全与合规三个维度,对目前市场上的7个大型语言模型进行了全面的综合评估。
在这7款大模型中,GPT-4获得了毫无悬念的第一,第二名是百度的文心一言,其次是GPT-3.5,后面就是Claude、讯飞星火、阿里云的通义千问及昆仑的天工。
虽然GPT-4各方面领先,但是对国内用户来说,更懂中文的大模型才是关键,这方面百度的文心一言更好,在部分中文语义理解方面,文心一言以92%的得分率排名榜首,超越讯飞星火、GPT-4。
这跟百度的大模型包含大量中文文本有关系,因此能够更好地处理本土文化相关的内容。
相关:
水利部部署受灾地区做好农村供水保障近期,海河流域发生流域性大洪水,松花江流域发生强降雨,对部分地区农村供水工程造成较大损毁。水利部深入贯彻习近平总书记关于防汛救灾工作的重要指示精神,落实中央领导同志批示要求,加强组织调度,对京津冀、..
三星S24 Ultra相机规格曝光 配备5000万像素长焦镜头8月9日,手机中国从外媒了解到,三星S24 Ultra将配备5000万像素3倍长焦镜头。外媒还报道称,三星S24将采用与S23 Ultra相同的2亿像素传感器,而10倍潜望式镜头预计会有小幅改进,但目前尚不清楚1200万像素超广角..