清华发布大模型性能报告:GPT-4第一 更懂中文的还是百度
(相关资料图)
快科技8月10日消息,AI大模型成为今年的热点,OpenAI的ChatGPT一马当先,微软、谷歌、Meta紧随其后,国内科技巨头也迅速跟进,现在国内据说已经有上百款大模型问世了。
这么多大模型中,实力到底如何?日前清华大学新闻与传播学院发布了《大语言模型综合性能评估报告》,将国内外的大模型做了一番对比。
该报告还探讨了这些模型在不同知识领域,如创意写作、代码编程、舆情分析、历史知识等方面的回答情况,以及其在解决实际问题中的有效性和局限性。
从生成质量、使用与性能、安全与合规三个维度,对目前市场上的7个大型语言模型进行了全面的综合评估。
在这7款大模型中,GPT-4获得了毫无悬念的第一,第二名是百度的文心一言,其次是GPT-3.5,后面就是Claude、讯飞星火、阿里云的通义千问及昆仑的天工。
虽然GPT-4各方面领先,但是对国内用户来说,更懂中文的大模型才是关键,这方面百度的文心一言更好,在部分中文语义理解方面,文心一言以92%的得分率排名榜首,超越讯飞星火、GPT-4。
这跟百度的大模型包含大量中文文本有关系,因此能够更好地处理本土文化相关的内容。
关键词:
- 清华发布大模型性能报告:GPT-4第一 更懂中文的还是百度
- 罗普特:8月9日融资买入37.6万元,融资融券余额6278.37万元
- 陇神戎发:公司主打产品元胡止痛滴丸、宣肺止嗽合剂在全国范围均有销售,以院内市场销售为主
- 补贴发放缘何起纷争
- 《深圳市住宅设计品质提升指引(第1版)》下月起施行 新建超高层住宅每层5户至少配3台电梯
- 比亚迪迎高光时刻 第500万辆新能源汽车下线
- MIX Fold3真机完全展示来了:重新定义折叠屏
- 北京房山所有失联村复联 77个断路村全部实现通行
-
景峰医药:公司目前无美国上市计划及与国外公司合作开发新品的情况
景峰医药(000908)08月09日在投资者关系平台上答复了投资者关心的问题。
-
青岛科技大学:发挥工科高校产学研办学优势
中国山东网-感知山东8月9日讯主题教育期间,青岛科技大学立足自身办学
-
国家防总针对辽宁山东启动防汛防台风四级应急响应
据应急管理部消息,今年第6号台风“卡努”预计将于10日上午以强热带风
-
香港国安法实施至去年底有236人涉嫌危害国家安全被捕
中新社香港8月9日电 香港警务处9日发表2022年度年报。警务处处长萧
X 关闭
X 关闭