清华发布大模型性能报告:GPT-4第一 更懂中文的还是百度
发布日期: 2023-08-10 11:00:36 来源: 快科技
【资料图】
8月10日消息,AI大模型成为今年的热点,OpenAI的ChatGPT一马当先,微软、谷歌、Meta紧随其后,国内科技巨头也迅速跟进,现在国内据说已经有上百款大模型问世了。
这么多大模型中,实力到底如何?日前清华大学新闻与传播学院发布了《大语言模型综合性能评估报告》,将国内外的大模型做了一番对比。
该报告还探讨了这些模型在不同知识领域,如创意写作、代码编程、舆情分析、历史知识等方面的回答情况,以及其在解决实际问题中的有效性和局限性。
从生成质量、使用与性能、安全与合规三个维度,对目前市场上的7个大型语言模型进行了全面的综合评估。
在这7款大模型中,GPT-4获得了毫无悬念的第一,第二名是百度的文心一言,其次是GPT-3.5,后面就是Claude、讯飞星火、阿里云的通义千问及昆仑的天工。
虽然GPT-4各方面领先,但是对国内用户来说,更懂中文的大模型才是关键,这方面百度的文心一言更好,在部分中文语义理解方面,文心一言以92%的得分率排名榜首,超越讯飞星火、GPT-4。
这跟百度的大模型包含大量中文文本有关系,因此能够更好地处理本土文化相关的内容。
关键词:
相关内容
- 清华发布大模型性能报告:GPT-4第一 更懂中文的还是百度 a>
- 江苏省公布2023年第七批预拌砂浆生产备案企业名单 a>
- 顺应民生期盼 推进老旧小区“升级换代” a>
- 淘米水有这么多好处,别说你还不知道 a>
- 《最后的真相》8月25日上映,黄晓明庭审激辨超长台词一镜到底 a>
- 四川达州、资阳发布人事动态 a>
- 超预期!报复性反弹! a>
- 宁夏最新油价是多少(2023年8月9日更新) a>
- 呈现5部经典民族歌剧,40名演员再现“喜儿”“小二黑”传唱经典 a>
- 北京巾帼心理援助服务队将为灾区妇女儿童提供心理咨询 a>
- 金融软件股再度活跃 指南针涨超7%再创历史新高 a>
- 国际油价上扬带动石油股,中国油气控股涨超7% a>
- 美联储推出新活动监管计划 a>
- 国家发改委:加强违约失信行为认定 全面健全政务信用记录 a>
- 杭氧股份于四川达州新设子公司,注册资本1.53亿 a>
- 俄称打击乌军人员装备 乌称击退俄军进攻 a>
- 元琛科技:8月9日融券卖出9155股,融资融券余额1.34亿元 a>
- 郊区树牢实干导向打造区域发展新样板 a>
- 四川广安可提供佳能数码复合机维修服务地址在哪 a>
- 一名殡葬专业学生晒课表:含墓地风水知识建议不要冲动报考 具体是什么情况? a>