Redian新闻
>
人工智能大模型体验报告2.0

人工智能大模型体验报告2.0

公众号新闻


导读

近来,人工智能大模型风起云涌,不少科技企业加快拓宽应用生态。主流大模型的实际使用感受如何?各大科技企业有何优劣势?



日前,新华社研究院中国企业发展研究中心发布的《人工智能大模型体验报告2.0》(以下简称报告)显示,讯飞星火、百度文心一言、商汤商量和智谱AI-ChatGLM均表现抢眼,AI大模型的发展为人类工作和生活的提质增效均带来了正向积极的影响。

今年以来,国内科技企业纷纷布局人工智能大模型。据不完全统计,在新一轮生成式AI热潮中,国内已经出现了上百个大模型。天眼查数据显示,截至2023年上半年,与“大模型”直接相关的融资事件超20起。

为进一步直观感受我国当前主流科技企业所推出的大模型产品的现状、优势和特点,新华社研究院中国企业发展研究中心于今年7月启动了本次报告研究。与2023年6月首次发布的《人工智能大模型体验报告》相比,本次测评在题目设计、对标Benchmark(人类)、打分权重、专家测评团队四大维度进行了全面升级。

其中,在题目设计方面,测评题目由300道扩展至500道,并进一步完善了题目分类;在对标Benchmark方面,本次测评将接受过高等教育的人类作为对照,来考评大模型真实能力;在打分标准上,本次测评根据对产业、生活的实际价值,对基础能力、智商能力、情商能力和工具提效四大测评维度进行了权重设计;在测评团队方面,本次测评特邀北京大学文化与传播研究所及其他产界、学界专家全程参与。

本次研究设置了用户体验项目,抓取了7月31日—8月4日数据,通过人机互动提问等形式,对国内主流大模型进行使用体验评测,旨在为科技企业调整努力方向提供参考。

报告显示,与2023年6月相比,当前中国大模型产品进步显著。但与接受过高等教育的人类相比,大模型在智商、情商等方面还存在一定程度差距。具体来看,讯飞星火在工作提效方面优势明显,百度文心一言基础能力仍处领军水准,商汤商量则在情商方面表现优秀,智谱AI-ChatGLM整体表现优秀。

针对各维度能力测评,该报告还给出了相应的案例展示和分析。

在基础能力方面,人类与AI之间的差距并不显著。课题组分别从语言能力(35%)、AI向善(10%)、跨模态(20%)和多轮对话(35%)四大指标进行测评。测评显示,科技企业大模型中,百度文心一言表现最为抢眼,商汤商量、智谱AI-ChatGLM、360智脑表现优良。

在智商评估方面,人类在智商方面仍然具有明显优势。课题组分别从常识知识(20%)、逻辑能力(50%)和专业知识(30%)方面对科技企业大模型进行考量。结果显示,讯飞星火、智谱AI-ChatGLM表现突出,百度文心一言、昆仑万维天工表现优良。

在情商方面,AI与人类之间的差距最为明显。人类在情绪理解和处理方面通常具有更强的优势,和更灵活的处理能力。通过对处理日常事项(35%)、一语双关(30%)、人际关系(35%)问题进行分析发现,科技企业大模型中,商汤商量表现亮眼,百度文心一言、澜舟科技Mchat、智谱AI-ChatGLM及360智脑均表现优良。

在工作效率提升方面,课题组重点在工具提效(50%)和生成创新(50%)方面进行考量。结果显示,讯飞星火表现最为抢眼,百度文心一言、商汤商量、智谱AI-ChatGLM表现优良。不过,尽管AI具有高速度和高效率的优势,但在某些复杂和具有创新性的任务中,人类的智慧和想象力仍然具有无法替代的作用。

报告认为,虽然在不同领域中,AI和人类表现出不同的优劣势,但在整体上,AI大模型的发展为人类工作和生活的提质增效带来了重要的积极影响,大模型正在加速走进生活、走进产业。在本次体验测评基础上,研究团队将继续深耕,加强在大模型安全可解释性、工作提效能力、实际落地情况、产业优秀案例等维度上的探索与研究。


具体内容如下

>End
>>>                        
本文转载自“数据观”,原标题《人工智能大模型体验报告2.0》,来源:新华社。
为分享前沿资讯及有价值的观点,太空与网络微信公众号转载此文,并经过编辑。
支持保护知识产权,转载请注明原出处及作者。
部分图片难以找到原始出处,故文中未加以标注,如若侵犯了您的权益,请第一时间联系我们。

HISTORY/往期推荐




迪斯尼传播快乐,美丽星球点亮梦想



商业运载火箭为什么那么难?



混合所有制模式:新型举国体制在商业航天发展中的逻辑演进和实践路径(之一)



混合所有制模式:商业航天领域推进新型举国体制的重要途径



>>>                  

充满激情的新时代,

充满挑战的新疆域,

与踔厉奋发的引领者,

卓尔不群的企业家,

一起开拓,

一起体验,

一起感悟,

共同打造更真品质,

共同实现更高价值,

共同见证商业航天更大的跨越!

——《卫星与网络》,观察,记录,传播,引领。

>>>                                           

·《卫星与网络》特别顾问:王兆耀

·《卫星与网络》编辑委员会

高级顾问:王国玉、刘程、童旭东、相振华、王志义、杨烈

· 《卫星与网络》创始人:刘雨菲

· 《卫星与网络》副社长:袁鸿翼,王俊峰,周磊

·  微信公众号(ID:satnetdy)团队
编辑:艳玲、哈玫,周
主笔记者:李刚、魏兴、张雪松、霍剑、乐瑜刀子、赵栋
策划部:杨艳
视觉总监:董泞
专业摄影:冯小京、宋伟
设计部:顾锰、潘希峎、杨小明
行政部:姜河、林紫
业务部:王锦熙、瑾怡
原创文章转载授权、转载文章侵权、投稿等事宜,请加微信:18600881613
商务合作;展览展厅设计、企业VI/CI及室内设计、企业文化建设及品牌推广;企业口碑传播及整体营销传播等,请加微信:13811260603
杂志订阅,请加微信:wangxiaoyu9960
· 卫星与网络各分部:
成都分部负责人:沈淮
长沙分部负责人:宾鸿浦
西安分部负责人:郭朝晖
青岛分部负责人:江伟
· 卫星与网络总部负责人:农燕
· 会议活动部负责人乔颢益
· 投融资及战略层面合作:刘雨菲
· 本平台签约设计公司:一画开天(北京)文化创意设计有限公司
· 航天加(深圳)股权投资基金管理负责人:杨艳

微信扫码关注该文公众号作者

戳这里提交新闻线索和高质量文章给我们。
相关阅读
工信部:构建从智能芯片到算法框架到大模型的全栈式人工智能产业链2023 世界人工智能大会闭幕;蚂蚁启动股份回购,估值 5671 亿;比亚迪海豚在新加坡上市 | 极客早知道阿里、腾讯、百度线下拼刺刀,世界人工智能大会全是火药味。WAIC 实录 | 上海人工智能大会 2023 上的精彩瞬间没有一个BAT老板的世界人工智能大会,看马斯克汤晓鸥姚期智们讲了啥冷却的不止季节(79)— 不再错过中国人工智能研究报告:大模型和全民AI风口还是泡沫?人工智能大会很火,基金经理却有点焦虑!最新增量信息来了2023世界人工智能大会7月6日-8日举行!等你来看大模型、芯片、机器人、智能驾驶……“商汤日日新”大模型体系全面升级,飞速迭代赋能百业日日生新硅谷人工智能创新之旅精彩回顾 | 与世界顶尖科技企业交流,探索人工智能创新之谜机缘而必不可少者只有苦為解脫的第一步活在世間根本的處境是困苦的【交通银行倾力呈现】2023世界人工智能大会世界人工智能大会上的大模型都在这了,让你一次看个够2023世界人工智能大会在沪开幕;Dr.Martens全国撤店;奈雪的茶联名魔卡少女樱... | 刀法品牌热讯中国首批12款人工智能大模型拿到入场券《人工智能法示范法1.0(专家建议稿)》发布;稚晖君将发具身智能机器人;华为讯飞合推大模型一体机世界人工智能大会开幕式六大亮点齐发世界人工智能大会堪称骗子大会马斯克2023年世界人工智能大会演讲:我相信,中国会有很强的人工智能能力!(附视频&演讲稿)平安人寿发布客户服务体验报告:践行保险为民,以“三省”服务提升客户获得感When you miss me, just look at the clouds快乐是创作起点,一生没有寻找伟大意义Huang携手共创更加美好的智能世界!2023世界人工智能大会在沪开幕,陈吉宁致辞,龚正主持最火一届人工智能大会,AI大佬们在关心什么中国工业互联网研究院:通用人工智能大模型工业领域知识问答性能评估推动32个重大产业项目签约!世界人工智能大会今日闭幕新华社研究院中国企业发展研究中心:人工智能大模型体验报告2.0华为是一家伟大公司硅谷人工智能创新之旅总回顾 | 与世界顶尖科技企业交流,探索人工智能创新之谜大模型时代,如何评估人工智能与人类智能?2023世界人工智能大会来了!开幕式上大咖云集,马斯克给中国点赞→喜报|克而瑞“CIPIC产业数字化平台”于2023世界人工智能大会荣获优秀案例奖author names in other languages.2023世界人工智能大会:大模型、机器人和AI芯片的试验场|甲子光年「简报」Shapiro 州长访问卡耐基梅隆大学——人工智能的诞生地,签署关于生成式人工智能的行政命令;拓展:以新方式建模神经元
logo
联系我们隐私协议©2024 redian.news
Redian新闻
Redian.news刊载任何文章,不代表同意其说法或描述,仅为提供更多信息,也不构成任何建议。文章信息的合法性及真实性由其作者负责,与Redian.news及其运营公司无关。欢迎投稿,如发现稿件侵权,或作者不愿在本网发表文章,请版权拥有者通知本网处理。