返回首页  设为首页  加入收藏  今天是:
网站首页人工智能商业智能智能家居智能手表智能手机智能通信智能电视智能汽车智能机器人
相关文章
 体验感受哪家强?《人工智能…
 @想提高經濟、管理效益的企業…
 2023中国消费品牌增长峰会—…
 人工智能需要哪些专业
 从网红饮食菜单里洞察食品饮…
 一杯咖啡引发的“战争”
 2023亚洲消费电子展及5G应用…
 好的智能锁应该具备哪些条件…
 双喜临门 莫干山板材、全屋定…
 七度蝉联载誉归来!王力安防…
 2022-2023十大家居创新优选品…
 索尼股价的暴跌:折射中国和…
 中国智能手机出货量降幅收窄…
 TechInsights:2023年Q2传音…
 中国信通院:2023 上半年国内…
 老人日常用智能手机还有哪些…
 中国十大名表有哪些牌子?手…
 中国十大名表有哪些牌子值得…
 2023年国产手表十大品牌排行…
 钱都去哪了?看看山西太原年…
 一场直播带货超百万元 抖音电…
 黑龙江各级工会:全力以赴做…
 无人机“空中基站”、卫星背…
 冲锋在前!黑龙江移动青年突…
 闻汛而动!湖南移动星夜驰援支…
 洪水围困近70小时这个法庭没…
 好看的车文有几本 国内十大车…
 什么是激光电视?海信激光电…
 2023年传媒公司十大品牌排行…
 激光电视机100寸推荐海信激光…
 2023年电视挂架十大品牌排行…
 聚焦智能网联汽车 拓展产业发…
 “人工智能法学研究奖”颁奖…
 官宣|GTM2023(第六届)全球…
 2023中国智能车大会暨国家智…
 汽车智能化拐点已至 赛力斯汽…
 科大讯飞提出的中国首个ISOI…
 小场景推动大创新 AI质检助力…
 浪潮人工智能工业质检方案引…
 财经要闻
 人工智能如何赋能不良资产处…
 智能客服技术的发展让人机交…
 电话那头的人工智能客服其实…
 人工客服难接通智能客服不“…
 人民财评:智能客服切忌聪明…
 人工智能智能客服:提升客户…
 供应链管理服务行业分析
 供应链风险因素分析
 2022年中国供应链物流行业市…
 供应链物流行业市场分析
专题栏目
网络
您现在的位置: 智能制造网 >> 人工智能 >> 正文
高级搜索
体验感受哪家强?《人工智能大模型体验报告20》发布
作者:佚名 文章来源:本站原创 点击数: 更新时间:2023/8/13 14:22:39 | 【字体:

  封神太子2黄天化加点大模型风云起涌,不少科技企业加快拓宽应用生态。主流大模型的实际使用感受如何?各大科技企业有何优劣势?8月12日,新华社研究院中国企业发展研究中心发布的《文心一言、商汤商量和智谱AI-ChatGLM均表现抢眼,AI大模型的发展为人类工作和生活的提质增效均带来了正向积极的影响。

  今年以来,国内科技企业纷纷布局大模型。据不完全统计,在新一轮生成式AI热潮中,国内已经出现了上百个大模型。天眼查数据显示,截至2023年上半年,与“大模型”直接相关的融资事件超20起。

  为进一步直观感受我国当前主流科技企业所推出的大模型产品的现状、优势和特点,新华社研究院中国企业发展研究中心于今年7月启动了本次报告研究。与2023年6月首次发布的《人工智能大模型体验报告》相比,本次测评在题目设计、对标Benchmark(人类)、打分权重、专家测评团队四大维度进行了全面升级。

  其中,在题目设计方面,测评题目由300道扩展至500道,并进一步完善了题目分类;在对标Benchmark方面,本次测评将接受过高等教育的人类作为对照,来考评大模型真实能力;在打分标准上,本次测评根据对产业、生活的实际价值,对基础能力、智商能力、情商能力和工具提效四大测评维度进行了权重设计;在测评团队方面,本次测评特邀北京大学文化与传播研究所及其他产界、学界专家全程参与。

  本次研究设置了用户体验项目,抓取了7月31日—8月4日数据,通过人机互动提问等形式,对国内主流大模型进行使用体验评测,旨在为科技企业调整努力方向提供参考。

  报告显示,与2023年6月相比,当前中国大模型产品进步显著。但与接受过高等的人类相比,大模型在智商、情商等方面还存在一定程度差距。具体来看,讯飞星火在工作提效方面优势明显,文心一言基础能力仍处领军水准,商汤商量则在情商方面表现优秀,智谱AI-ChatGLM整体表现优秀。

  在基础能力方面,人类与AI之间的差距并不显著。课题组分别从语言能力(35%)、AI向善(10%)、跨模态(20%)和多轮对线%)四大指标进行测评。测评显示,科技企业大模型中,文心一言表现最为抢眼,商汤商量、智谱AI-ChatGLM、360智脑表现优良。

  在智商评估方面,人类在智商方面仍然具有明显优势。课题组分别从常识知识(20%)、逻辑能力(50%)和专业知识(30%)方面对科技企业大模型进行考量。结果显示,讯飞星火、智谱AI-ChatGLM表现突出,百度文心一言、昆仑万维天工表现优良。

  在情商方面,AI与人类之间的差距最为明显。人类在情绪理解和处理方面通常具有更强的优势,和更灵活的处理能力。通过对处理日常事项(35%)、一语双关(30%)、人际关系(35%)问题进行分析发现,科技企业大模型中,商汤商量表现亮眼,百度文心一言、澜舟科技Mchat、智谱AI-ChatGLM及360智脑均表现优良。

  在工作效率提升方面,课题组重点在工具提效(50%)和生成创新(50%)方面进行考量。结果显示,讯飞星火表现最为抢眼,百度文心一言、商汤商量、智谱AI-ChatGLM表现优良。不过,尽管AI具有高速度和高效率的优势,但在某些复杂和具有创新性的任务中,人类的智慧和想象力仍然具有无法替代的作用。

  报告认为,虽然在不同领域中,AI和人类表现出不同的优劣势,但在整体上,AI大模型的发展为人类工作和生活的提质增效带来了重要的积极影响,大模型正在加速走进生活、走进产业。在本次体验测评基础上,研究团队将继续深耕,加强在大模型安全可解释性、工作提效能力、实际落地情况、产业优秀案例等维度上的探索与研究。

人工智能录入:admin    责任编辑:admin 
  • 上一个人工智能:

  • 下一个人工智能: 没有了
  •  
     栏目文章
    普通人工智能 体验感受哪家强?《人工智能大模型体验报告20… (08-13)
    普通人工智能 智能客服技术的发展让人机交互更加便捷智能 (08-13)
    普通人工智能 电话那头的人工智能客服其实一点也不神秘 (08-13)
    普通人工智能 人工客服难接通智能客服不“走心”新华社:其… (08-13)
    普通人工智能 人民财评:智能客服切忌聪明反被聪明误 (08-13)
    普通人工智能 人工智能智能客服:提升客户服务质量的新途径 (08-13)
    普通人工智能 徐汇滨江的这家银行 正为人工智能产业发展注入… (08-12)
    普通人工智能 助力双碳开利举办第五届“绿建我行”研讨会 (08-12)
    普通人工智能 聚焦应用成果转化赛道 2023浦东新区人工智能创… (08-12)
    普通人工智能 打造银行服务新标杆!银行智能质检系统助您迈… (08-12)
    普通人工智能 农发行兰考县支行:扎实开展微信客服平台及智… (08-12)
    普通人工智能 内蒙古教育招生考试智能客服系统上线试运行 (08-10)
    普通人工智能 “小安”来了! (08-10)
    普通人工智能 喜鹊声声智能客服系统:一套软件解决企业营销… (08-10)
    普通人工智能 奇富科技披露2023年消保半年报:累计保护用户… (08-10)
    普通人工智能 UCloud优刻得上线镜像助力AGI应用发展 (08-10)
    普通人工智能 在线客服系统“中心化”整合浪潮来袭 (08-10)
    普通人工智能 喜鹊声声在线客户服务系统:免费试用全程自动… (08-10)
    普通人工智能 社保问题24小时免费咨询春节不打烊!智能客服… (08-10)
    普通人工智能 中心地带计划推出免费WEB客户服务系统 (08-10)