新华社研究院中国企业发展研究中心：人工智能大模型体验报告2.0

2023年08月14日
50 金币

日前，新华社研究院中国企业发展研究中心发布的《人工智能大模型体验报告2.0》（以下简称报告）显示，讯飞星火、百度文心一言、商汤商量和智谱AI-ChatGLM均表现抢眼，AI大模型的发展为人类工作和生活的提质增效均带来了正向积极的影响。今年以来，国内科技企业纷纷布局人工智能大模型。据不完全统计，在新一轮生成式AI热潮中，国内已经出现了上百个大模型。天眼查数据显示，截至2023年上半年，与“大模型”直接相关的融资事件超20起。为进一步直观感受我国当前主流科技企业所推出的大模型产品的现状、优势和特点，新华社研究院中国企业发展研究中心于今年7月启动了本次报告研究。与2023年6月首次发布的《人工智能大模型体验报告》相比，本次测评在题目设计、对标Benchmark（人类）、打分权重、专家测评团队四大维度进行了全面升级。其中，在题目设计方面，测评题目由300道扩展至500道，并进一步完善了题目分类；在对标Benchmark方面，本次测评将接受过高等教育的人类作为对照，来考评大模型真实能力；在打分标准上，本次测评根据对产业、生活的实际价值，对基础能力、智商能力、情商能力和工具提效四大测评维度进行了权重设计；在测评团队方面，本次测评特邀北京大学文化与传播研究所及其他产界、学界专家全程参与。