2023人工智能大模型体验报告3.0-新华社研究院
报告摘要
中国企业发展研究中心发布《人工智能大模型体验报告30》,分析大模型产品市场竞争、技术进步及厂商表现。报告指出,从10版到30版的测评显示,厂商在技术实力和市场竞争力方面持续提升,竞争格局逐渐形成。10版测评中,ChatGPT系列占据优势,科大讯飞星火与阿里通义千问等国内厂商排名靠前;至30版,科大讯飞星火保持领先,商汤商量和澜舟科技孟子表现突出,部分新厂商如字节跳动豆包崭露头角。
测评体系优化方面,30版采用机器自动化初评结合专家复核,题库扩充至1000道,取消加权计算以提高客观性,并增加技术潜力评估维度。评测维度涵盖基础能力、智商、情商及工具提效,分别对应模型准确性、逻辑推理、人文关怀及专业场景应用能力。测评结果显示,科大讯飞星火在基础能力、技术实力和工具提效方面表现均衡;商汤商量和澜舟科技孟子在特定领域如视觉处理和文化数字化上具有优势;360智脑、昆仑万维天工等在多语言翻译、代码生成等专业场景表现优异。
厂商案例展示中,科大讯飞星火应用于航空领域,通过结合飞行安全知识库实现机场运营优化和智能客舱服务;澜舟科技孟子推动文化数字化,助力中华传统文化传播;商汤商量与电力行业合作开发AI平台,提升客服效率;智谱AI结合电子签约企业打造智能合同管理系统,提升法律审查效率。报告同时指出,大模型仍面临稳定性、幻觉现象及安全合规问题,需持续优化算法和评估体系。未来需加强技术与产业融合,推动大模型在更多垂直领域落地,并探索可持续的商业模式以避免技术泡沫。
总结显示,大模型技术迭代加速,市场竞争加剧,厂商在技术能力和场景应用上呈现差异化发展。尽管存在挑战,但产业合作与政策支持为大模型深化应用提供了机遇。报告建议进一步完善评测机制,提升模型可靠性,并加快技术与实体经济的结合以实现价值转化。
试读结束,高清完整版pdf/doc/ppt,请点下载