文章预览
中国大模型应用,正在进入“可观测期”。 《中国大模型中标项目监测报告(2024年5月)》中显示,截至5月,中国大模型的相关中标金额已经超过2023年全部中标项目的披露金额。 在大模型全面落地四处开花的同时,大模型正摆脱“不可观测”状态,过去由于大量大模型应用在B端,信息相对封闭,对于产业来说,他们很难清晰获知大模型技术水平、擅长领域、落地能力,无形中增加了智慧化转型的决策成本。 随着大模型技术评测体系的逐渐成熟,我们仿佛拥有了天文望远镜,可以在群星闪耀中,找到那颗最耀眼的星。 最近,国际权威机构IDC发布了《中国大模型市场主流产品评估,2024》,智源研究院打造的FlagEval天秤大模型评测平台也发布了最新一期模型评测排行榜单,两项评测中百度文心大模型实现了双榜夺魁。 “望远镜”背后技术评价机制
………………………………