神力就是科技华为云发布盘古大模型5.0:解难题做难事,重塑千行万业
2024-12-26 13:23:47
体育资讯
facai369
交汇点讯 6月21日,华为开发者大会2024(HDC 2024)正式揭幕,华为常务董事、华为云CEO张平安发布盘古大模型5.0,在全系列、多模态、强思维三个方面全新升级。盘古5.0推出适配不同业务场景多种规格模型,并与物理世界结合,加速大模型行业落地。
华为常务董事、华为云CEO张平安发布盘古大模型5.0
张平安介绍,本次发布的盘古大模型5.0主要有全系列、多模态、强思维的特点。“全系列是指盘古大模型5.0包含不同参数规格的模型,以适配不同的业务场景。十亿级参数的Pangu E系列可支撑手机、PC等端侧的智能应用;百亿级参数的Pangu P系列,适用于低时延、低成本的推理场景;千亿级参数的Pangu U系列适用于处理复杂任务,可以成为企业通用大模型的底座;万亿级参数的Pangu S系列超级大模型是处理跨领域多任务的超级大模型,能帮助企业更好地在全场景应用AI技术。”张平安解释说。
而多模态指的是盘古大模型5.0能够更好更精准地理解物理世界,包括文本、图片、视频、雷达、红外、遥感等更多模态。在生成方面,盘古5.0可以生成符合物理世界规律的多模态内容,让创新随心所欲。
例如,在多模态识别方面,盘古大模型5.0能够识别卫星遥感图像,准确分析出区域农作物的生长情况,用于产量预估、病虫害监测等。还能识别红外影像,当夜间通过可见光无法看清的时候,盘古5.0能够通过红外影像精准地识别车辆的位置,进行交通违停的管理;此外,盘古5.0能够通过可见光和雷达的影像综合判断该地区的植被覆盖情况,帮助生态部门进行自然保护地的监测。
华为常务董事、华为云CEO张平安发布盘古大模型5.0
在内容生成方面,在自动驾驶领域,盘古大模型5.0通过创新的可控时空生成技术,结合场景视频生成、4D BEV视频生成、自动驾驶仿真库及路网信息,能更好地理解物理规律,大规模生成和实际场景相一致的驾驶视频数据,还可以灵活增加控制条件,生成不同路况、不同光照、不同天气的训练视频数据,加速自动驾驶技术的快速成熟。
此外,复杂逻辑推理是大模型成为行业助手的关键。盘古大模型5.0将思维链技术与策略搜索技术深度结合,极大提升了数学能力、复杂任务规划能力。例如,在一道立体几何题中,需要证明图中的直线PQ与三棱柱的侧面平行。盘古大模型5.0可以将输入的2D图片在3D空间中进行推理,首先给出了正确的解题思路,并通过思维链多步生成和策略搜索,一步一步完成题目的证明。
张平安表示,一直以来,华为云盘古大模型都坚定地聚焦行业,在解难题、做难事的道路上不断攻坚克难,砥砺前行,重塑千行万业。华为云将与所有客户、伙伴和开发者一起,创新不止,攀登不止,让云无处不在,让智能无所不及,加速千行万业的智能升级。
在过去的一年中,盘古大模型持续深耕行业,已在30多个行业、400多个场景中落地,在政务、金融、制造、医药研发、煤矿、钢铁、铁路、自动驾驶、工业设计、建筑设计、气象等领域发挥巨大价值。
新华日报·交汇点记者 张宣