点击右上角微信好友

朋友圈

请使用浏览器分享功能进行分享

正在阅读:权威测评报告发布,这款国产工业大模型表现突出
首页> 科技频道> 人工智能 > 正文

权威测评报告发布,这款国产工业大模型表现突出

来源:光明网2025-12-30 13:35

  近日,中国工业互联网研究院发布《人工智能大模型工业应用能力测评报告》。报告显示,由北电数智自主研发的“骄阳・工业大模型”在核心工业场景能力评测中表现突出,尤其在工具调用、多步推理、工业标准问答、产品客服四项关键评测维度,位列参评国产大模型首位。

  据了解,本次测评重点突出面向智能体任务应用特点,围绕自主规划、多步推理、工具调用、环境交互等能力维度,进行大模型智能体组件级能力测试。同时,在场景能力方面,首次面向工业标准问答、工业单据识别等大模型创新场景进行应用成熟度测评。

  在智能体工具调用能力测试中,“骄阳·工业大模型”综合排名位列国产大模型第一,在工具选择与参数匹配等细分能力上表现突出,标志着模型具备强大的自主或半自主执行任务能力,可通过与多系统交互,优化或辅助复杂工业流程落地,为工业场景自动化运营奠定基础。

  在智能体多步推理能力测试中,“骄阳·工业大模型”展现了出色的记忆管理、任务多步执行与错误检测能力。在实际工业环境中,模型在处理类似设备故障诊断、工艺参数优化等复杂的工业任务流程时,能够准确调用历史信息与中间结果,减少人工干预成本,实现更高效、更精准的工业化运营与流程优化。

  在智能体自主规划能力测试中,“骄阳·工业大模型”的表现位居国产大模型前列。在任务分解、约束识别与动态校准三项细分能力上具有突出优势,这让模型能够根据不同条件,实时优化生产排程、资源调度等多约束复杂任务;同时,出色的自主规划能力也让模型能够将长流程目标系统拆解为可执行步骤,从而提升智能排产、工艺优化等工业场景下决策的可靠性与敏捷性。

  此外,工业场景能力测试专项中,“骄阳·工业大模型”在工业标准问答、产品客服能力等方面表现优异。

  作为北电数智面向泛工业场景自主研发的大模型,“骄阳·工业大模型”已在装备制造、医疗器械、家纺印刷等领域部署应用,并取得多项标杆成果。(战钊)

[ 责编:蔡琳 ]
阅读剩余全文(

相关阅读

您此时的心情

光明云投
新闻表情排行 /
  • 开心
     
    0
  • 难过
     
    0
  • 点赞
     
    0
  • 飘过
     
    0

视觉焦点

  • 科学报国正当时|以“芯”报国显担当

  • 中国制造“十四五”成就展在国博开幕

独家策划

推荐阅读
光明日报北京12月29日电 记者姚亚奇29日从国家林草局获悉,“十四五”期间,我国采取有力措施,加快推进林草种苗振兴,收集保存林草种质资源14.74万份,较“十三五”末增长180%,我国重要乡土树种草种和珍稀濒危林草种质资源得到有效保护。
2025-12-30 09:23
由自然资源部南海生态中心联合相关单位共同编制的《黄岩岛珊瑚礁生态调查报告》29日在京发布。报告基于船舶走航、潜水调查、卫星航空遥感、原位观测等方式,结合历史数据分析,对黄岩岛珊瑚礁生态状况进行了调查评估。
2025-12-30 09:23
松花江畔,风机和光伏正齐齐出力,一端是新能源电力源源不断产出;另一端,化工装置稳定运行,“绿色石油”涌流而出。
2025-12-30 09:37
执行中国第42次南极考察任务的“雪龙”号极地科考破冰船于北京时间29日顺利抵达秦岭站海域,并开展卸货作业。
2025-12-30 09:32
研究人员在火星发现了适合人类探索的浅层水冰的痕迹。研究团队借助高分辨率轨道影像,对火星地貌进行了研究,并在中纬度的亚马孙平原发现了埋藏深度不足1米的冰痕迹。易获取的冰能够让宇航员在火星长期生存与工作期间,制备饮用水、可呼吸的氧气、燃料及其他必需品。
2025-12-30 09:27
截至12月28日,新疆油田2025年二氧化碳注入量突破100万吨,成为我国首个实现年注碳百万吨的油田。”新疆油田公司执行董事、党委书记石道涵介绍,油田年注碳量从2022年的12.6万吨跃升至2025年的100万吨,已累计注入二氧化碳超200万吨。
2025-12-30 09:26
12月26日,我国首个覆盖6种轮状病毒血清型的六价轮状病毒疫苗在湖北武汉完成首剂接种。
2025-12-29 10:23
美国哈佛—史密森尼天体物理中心天文学家利用美国国家航空航天局(NASA)的哈勃空间望远镜,首次观测到围绕年轻恒星运行的迄今最大原行星盘——IRAS 23077+6707。
2025-12-29 10:10
2025年12月27日0时07分,我国在西昌卫星发射中心用长征三号乙运载火箭成功发射风云四号C星(03星),卫星顺利进入预定轨道,发射任务取得圆满成功。
2025-12-29 10:07
中国科学院空天信息创新研究院研究员王振友团队联合四川省文物考古研究院等机构的科研人员,自主研制了显微时间门控拉曼光谱仪,并利用该仪器对三星堆出土的4块象牙碎片进行无损检测,揭示了象牙在长期地质作用下的老化过程。
2025-12-29 10:01
近期,工信部发布《场景化、图谱化推进重点行业数字化转型的参考指引(2025版)》,聚焦14个重点行业,绘制企业数字化转型“场景导航图。
2025-12-29 09:59
当日,石景山区AI for Science平台正式上线,该平台由枫清科技携手火山引擎联合打造,以AI驱动科研机构与企业的科研效率革新,降低科研门槛。
2025-12-27 20:21
记者25日从国防科技大学获悉,该校磁浮团队近日在磁悬浮试验中,成功在两秒内将吨级试验车加速至700公里/小时。测试速度打破了同类型平台全球纪录,成为全球最快的超导电动磁悬浮试验速度。
2025-12-26 10:08
12月24日,中国科学院重大科技基础设施“载人潜水器与海上作业母船”用户委员会2025年度会议披露:我国“深海勇士”号、“奋斗者”号、“蛟龙”号三大载人潜水器全年完成314次深潜,累计下潜总量达1746次,2026年将向2000次目标稳步迈进。
2025-12-26 10:05
日前,国家自然科学基金委员会在北京召开国家自然科学基金首批重大非共识项目遴选会议,标志着重大非共识项目正式启动试点。国家自然科学基金委员会将深入实施并持续优化重大非共识项目遴选机制,引导广大科研人员聚焦高水平原创性科研工作狠下功夫。
2025-12-26 09:59
其实,流感和普通感冒不是一回事,用药自然不能一概而论。流感一来往往会发高烧(体温39—40摄氏度),浑身肌肉酸痛、没力气,症状重;普通感冒多是鼻塞、流鼻涕、喉咙痛,发烧也多是低热,症状轻。
2025-12-26 09:58
一项近日发表于《科学》的研究指出,像ChatGPT 这样的人工智能(AI)工具正在大幅增加论文产量。此类文本数量的不断增加,使同行评议、资金决策和科研监督变得复杂,因为越来越难区分有意义的研究成果和低价值的内容。
2025-12-26 09:56
传统探查手段在如此深的地下几乎“失明”,无法精准捕捉地质特征。这项工程的成功实施,填补了我国超深埋输水隧洞注浆治理技术的空白,标志着我国在深埋地下工程地质探查与注浆治理领域达到国际领先水平。
2025-12-25 09:42
24日上午,随着最后一方混凝土浇筑完成,宁波舟山港六横公路大桥二期工程——青龙门特大桥双主塔成功封顶。青龙门特大桥位于浙江舟山,横跨青龙门水道,连接宁波梅山岛与舟山佛渡岛。
2025-12-25 09:45
24日,我国最大超深凝析气田——中国石油塔里木油田博孜—大北气田天然气年产量突破100亿立方米,生产凝析油91.89万吨。为攻克上述难题,塔里木油田持续攻关,推动气田开发实现从深层向超深层、从高压向超高压、从优质储层向复杂储层的三大跨越。
2025-12-25 09:44
加载更多