中国信通院10项人工智能国际标准化成果实现新突破
2026年7月,国际电信联盟电信标准化部门第21研究组(ITU-T SG21)全会在瑞士日内瓦顺利举行。中国信息通信研究院聚焦大模型评估、智能体评估、智能化软件工程、世界模型、人工智能原生应用平台等核心方向,累计获得10项标准化成果,进一步完善了人工智能国际标准体系的整体布局。
大模型方向2项国际标准正式发布出版。本届全会审议通过了2026年5月第三工作组(WP3)中间会议工作报告,确认了各课题组的工作推进情况。中国信通院主导的2项大模型领域国际标准遵循ITU-T AAP程序顺利获批,目前已由国际电联正式发布并出版。
● ITU-T F.748.69(ex F.FMD)General technical framework and requirements of foundation model for mobile device/ 面向移动终端的大模型通用技术框架与要求
大模型正加速向手机、平板、机器人等终端设备延伸渗透,然而端侧算力受限、网络波动较大、功耗敏感等现实约束,使得云端大模型方案难以直接迁移,迫切需要面向终端场景制定专门的技术规范。本标准规定了终端大模型的整体架构、模型能力要求、模型适配要求及模型服务要求,为端侧大模型的研发、测试和落地应用提供指导依据。
●ITU-T F.748.74(ex F.RFE-MM)Requirements and framework for evaluation of multimodal foundation models/ 多模态基础模型评估要求与框架
多模态基础模型融合文本、图像、音视频等多种模态能力持续快速演进,但各厂商采用的评测口径各不相同,跨模态任务缺乏统一的评估基准,阻碍了模型的可信选型与持续优化。本标准构建了多模态基础模型评估框架,规定了测试场景、数据集、工具与流程,并针对感知、理解、生成、检索、推理等核心能力给出了可量化的评估手段。
智能体互操作标准与世界模型技术报告获全会审议通过。本届全会针对中国信通院主导的1项智能体领域国际标准和1项世界模型领域技术报告进行了审议,分别予以结项批准和通过审议,两项成果将进入正式发布流程。
●ITU-T F.748.93(ex F.AAI)Framework and Requirements for AI Agent Interoperability/ 智能体互操作性技术要求
当前智能体面临集成成本居高不下、跨系统互联存在壁垒等现实难题,业界亟需通过标准规范智能体的互操作机制及应用层交互流程。本标准涵盖互操作基础要素、互操作与交互、互操作应用三大模块:互操作基础要素明确了智能体互联协同过程中所需的基础数据和信息单元;互操作与交互明确了智能体的互操作流程与交互机制;互操作应用明确了智能体互联协同过程中的应用管理与应用保障。
●ITU-T FSTR.WM Technical framework and essential capabilities of World Models/ 世界模型技术框架及关键能力技术报告
世界模型作为物理世界理解与预测的关键模块,在自动驾驶、机器人等场景中展现出广阔的应用前景,但其技术路径与能力边界尚缺乏系统化梳理。本技术报告给出了世界模型的定义阐释、技术架构梳理与最新进展归纳,归纳了关键能力要素,并分析了典型应用场景,为后续相关研究与标准化工作奠定了重要基础。
智能体、智能化软件工程等方向6项新项目成功立项。本届全会还批准了中国信通院主导的3项新国际标准和3项新技术报告立项申请,覆盖智能体评估、智能体分类分级、智能体基础设施、智能化开发与运维工具、人工智能原生应用平台等多个方向。
●ITU-T F.ACAIA-B Assessment criteria for artificial intelligence agents: Benchmark/ 智能体评估标准:基准测试
智能体在各行业加速部署应用,但不同智能体之间缺乏统一的测试流程与可比的性能基准,难以客观衡量智能体的实际能力水平。本标准拟规定智能体基准测试框架,包含测试环境、数据集和工具等基准要素,以及通用能力与任务性能的评估范围,旨在为以可复现、可比较的方式评估智能体提供标准化方法。
●ITU-T F.EM-IDT Evaluation Methods and Metrics of Intelligent Development Tools for Multimedia Applications/ 智能开发工具评价方法与指标
智能开发、智能测试等软件研发工具层出不穷,但不同工具所采用的智能化能力指标计算方法差异显著,导致评估结果缺乏横向可比性。本标准以软件工程全生命周期为主线,覆盖需求分析与设计、开发、测试、运维四大阶段,系统构建各阶段智能化能力的度量指标体系与评估方法,对数据