跳到主内容
智联观察
Esc

    SG21/Q5

    子工作组 / 任务组

    Agent & LLM Benchmarking

    智能体与大模型评测(SG21 Q5)

    ITU-T 应用层的 AI 标准主阵地,负责智能体与大模型基准评测。跨组联动最多的一个单元:与 SG13 对接大模型云平台与边缘推理的传输特性,与 SG17 联动引入安全要求——是「评测」议题在 ITU-T 的枢纽。

    2

    已录条目

    2

    在研 / 申请中

    0

    已结项

    3

    涉及议题域

    本单元条目为人工维护(该组织无公开状态接口),请以 CCSA 官网立项公告为准。

    已录条目

    智能体与大模型评测 在研

    智能体、大模型基准评测标准(应用层)

    与 SG13 接口要求对接、与 SG17 安全要求联动

    立项状态
    在研
    记录日期
    2026-09-06
    来源
    人工维护
    TR.FRES 在研

    技术报告(TR)· 绿色 AI 度量体系

    与 SG5 的 AI 算力基础设施能耗评估形成技术互补

    立项状态
    在研
    记录日期
    2026-09-06
    来源
    人工维护

    跨组织对应(同一议题,谁在做)

    按议题域对齐:下面列出该单元所覆盖议题域中其他标准组织的对应单元。这个对应关系由议题域自动汇聚,不是手工维护的对照表。

    智能体能力评测、互操作测试、一致性验证、成熟度分级

    能力声明与发布、能力匹配算法、服务绑定与语义描述

    智能体行为审计与追溯、权限撤销、内容偏好与合规、责任界定