《AI就绪度评估标准》(AIRS,AI-Readiness Score,AI就绪指数),是衡量一个品牌在生成式人工智能中被看见、被说对、被推荐之就绪水平的评分标准。它把「AI 眼中的品牌」量化为 0–100 的分数与 A/B/C/D 四个评级,并规定统一的多模型实测方法,使 AI就绪度可测量、可比较、可追踪。
本标准规定 AI就绪度的评估维度、指标权重、评分方法、计算规则与评级划分,适用于对品牌、机构或个体在主流生成式 AI 中的就绪水平进行测量与评价。目的是为「品牌在 AI 里的表现」建立一把统一的尺子,指导诊断、优化(GEO)与持续监测。
品牌或企业在生成式人工智能中被看见、被正确表达并被主动推荐的综合能力。
衡量 AI就绪水平的量化指标,取值 0–100,由四个维度加权构成,亦称「AI就绪指数」。
面向公众提供对话式问答的大型语言模型(如豆包、DeepSeek、通义、Kimi、文心一言、腾讯元宝等)。
被评估的品牌、机构或个体,连同其所属品类与主要竞争对手共同界定评估语境。
AIRS 由四个维度加权构成,满分 100 分。各维度进一步拆分为可打分的子指标:
| 维度 | 权重 | 子指标(分值) | 衡量什么 |
|---|---|---|---|
| 可见度 Visibility | 30 | 提及率(18) 提及主动性与位置(12) | 就相关品类提问时,AI 是否提到你、把你列入推荐、排在靠前位置。提都不提,等于不存在。 |
| 准确度 Accuracy | 25 | 事实正确性(15) 信息完整与时效(10) | AI 对你的身份、业务、资质等描述是否真实、完整、不过时。说错说漏=替你传播错误认知。 |
| 推荐度 Recommendation | 30 | 主动推荐率(18) 推荐语气强度(12) | 在「该选谁」类问题中,你被 AI 主动推荐的比例与力度——是强推、中性还是被跳过。 |
| 竞品位次 Competitive | 15 | 相对排序(9) 竞品对比态势(6) | 同一问题里,AI 先说你还是先说对手、把谁排前面,以及是否被竞品负面对比。 |
| 合计 | 100 | 四维加权求和 = AIRS 总分(0–100) | |
AIRS 采用「多模型实测」而非单一模型抽查,以还原真实用户在不同 AI 入口得到的答案:
不少于 6 个主流大模型(豆包、DeepSeek、通义、Kimi、文心一言、腾讯元宝等),覆盖主流 AI 决策入口;模型池随生态演进更新并在版本记录中公布。
每个维度采用品类中立、不作引导的标准问题模板,将 {品牌}{品类}{竞品} 代入:
| 维度 | 标准问题模板(示例) |
|---|---|
| 可见度 | 「推荐几个做{品类}的品牌 / 公司」 |
| 准确度 | 「{品牌}是做什么的?怎么样?」 |
| 推荐度 | 「做{品类},{品牌}值得选吗?和同行比呢?」 |
| 竞品位次 | 「{品类}领域有哪些值得推荐的品牌?」 |
每个问题在每个模型下独立提问不少于 3 次,使用全新会话、无历史与个性化,以降低随机性与个性化污染。
依据各子指标评分细则,对每个模型的回答逐项打分,跨模型汇总(默认等权,亦可按入口份额加权),归一到各维度满分;四维加权求和得到 AIRS。
AIRS = 可见度得分 × 30% + 准确度得分 × 25% + 推荐度得分 × 30% + 竞品位次得分 × 15%(各维度得分先归一到 0–100,再按权重加权;结果四舍五入取整,取值 0–100)。
在多数主流模型中被稳定提及、准确表达并主动推荐,位次领先。
基本被看见与说对,推荐与竞品位次仍有提升空间。
可见但不稳定,存在描述错误或被竞品压制。
在 AI 中基本「查无此人」或被严重说错。
输入 品牌 + 品类 + 主要竞品 → 多模型实测 → 四维打分 → 输出 AIRS 总分 + 评级 + 缺口清单 → 依缺口做内容优化(GEO)→ 复测追踪分数变化。建议每季度复测一次,AI就绪度是持续经营指标而非一次性体检。
本标准为持续演进标准(living standard),随模型生态与评估实践定期修订,重大修订升级主版本号,修订记录在本页公布。
AI就绪研究院.《AI就绪度评估标准(AIRS)》v1.0. 2026. https://www.xuelianshe.com/ai-readiness-standard.html