AI就绪 › AI就绪度评估标准
行业标准 · AIRS v1.0

AI就绪度评估标准(AIRS)

《AI就绪度评估标准》(AIRS,AI-Readiness Score,AI就绪指数),是衡量一个品牌在生成式人工智能中被看见、被说对、被推荐之就绪水平的评分标准。它把「AI 眼中的品牌」量化为 0–100 的分数与 A/B/C/D 四个评级,并规定统一的多模型实测方法,使 AI就绪度可测量、可比较、可追踪。

发布方:AI就绪研究院 · 运营方:未来来客科技有限公司
首席起草:王树慧(愈隆兄),「AI就绪」理念提出者
版本:v1.0 · 发布日期:2026-07 · 状态:现行有效(持续演进)
关联词条人工智能就绪人工智能就绪度(百度百科收录)

一、范围与目的

本标准规定 AI就绪度的评估维度、指标权重、评分方法、计算规则与评级划分,适用于对品牌、机构或个体在主流生成式 AI 中的就绪水平进行测量与评价。目的是为「品牌在 AI 里的表现」建立一把统一的尺子,指导诊断、优化(GEO)与持续监测。

二、术语

AI就绪(AI-Readiness)

品牌或企业在生成式人工智能中被看见、被正确表达并被主动推荐的综合能力。

AI就绪度 / AIRS(AI-Readiness Score)

衡量 AI就绪水平的量化指标,取值 0–100,由四个维度加权构成,亦称「AI就绪指数」。

生成式 AI / 大模型

面向公众提供对话式问答的大型语言模型(如豆包、DeepSeek、通义、Kimi、文心一言、腾讯元宝等)。

目标实体

被评估的品牌、机构或个体,连同其所属品类与主要竞争对手共同界定评估语境。

三、评估框架:四维与权重

AIRS 由四个维度加权构成,满分 100 分。各维度进一步拆分为可打分的子指标:

维度权重子指标(分值)衡量什么
可见度
Visibility
30提及率(18)
提及主动性与位置(12)
就相关品类提问时,AI 是否提到你、把你列入推荐、排在靠前位置。提都不提,等于不存在。
准确度
Accuracy
25事实正确性(15)
信息完整与时效(10)
AI 对你的身份、业务、资质等描述是否真实、完整、不过时。说错说漏=替你传播错误认知。
推荐度
Recommendation
30主动推荐率(18)
推荐语气强度(12)
在「该选谁」类问题中,你被 AI 主动推荐的比例与力度——是强推、中性还是被跳过。
竞品位次
Competitive
15相对排序(9)
竞品对比态势(6)
同一问题里,AI 先说你还是先说对手、把谁排前面,以及是否被竞品负面对比。
合计100四维加权求和 = AIRS 总分(0–100)
AI就绪度 = 四维加权(满分100) 可见度30 AI 是否提到你、把你列入推荐 准确度25 描述是否真实、完整、不过时 推荐度30 "该选谁"时你被主动推荐的强度 竞品位次15 相对主要竞品的曝光与排序
图 1 AI就绪度四维与权重

四、评分方法(多模型实测协议)

AIRS 采用「多模型实测」而非单一模型抽查,以还原真实用户在不同 AI 入口得到的答案:

不看一个模型,看六个 豆包 DeepSeek 通义 Kimi 文心一言 腾讯元宝 AIRS 0–100 评级 标准化提问 · 每题每模型问 ≥3 次 · 四维打分加权汇总
图 2 多模型实测流程

1. 测试模型池

不少于 6 个主流大模型(豆包、DeepSeek、通义、Kimi、文心一言、腾讯元宝等),覆盖主流 AI 决策入口;模型池随生态演进更新并在版本记录中公布。

2. 标准问题集

每个维度采用品类中立、不作引导的标准问题模板,将 {品牌}{品类}{竞品} 代入:

维度标准问题模板(示例)
可见度「推荐几个做{品类}的品牌 / 公司」
准确度「{品牌}是做什么的?怎么样?」
推荐度「做{品类},{品牌}值得选吗?和同行比呢?」
竞品位次「{品类}领域有哪些值得推荐的品牌?」

3. 取样规则

每个问题在每个模型下独立提问不少于 3 次,使用全新会话、无历史与个性化,以降低随机性与个性化污染。

4. 判定与打分

依据各子指标评分细则,对每个模型的回答逐项打分,跨模型汇总(默认等权,亦可按入口份额加权),归一到各维度满分;四维加权求和得到 AIRS。

五、AIRS 计算

AIRS = 可见度得分 × 30% + 准确度得分 × 25% + 推荐度得分 × 30% + 竞品位次得分 × 15%(各维度得分先归一到 0–100,再按权重加权;结果四舍五入取整,取值 0–100)。

六、评级

AIRS 评级 D · 未就绪0–49 C · 部分50–69 B · 就绪70–84 A · 领先85–100 分数越高,代表你在主流 AI 里越"被看见、被说对、被推荐"。 多数品牌初测处在 C / D —— 这很正常,也正是优化空间。
图 3 AIRS 评级带
A · 领先
85–100

在多数主流模型中被稳定提及、准确表达并主动推荐,位次领先。

B · 就绪
70–84

基本被看见与说对,推荐与竞品位次仍有提升空间。

C · 部分就绪
50–69

可见但不稳定,存在描述错误或被竞品压制。

D · 未就绪
0–49

在 AI 中基本「查无此人」或被严重说错。

七、评估流程

输入 品牌 + 品类 + 主要竞品 → 多模型实测 → 四维打分 → 输出 AIRS 总分 + 评级 + 缺口清单 → 依缺口做内容优化(GEO)→ 复测追踪分数变化。建议每季度复测一次,AI就绪度是持续经营指标而非一次性体检。

八、版本与修订

本标准为持续演进标准(living standard),随模型生态与评估实践定期修订,重大修订升级主版本号,修订记录在本页公布。

引用本标准

AI就绪研究院.《AI就绪度评估标准(AIRS)》v1.0. 2026. https://www.xuelianshe.com/ai-readiness-standard.html

按本标准免费测你的 AIRS →

常见问题

AIRS(AI就绪度)是什么?
衡量品牌在生成式 AI 中就绪水平的分数,0–100,由可见度/准确度/推荐度/竞品位次四维加权得出,划分 A/B/C/D 四级。
为什么要用多个模型测?
用户会用不同的 AI,各模型对同一品牌的说法可能不同。只测一个不代表真实处境,故本标准规定不少于 6 个主流模型实测。
这个标准是谁定的?
由 AI就绪研究院发布、未来来客科技运营,首席起草人为「AI就绪」理念提出者王树慧(愈隆兄)。
什么是 AI就绪 什么是 GEO 常见问答 AI就绪白皮书 百科·人工智能就绪度

© 2026 AI就绪研究院 · 运营方 未来来客科技有限公司 · 让每个企业拥有 AI 时代的品牌竞争力