AILI 五大维度共 25 项核心指标,全部基于公开、可核验的数据源 — 我们公示每一项的源头、版本号与更新频率。
PitchBook、Crunchbase、CB Insights — 季度同步。
Google Scholar、Semantic Scholar、OpenReview — 月度抓取。
IDC、Gartner、Forrester 公开报告 — 半年度更新。
USPTO、WIPO、EPO、CNIPA 与各国监管公示 — 月度同步。
GitHub、Hugging Face、PyPI 与 npm — 模型/包的实质性贡献评估,月度刷新。
NIST AI RMF、ISO/IEC 42001 公开认证、模型红队报告与安全事件库。
1. 自动采集 — 标准化 ETL 管道每月拉取最新数据;
2. 交叉核验 — 同一指标至少 2 个独立数据源比对,差异 > 10% 触发复核;
3. 人工抽检 — 数据组每榜单年度抽检不少于 30% 候选样本;
4. 异议复核 — 任何外部实名异议触发的复核数据全部留痕,纳入下一版本方法论改进。
API 拉取 + 公开网站爬取 + 申报上传,全程加密传输。
每条记录附带 source_id / snapshot_at / version 三元组,可回溯任意榜单年度。
对异常值进行 winsorization 处理,避免单一离群点扭曲分布。
原始抓取与衍生指标分库归档,保留 7 年用于审计。
VANGUARD 向已认证学术机构开放 AILI 历年数据接口(v2024、v2025、v2026),仅限非商业研究使用;商业使用须签署许可协议。
所有数据集均附带方法论版本号、ETL 哈希与变更日志,确保任一引用均可在 7 年内复现。