直接结论:“2025 年中国人工智能核心产业规模超过 1.2 万亿元”和“智能体流量同比增长 7,851%”都有公开来源,但它们描述的是两套完全不同的数据。前者是中国 AI 核心产业的年度规模估计,后者是网络安全公司 HUMAN 在其防护平台观察到的智能体与智能体浏览器流量增速。两者不能相加,也不能互相证明“中国 AI 产业增长由智能体流量驱动”。

两组数字分别来自哪里
2026 年 3 月 5 日,中国政府网转引新华社消息:工业和信息化部部长李乐成表示,2025 年中国人工智能核心产业规模超过 1.2 万亿元,相关企业超过 6,200 家;规上制造业企业中采用 AI 技术的比例超过 30%。此前 1 月公开口径是“预计突破 1.2 万亿元、企业超过 6,000 家、智能算力规模 1,590 EFLOPS”。时间点不同,所以企业数和“预计/超过”的措辞不能混写。
7,851% 来自 HUMAN Security 的《2026 State of AI Traffic & Cyberthreat Benchmark Report》。该公司称,其平台在 2025 年分析了超过 1000 万亿次数字交互;其中自动化流量同比增长 23.51%,人类流量增长 3.10%,AI 驱动月流量从 1 月到 12 月增长 187%,智能体和智能体浏览器流量同比增长 7,851%。报告同时提醒,2024 年基数很低,巨大倍数反映早期采用加速,不能直接理解为智能体已占互联网流量的大多数。
| 指标 | 统计对象与单位 | 能回答什么 | 不能推出什么 |
|---|---|---|---|
| AI 核心产业超 1.2 万亿元 | 中国 2025 年核心产业规模,人民币 | 产业活动总体量级 | 不能等同上市公司收入、GDP 增量或生成式 AI 收入 |
| 相关企业超 6,200 家 | 纳入官方口径的企业数量 | 产业主体规模 | 不能证明每家盈利、同等规模或都做大模型 |
| AI 驱动流量增长 187% | HUMAN 平台内,2025 年 1 月至 12 月月流量变化 | 该观测网络中的年度内增长 | 不能当作全网市场份额 |
| 智能体流量增长 7,851% | 智能体与智能体浏览器同比增速 | 低基数类别扩张速度 | 不能证明机器流量已超过人类,也不能直接换算收入 |
先建立两张彼此独立的证据卡
| 证据字段 | 1.2 万亿元 | 7,851% |
|---|---|---|
| 发布主体 | 工信部部长公开表述,中国政府网/新华社转引 | 网络安全供应商 HUMAN Security |
| 观察期 | 2025 年产业年度 | 2025 年相对 2024 年 |
| 单位 | 人民币产业规模 | 供应商平台内流量同比增幅 |
| 分母 | “AI 核心产业”的统计范围 | 2024 年该平台识别的智能体流量 |
| 关键限制 | 不是 GDP、利润或纯大模型收入 | 低基数、客户样本、分类规则、非全网普查 |
| 复核材料 | 官方消息、此前预计口径、后续统计资料 | 报告专题页、PDF、发布说明和方法页 |
证据卡的作用是防止“同一天看到的数字”被误写成“同一项研究中的数字”。前者是官方公开的产业测算结果,后者是商业安全平台的网络观测。即使两者都在 2026 年发布,也没有共同分母、样本或计算公式,不能计算相关系数,更不能据此建立因果关系。
为什么 7,851% 看起来如此惊人
同比增速的分母决定视觉冲击。假设某类流量从 1 个单位增长到约 79.51 个单位,同比增幅就是 7,851%;但即便如此,它仍可能小于一个原本有 10,000 个单位、只增长 3% 的成熟类别。HUMAN 明确写道,智能体流量在 2024 年从很低的基数起步,因此解读时必须同时看绝对量、样本覆盖、分类方法和行业分布。
报告还显示,智能体活动集中于零售与电商、流媒体与媒体、旅游与酒店;产品与搜索页面占主要部分,账户、认证和结账页面也已出现智能体访问。这说明“从读取网页走向执行动作”值得网站运营和安全团队重视,但并不等于每一次自动访问都是有效客户,更不等于所有智能体都获得了用户授权。
复核报告方法页还要看到三个限制:数据来自 HUMAN 客户群体中的平台观测,不代表互联网全量;数据经过聚合和匿名化;“典型客户”和“高目标客户”分别使用中位数与第 90 百分位。AI 流量分类结合声明身份、行为特征和观测结果,User-Agent 可以被伪造。因此,网站自己的访问日志只能使用相同定义做趋势比较,不能直接套用 7,851% 作为本站增长目标。
把 7,851% 还原成可计算的式子
同比增幅的公式是:(本期值 − 上期值) ÷ 上期值 × 100%。7,851% 意味着本期约为上期的 79.51 倍,而不是 7,851 倍;如果上期只有 100 次,则示意性本期约为 7,951 次。这个例子只解释算术,不代表 HUMAN 的绝对请求数,因为公开报告没有在这条结论旁给出可供外部复算的完整分子和分母。
| 同时需要的量 | 缺失时会发生什么误判 | 运营上怎么补 |
|---|---|---|
| 基期绝对量 | 把低基数倍增误当成主流占比 | 保存去年同期同口径请求数 |
| 本期绝对量 | 只看到增速,不知业务影响 | 按日、页面、动作和身份分组 |
| 总流量分母 | 把类别增速写成全站份额 | 同时报告人类、已知爬虫、未知自动化 |
| 去重规则 | 重试、预取和批量抓取被当成用户 | 按会话/IP/验证身份建立多个视图 |
| 业务结果 | 把访问量等同线索、订单或引用 | 关联引用、注册、确认动作与真实转化 |
1.2 万亿元的“核心产业”是什么
核心产业规模是宏观统计口径,不是单一公司的营收,也不是只统计聊天机器人。它可能覆盖芯片、算法、数据、平台、模型、软件与行业应用等环节。不同机构使用营业收入、增加值、企业名录或上下游映射时,结果可能不同,因此转载时至少要保留年份、币种、“核心产业”限定和发布主体。
旧稿把 1.2 万亿元、1,590 EFLOPS、600 亿元产业投资基金、40 余项标准、智能体流量和中关村论坛拼成同一个“4 月 2 日重大事件”,这是错误的时间线。它们来自不同日期、不同发布者和不同统计目的。政策层面的《“人工智能+”行动意见》提出到 2027 年新一代智能终端、智能体等应用普及率超过 70%,这是目标值,不是 2025 年已经实现的市场渗透率。
“预计突破”与“已经超过”为什么要分开
2026 年 1 月的工信部发布会使用“据有关机构测算”“预计突破 1.2 万亿元”“企业超过 6,000 家”;3 月的公开表述更新为“规模超过 1.2 万亿元”“企业超过 6,200 家”。可核对中国政府网的1 月发布会整理。这说明后续口径更确定,但并不意味着 1 月到 3 月产业突然增加 200 家企业:更可能是统计完善、时间点更新或表述精化,公开材料没有给出可据此计算两个月净增的企业名录。
同理,若要写“同比增长近 30%”,还必须确认上一年度使用同一产业边界、同一测算机构和同一价格口径。没有方法附录和可比基期时,本文只保留“2025 年超过 1.2 万亿元”的官方公开结论,不自行反推 2024 年规模,也不把规模增长直接解释为利润、就业或生产率增长。
企业数量也不是质量分数。超过 6,200 家只回答纳入该口径的主体规模,不能说明每家公司均盈利、都拥有自研大模型或都达到相同技术水平。投资、采购或政策分析仍需查看企业主营业务、收入结构、研发投入、客户集中度和风险披露。
引用宏观数字时,宁可保留限定词,也不要为了标题简短而删除年份、单位、统计对象和发布主体。

网站日志如何区分搜索爬虫、AI 抓取与智能体
第一层是声明身份:User-Agent、反向 DNS、已公布 IP 范围或签名。第二层是行为:访问路径、速率、资源类型、是否执行脚本、是否维护会话。第三层是动作后果:只读取公开内容,还是进入账户、认证、购物车、结账和导出。身份声明只是线索,真正的访问控制不能只靠一个可伪造的字符串。
| 类别 | 典型目的 | 验证与指标 | 不要混淆 |
|---|---|---|---|
| 传统搜索爬虫 | 建立网页索引 | 官方爬虫验证、抓取统计、索引与点击 | 抓取量不等于排名 |
| AI 训练/数据抓取 | 收集训练或分析材料 | 公布的 bot 名称、robots 规则、日志趋势 | 不等于答案系统实时引用 |
| 搜索/回答抓取 | 响应用户问题并检索页面 | 引用、落地访问、查询与抓取时间 | 不等于训练许可 |
| 用户代理型智能体 | 在授权范围内浏览或执行任务 | 用户会话、授权、动作确认、审计轨迹 | 不能因“AI”身份绕过业务权限 |
| 未知自动化 | 可能是监控、采集、滥用或伪装 | 行为、速率、挑战结果和风险信号 | 不能仅凭高频就断言恶意 |
robots.txt 的语义以RFC 9309为基础,它表达抓取偏好,不是身份认证或访问授权。站点还应对照Bing 官方爬虫说明、Google 常见爬虫文档和OpenAI 爬虫说明核验具体声明,不应从第三方 bot 名单直接复制后永久放行。

网站运营者真正应该做什么
- 分开统计人类、搜索爬虫、AI 爬虫、实时抓取与智能体。不要仅凭 User-Agent 下结论;报告指出声明身份可能被伪造,还要结合 IP、行为、会话和请求频率。
- 把“被抓取”与“被引用”分开。AI 抓取次数多不等于内容被答案系统采用。对本站而言,应结合 Bing Webmaster Tools 的 AI 引用数据、落地页日志与真实转化判断,而不是追求机器请求数量。
- 保护高风险动作。登录、账户修改、支付和批量导出应使用最小权限、二次确认、速率限制、审计日志和可撤销授权;是否为 AI 不是唯一判断标准,动作风险更重要。
- 为可引用内容提供证据。标题中的数字必须在正文附近解释来源、统计期、单位和限制。原创表格、方法和纠错记录比重复新闻摘要更有长期价值。
- 保留原始数据快照。保存报告版本、抓取日期、查询条件和计算公式,避免一年后只剩一个无法复现的百分比。
建议至少保存 30 天可比较的分层指标:已验证爬虫请求、未验证自动化请求、人类会话、抓取成功率、4xx/5xx、带宽、被引用页面、引用带来的访问以及高风险动作的确认/拒绝率。是否延长日志保留期,应结合隐私、合规与成本确定。出现流量突增时,先按路径和响应体积判断是抓取、攻击、备份或部署,不要把所有带宽峰值都归因于“AI 访客”。
要理解智能体能做什么、哪些动作必须授权,可继续阅读站内的AI 智能体与自动化专题。需要区分宏观产业规模与具体产品能力时,可对照腾讯元宝产品与能力边界;理解模型处理语言任务的技术口径,可参考自然语言处理指南。如果某个术语仍不清楚,可从AI 词典查定义;本站如何选择来源、标注更新与处理纠错,见关于本站与编辑规范。
先把每个结论改写成可审计主张
判断一条行业数字能不能进入标题,最实用的方法不是看它是否“权威”,而是把它拆成主体、动作、对象、时间、单位和限制六个字段。本文的产业主张可以写成:“工信部部长在 2026 年 3 月公开表示,2025 年中国人工智能核心产业规模超过 1.2 万亿元。”流量主张则应写成:“HUMAN 在其客户平台观测中称,2025 年智能体与智能体浏览器流量相对 2024 年增长 7,851%,且 2024 年基数很低。”删除其中任何一个限定,都可能改变读者理解。
| 原子主张 | 证据强度 | 必须保留的限定 | 发布动作 |
|---|---|---|---|
| 2025 年核心产业规模超过 1.2 万亿元 | 官方公开表述,另有国家统计局材料交叉记录 | 中国、2025 年、核心产业、人民币、公开测算口径 | 可引用,不声称本站独立复算 |
| 相关企业超过 6,200 家 | 同一官方公开表述 | “相关企业”的纳入口径未附完整企业底表 | 不计算单企平均收入,不推断盈利率 |
| 智能体流量同比增长 7,851% | 供应商原始报告 | HUMAN 客户平台、2025 对 2024、低基数、分类模型 | 可解释增速,不写成全网份额 |
| 本期约为基期 79.51 倍 | 由同比公式直接换算 | 只是倍数关系,绝对分子分母未公开 | 明确标注为算术解释 |
| 产业增长由智能体访问驱动 | 没有共同样本、时间序列或因果识别 | 两组数字单位与统计对象完全不同 | 拒绝发布为事实 |
这种写法也适合 AI 摘要和搜索结果:一句话离开上下文后仍然携带年份、来源和边界,不容易被二次转述成另一项结论。对“超过”“预计突破”“同比增长”“月流量增长”这些词,编辑应保留原始动词;它们分别代表结果陈述、预测、跨年比较和年内首尾比较,不能为了句式整齐互换。
怎样用本站日志做一套可复现的 30 天观测
外部报告只能提供假设,本站是否真的出现智能体增长,必须从自己的服务器、CDN 与分析工具复算。建议先冻结一天的原始日志副本,并为每条请求生成匿名化观测字段:UTC 时间、请求路径、状态码、响应字节、声明身份、验证结果、会话线索、动作风险和来源渠道。IP 等可能涉及个人或安全的数据应按最小必要原则保存,分析报表优先使用聚合结果。
| 观测步骤 | 输入 | 输出 | 验收条件 |
|---|---|---|---|
| 建立基线 | 连续 7 天原始访问日志 | 按人类、已验证爬虫、声明但未验证、未知自动化分层 | 分类规则有版本号,未识别流量不被强行归类 |
| 验证身份 | User-Agent、官方 IP/rDNS 或签名资料 | 已验证与仅声明两列 | 不能验证时保留“未知”,不自动放行 |
| 规范计数 | 请求、重试、缓存命中、预取 | 请求数、去重会话、响应字节三套指标 | 任何百分比都能追溯分子与分母 |
| 连接结果 | 抓取、引用落地、注册与确认动作 | 发现、引用、访问、转化分开的漏斗 | 不把抓取请求计作用户或收入 |
| 按周复算 | 固定查询与规则版本 | 本周、上周、去年同期可比较表 | 规则变化时同时重算历史或标注断点 |
身份验证不必只依赖自建名单。除各平台官方爬虫文档外,CDN 或安全服务也可能提供经过验证的自动化分类;例如 Cloudflare 的官方 Bot 文档说明了已验证机器人、签名代理与行为检测等不同信号。它可以作为日志字段之一,但供应商标签也不是业务授权:即使身份真实,进入账户、修改数据或发起交易仍要按普通高风险操作完成认证、确认、限额和审计。
看到流量暴涨时,先排除四类假增长
7,851% 这样的数字容易让运营者把任何服务器峰值都解释成“智能体爆发”。实际排障应先看读写方向、响应体积、访问路径和时间分布。一次备份、镜像同步或主题部署可能制造高磁盘吞吐,却几乎不增加公网入站;搜索爬虫集中重抓会增加网页读取和出站带宽;恶意扫描常集中在登录、探测路径和大量 404;真实用户增长则通常会同时影响页面会话、静态资源、搜索查询与转化。四类现象不能只靠一条 CPU 或磁盘曲线判断。
| 峰值特征 | 优先假设 | 需要核对 | 错误动作 |
|---|---|---|---|
| 磁盘读接近上限,公网流量很低 | 备份、压缩、全盘扫描或本机复制 | 进程、打开文件、计划任务、云盘吞吐 | 把它当访客暴增并盲目扩容带宽 |
| 少数内容页产生连续大响应 | 爬虫重抓、资源下载或缓存未命中 | 验证身份、URL、状态码、响应字节、缓存 | 只按 User-Agent 永久放行 |
| 登录与不存在路径高频 401/403/404 | 扫描、撞库或错误客户端 | 速率、来源分布、挑战结果、账号风险 | 将所有机器流量归入 AI 推荐 |
| 搜索落地、页面会话和目标动作同步增长 | 真实发现或传播增长 | 查询、落地页、引用来源、转化质量 | 仅凭访问量宣布收入或用户增长 |
出现异常时应先保存证据,再暂停单个高负载任务或对特定路径限速;不要边清日志边排查。网站恢复后还要记录事件时间、根因、采取的动作和是否复发。这样既能防止把运维任务误认成流量,也能避免把真正的 AI 抓取、搜索发现或攻击全部混成一个“机器人”数字。
这两组数据能支持哪些业务决策
1.2 万亿元适合用于判断产业活动已经形成较大规模,并提示采购者继续细分算力、模型、软件与行业应用;它不适合直接给某家供应商估值。查看训练基础设施时,可把Megatron Core 并行训练指南作为技术能力核验样例;评估推理硬件时,可参考Groq LPU 选型与证据边界。这些技术页回答“系统怎样工作”,宏观规模回答“产业量级如何被公开描述”,两者仍不能相互替代。
7,851% 能支持的决策是尽快把自动化访问纳入日志、权限和容量治理,并为可引用内容提供稳定 URL、明确标题、结构化小节、来源和更新时间。它不能支持“放开所有机器人就能获得 AI 推荐”。模型或服务选型仍应回到任务、数据边界、成本与评测;例如Cohere 模型选型指南强调用任务和证据做决策,而不是用供应商声量替代测试。
| 角色 | 现在可以做 | 仍需补充的证据 |
|---|---|---|
| 内容团队 | 给数字补年份、主体、单位、方法和限制;建立更新记录 | Bing 查询、引用页面和真实落地表现 |
| 安全团队 | 区分读取与高风险动作,验证机器人身份,保留审计轨迹 | 误报率、绕过测试、账号与交易风险 |
| 基础设施团队 | 按路径、响应字节和缓存命中建立容量基线 | 峰值并发、磁盘/网络瓶颈、恢复时间 |
| 管理与采购 | 把宏观规模当背景,用可复现测试比较具体方案 | 供应商收入结构、交付能力、成本与退出方案 |
发布前一分钟检查:先问标题中的每个数字能否在正文相邻位置找到原始来源,再问来源是否真的测量了标题声称的对象;随后核对年份、币种、同比或环比、全网或平台样本、预测或结果。若只有百分比而没有绝对量,就明确写“公开材料未给出可供外部复算的完整分子分母”;若只有企业数量而没有企业清单,就不能计算单企均值;若两个数字没有共同样本,就不计算相关性。最后由另一名编辑只看标题、首段、图注和表格,复述他理解到的结论。如果复述成“智能体推动中国 AI 产业达到 1.2 万亿元”,说明页面仍会制造因果错觉,必须回到标题或首图继续修改。
发布后也不能只更新日期。官方口径、报告方法、分类规则或链接发生变化时,应记录旧值、新值、变更原因和影响范围;如果新资料推翻核心结论,应在正文顶部增加醒目的纠错说明,而不是静默覆盖。这样搜索引擎和 AI 系统抽取到单段内容时,仍能看到可追溯的责任主体和当前有效边界。没有变化也应保留复核日期、检查范围和复核人,并保存对应证据快照留档,避免“已更新”变成无法验证的装饰标签。
如何复核这两组数据
产业规模以中国政府网 2026 年 3 月 5 日的官方转引消息为主要依据,并用工业和信息化部 1 月发布的2025 年工业和信息化发展口径核对时间变化。政策目标参考国务院《关于深入实施“人工智能+”行动的意见》的国家数据局转载全文。
网络流量数据以 HUMAN Security 的报告专题页、完整 PDF及发布说明交叉核对。HUMAN 是网络安全供应商,其平台样本很大但不是互联网人口普查;解读时应保留供应商样本、分类方法与商业立场限制。资料复核日期为 2026 年 7 月 18 日。
后续官方交叉验证可查看国家统计局对“十四五”科技创新成就的系列报告,其中同样记录 2025 年 AI 核心产业规模超过 1.2 万亿元。它能增强数字来源的可追溯性,但没有公开一套足以让读者从企业明细重新汇总到 1.2 万亿元的完整底表,因此本文仍把它称为官方公开口径,而不是本站独立测算。
纠错与更新说明
本文由兰塞 AI 编辑流程于 2026 年 7 月 19 日复核。本次重写修复了旧稿全文乱码,并删除“工信部在 4 月 2 日确认”“智能体流量重塑互联网商业逻辑”“航天工厂 70% 业务已由智能体覆盖”“机器流量即将超过人类”等无来源或超出证据范围的结论;新增证据卡、同比算式、日志分类、动作风险、30 天可复现观测、异常流量归因与发布闸门。后续如官方修订 2025 年产业规模,或 HUMAN 公布可比较的新年度样本,将同时更新数值、统计期和口径说明,不只改发布日期。本站的来源、更新与纠错原则见关于本站与编辑规范。
