天下工厂产业研究院 天下工厂产业研究院

SERIES

工厂数据三部曲

围绕「一个国家怎么知道自己有多少家工厂、在哪里、造什么」这一个问题的三篇五万字长文:第一篇解剖当代产业数据的地基与方法论,第二篇回溯一百二十年的组织史,第三篇推演 2026—2031 年的三条路径与二十个先行信号。

3篇研究

第 1 篇

数据要素的第一公里:中国制造业工厂数据的采集、加工与流通

五万字长文。2025 年全国数据生产总量 52.26 ZB,结构化存储只占约百分之一;A 股 5000 多家上市公司账面确认的数据资产合计 37.86 亿元。制度屋顶四年封顶,地基仍然悬空——悬空的那一段是「第一公里」:把散落在工商登记、招聘、招投标、报关、专利、展会里的公开信息,加工成可信、可调用的产业数据产品。本文以「中国到底有多少家工厂」这个没有标准答案的问题为解剖样本,拆解工厂数据的八个字段、六类来源、九个常见误判,讨论按次调用的定价、智能体时代的接口重写、合规边界,以及加工这件事为什么至今没有人被指定去完成。

第 2 篇

谁认识这家工厂:中国工厂信息的一百二十年

五万字编年史。从 1902 年的两家商会、1918 年商务印书馆的第一本企业名录、1931 年二十五项的工厂登记附表,到 1957 年广交会开幕、1985 年的 35.8 万家、1995 年的 734.2 万个、1992 年骑自行车收商情的慧聪、1999 年的阿里巴巴、2015 年的一照一码、2023 年的 404.9 万个制造业法人单位,再到大模型与调用接口——本文按「工厂信息的组织方式」把一百二十年分成认脸、目录、名录、平台、公示、接口六个时代,看每一代人怎么回答同一个问题:一个国家怎么知道自己有多少家工厂、在哪里、造什么。结论是:这从来不是一项可以被完成的工程,而是一项必须被持续支付的运营。

第 3 篇

2031 年的工厂数据:三个情景、七个变量、二十个信号

五万字情景推演。以 2026 年已经锁定的八条基线为起点——52.26 ZB 与约 1% 的结构化率、404.9 万制造业法人单位、封顶的制度屋顶、37.86 亿元入表、场内 5%、两年降 280 倍的推理成本、1000 个工业智能体目标、三条合规硬线——拆出七个驱动变量,推演公共底座、运营底座、模型直采三个情景(外加一个「停滞」情景),逐字段、逐场景、逐行业看它们的分野,给出三个分叉点、二十个先行信号、七条假设与六条证伪条件,以及五类主体在所有情景下都不会后悔的动作。核心判断:加工不会被取消,会被分层;可信度是唯一不能靠技术突破的边界。