
图/IC photo
一个原本只写在计费账单里的技术单位,正在被一座城市当作生产要素来对待。
9月18日,北京市经济和信息化局、北京市发展和改革委员会联合印发《北京市加快词元经济发展的行动方案(2026—2028年)》,提出打造“世界级词元工厂”。这是北京市级层面发布的首个围绕词元经济发展的专项行动方案。词元(Token)是人工智能时代大模型处理信息最基础的单位。将词元单独作为政策抓手,这份方案的新意不只是产业扶持,更在于为这一尚未形成全国统一标准的新型生产要素先行立规矩。
规模已经跑到了规则前面。行业估算显示,截至 2026 年 6 月,我国日均词元调用量已经冲高至 500 万亿量级,而 2024 年初还只有约 1000 亿;国内超过半数的词元生产集中在北京,仅豆包一家企业日均调用量就已突破 180 万亿。按照行业机构研判,词元全产业链在 “十五五” 期间有望迈向万亿级别。但调用量暴涨并不自动等于价值释放。
正如国家数据局局长刘烈宏在数博会专题活动上所阐释的,词元为AI服务的计量、定价、交易、结算构建起重要参照体系,这一度量体系的确立,进一步催生全新的产业商业模式。
症结在于,词元经济长期缺少一把全国通用的“度量衡”。国家数据专家咨询委员会委员、北京交通大学教授张向宏在接受媒体采访时分析,不同厂商采用不同分词技术,相同规模的数据切出的词元规模并不相同。他更关键的一个提醒是:一度电转化多少算力不固定,同等算力生成多少词元不固定,同量词元在不同模型中价值也不固定。行业至今没有形成类似1度电、1吨水、1GB流量那样的计量单位。缺少统一计量单位,价格就无从比照。在他看来,所谓“计价黑箱”,集中体现为计量数据、定价依据与第三方核验机制仍不透明。北京市经济和信息化局数字产业处副处长陈光明则从质量端指出另一重痛点:“同一个模型,用户通过不同渠道调用,生成内容的质量存在天壤之别。”
北京这份方案的价值,在于试图把这些缺口补上。它没有规定词元多少钱一个——陈光明明确表示,政府不会给词元定价,流通始终以市场化定价为主;它做的是建立词元质量评测体系、探索建设词元测试平台、打造词元分发平台,并制定覆盖词元吞吐速度、首字延迟、电能利用效率(PUE)等指标的“词元工厂”分级评价标准。规则由此第一次落到可测量的层面:不只问生产了多少,还要问快不快、稳不稳、省不省电。
先行先试的分量,正体现在这些可测量的规则里。市经信局数字产业处处长张金瑞表示,“市场在这里,需求在这里”,欢迎各类市场主体在北京开展相关业务试点。但试点能不能试出门道,还要看几处关口能不能闯过去。
“空转”是最需要提防的情形。倘若评价体系只盯产出数量,“刷词元”就有可能比“做好词元”更划算。方案提出“模型智能上限水平”这一概念,试图把关注点从词元消耗规模引向实际智能水平,后续关键要看分级评价体系能不能真正把优质词元筛选出来。
评测的公信力是另一道关口。按照方案设计,由软件企业与第三方评测机构合作建设测试平台;这套商业化协作路径具备可行性,但也随之带来 “既当运动员又当裁判员” 的潜在风险。评测机构的独立性,将决定这把度量之尺究竟是可靠的行业基础设施,抑或仅仅是又一层行业包装。
更靠近前端的是数据合规。词元的生产链条是“数据—算力—词元—应用”,前端的数据权属、流通边界与使用合规若无配套规则,后端的定价再精巧也站不住。方案提出探索数据本体技术范式;词元确权、数据流通与隐私保护的规则,仍需在更大范围内形成共识。
还应看到,分级评价目前只是一项地方标准,而分词规则与计量单位是全国乃至全球市场的问题,标准不互认,企业出海就要重新解释一次账单。
新要素崛起时,最常见的情形是产业先跑、规则后追,等乱象成形再回头补课。古人讲“不治已乱治未乱”,北京把评测、计量、分发平台和能效指标一并写进方案,是让规则先站到产业前面的尝试。检验它的标准很朴素:企业能不能用同一把尺子比价,用户能不能看懂自己那张账单,以及一份高额调用量背后,究竟是真实需求,还是一轮空转。
藻知科技评论员 程子姣
编辑 杨娟娟
校对 张彦君






