南都讯近日,《北京经济技术开发区关于支持词元驱动智能经济高质量发展的若干措施(试行)》(以下简称“词元十条”)正式发布,明确提出,目标到2030年,区域智能经济产业规模力争突破4000亿元。
据悉,这是北京市首个“词元经济”专项政策,旨在着力推进词元(Token)价值转化,形成“工厂供词元、平台分词元、社区用词元”的完整产业闭环,全力打造区域经济高质量发展新引擎。
“词元十条”明确,在芯片侧将加大推理专用芯片研发扶持力度,探索集成电路系统级架构创新。在模型侧加速推理效能跃升,推动通用模型与行业专用模型协同研发,提升端侧推理效率。在数据侧持续深化监管沙盒机制创新,鼓励具身智能、自动驾驶、医疗健康等重点领域的数据交易流通,探索以词元交易为基础的数据定价模式。通过打造全要素保障体系,为词元工厂建设提供全方位支撑。
上述政策提出,要建设自主可控的“万卡级词元工厂”,对推动批量词元生产的企业,将给予一定资金支持。每年还将继续发放算力券、数据券各1亿元,对开展推理效能跃升的企业,按照算力租赁费用的30%,给予最高2000万元的资金支持;按照年度数据交易金额的10%,给予采购主体最高100万元资金支持。不断降低基础设施建设和企业运营成本,全面提升单位能效下的词元产出效率与系统稳定性。
据北京市经开区介绍,目前北京市首个词元工厂北京壹号词元工厂、北京市首家国资词元工厂京算词元工厂先后在北京亦庄正式点亮。未来,北京亦庄还将优化土地、能耗等要素保障,高标准推动万卡级词元工厂建设,支持各类主体推动批量词元生产。
所谓词元(Token),是大模型处理文本、代码、图像、音频、视频等所有信息时采用的最小运算单元,正在成为人工智能服务的计量单位、结算单位和统计单位。据国家数据局介绍,截至今年6月底,我国日均Token消耗量已经突破30万亿。
南都记者梳理发现,不只是北京,广东也将“词元经济”纳入政策规划。今年6月,广东省政务服务和数据管理局发布《广东省释放数据要素价值促进词元经济高质量发展若干措施》,明确提出到2027年底,将广东打造为全国词元供给高地、智能应用标杆和词元出海枢纽。
具体而言,广东将围绕加强高质量数据供给、夯实基础设施建设、建立健全词元交易体系、培育数创企业多元主体、畅通国际数据跨境通道、优化词元经济发展环境等方面,推进词元经济的发展。
国家层面也释放了利好词元经济发展的信号。今年6月初,国家数据局出台的《关于推进行业高质量数据集建设行动的实施方案》提出,探索词元交易等新型交易模式,构建以词元为基础,可量化、可定价的数据价值体系。
5月22日,国家数据局还专门召开词元经济座谈会,会上指出将把推动词元经济发展纳入工作体系,持续跟踪研究并吸收社会各界建议,以行业高质量数据集建设和全国一体化算力网建设为着力点,深入推进数据要素市场化配置改革,推动词元经济高质量发展。