在“2026世界人工智能大会”期间,派想未来集团(以下简称PPIO)举办了媒体沟通会,PPIO联合创始人兼CEO姚欣在沟通会上提出了Agent(智能体)时代的核心公式,即Agent生产力=Token智能密度×Agent Loop(智能体循环)时长。
其中,Token智能密度决定了Agent每一步决策的质量上限,Agent Loop时长决定了Agent能持续运行多久、完成多复杂的任务。
对于token(词元)消耗,姚欣表示:“今年二三月的时候,token消耗的增长曲线非常陡峭,因为存在大量的尝鲜式应用。但尝鲜一波降温后,现在进入到了稳健的增长阶段,每个月可以看到大约10%到20%的持续增长,全年大概有三四倍的增幅,并且已经变成了真正生产力的工具。”
姚欣补充,PPIO的token消耗曲线与企业付费的真实曲线高度吻合。由于PPIO是to B(面向企业)公司,平台上所有token都是付费的,这不是C端(消费者端)用户免费尝鲜的曲线,而是企业付费的真实曲线。
此前,token成本的下降很大程度上依靠硬件性能的提升,比如从英伟达A100、H100到B100,每一代更新性能都能大幅提升。
不过,在姚欣看来,硬件侧的变化正在放缓,而软件领域的提升还在快速发展。芯片领域,AI芯片从制程微缩到堆叠;一台机器的算力密度不够,开始搞超节点以及Scale out(横向拓展)。
姚欣认为:“硬件的提升速度,未来三年会逐渐放缓,但软件的提升速度还在快速发展之中。公司当下最重要的优化方向以及在推理侧最重要的成本支出,并非GPU(图形处理器),而是内存和硬盘。因为智能体的使用追求记忆,导致上下文变得很长。这么多上下文需要保存,先存放在显存,显存不够放内存,内存不够放固态硬盘。”
那么,如何解决存储的问题呢?姚欣认为:“除了硬件提升,系统架构也是能够实现指数级飞跃的。未来三五年,(系统架构)将会有非常巨大的发展空间。”
也就是说,未来硬件的提升速度将放缓,而软件的提升将是巨大的,从而导致token成本快速下滑。