在第二届香港GIS全球创新展暨全球创新峰会上,清华大学智能产业研究院(AIR)创始院长张亚勤发表主旨演讲,描绘了人工智能发展的新蓝图。他指出,人工智能正经历第三次范式变革,从鉴别式转向生成式,最终将迈向智能体时代。他预测,未来五年“AI教AI”将成为核心产业趋势,全球基础大模型数量将缩减至不超过10个,其中开源模型将占据80%的市场份额,智能体互联网有望在2030年前全面成型。
张亚勤将人工智能划分为信息智能、物理智能和生物智能三个维度,认为新一代AI的本质是这三者的融合,也是数字世界与物理世界的深度交织。他以2022年底ChatGPT的诞生为标志性事件,指出AI从此前的模式识别阶段正式进入生成式阶段。生成式AI的核心在于词元化、规模定律和智能体三大概念:词元化将数字信息、传感器信号甚至蛋白质等统一视为可预测的单元;规模定律表明数据、算力和词元量的增加将推动智力水平跃升;智能体则通过模仿人类高级认知活动,形成目标设定、路径规划、迭代试错和持续进化的闭环。
他特别提到,今年“龙虾”事件让智能体概念进入公众视野。智能体具备自主性、进化性和泛化能力三大特征,其发展已推动AI智力呈现指数级增长。编程智能体的出现是过去一年最重要的突破,未来AI将具备自我学习、自我设计的能力,大模型将能够自主规划下一代架构。
在产业格局方面,张亚勤预测云端SaaS和端侧应用开发平台将通过智能体形式呈现,成为未来五年主流趋势。基础模型层将呈现寡头化特征,全球基础大模型不超过10个,其中中国和美国各占3至4个,其余来自其他地区。他分析,中国模型在效率、架构灵活性和Token利用率上具有优势,而美国以闭源路线为主,中国则以开源为主导。未来市场将形成“八二格局”,即80%开源、20%闭源,类似于当前手机操作系统中安卓与iOS的分布。
张亚勤提出,互联网正从PC、移动和物联网时代迈向智能体互联网时代。到2030年,AI生成的内容将达人类生成内容的1000倍,互联网节点将主要为智能体服务,人类则通过API等接口间接使用。他同时引入“词元经济”概念,指出Token作为AI基础单元,由电力、算力和算法构成,当前面临效率和成本挑战,需提升两个数量级才能形成闭环。未来企业商业模式将转向TAP模式,即Token、Agent和People的结合。
在技术架构层面,他预测GPU和CPU将形成双中心格局,CPU的作用可能超越GPU。交互方式也将从图形界面和触摸操作转向语音、动作和表情等自然交互,眼镜、机器人和嵌入式设备将成为新一代用户界面。产学研融合方面,清华大学智能产业研究院已与阿里巴巴、字节跳动等企业开展深度合作,开发的算法被业界广泛采用。在物理智能领域,研究院孵化的9家企业总市值达2000亿元,其中陈亦伦团队设计的机器人已具备一定泛化能力,并开发了23自由度的灵巧手。
生物智能被张亚勤视为AI最大的应用场景。他预测,未来3至5年AI将在生物制药领域取得重大突破,继聊天和编程之后成为第三个核心应用方向。目前,研究院约三分之一资源投入AI制药,刘洋团队已搭建全球首个智能体AI医院,模拟三甲医院架构,涵盖21个科室和42个医生智能体,并与真实医院连接。
尽管前景广阔,张亚勤也警示风险随AI能力提升而放大。智能体可自主完成3000余项任务,带来信息、物理和生物风险,尤其是网络风险。他透露,自己正投入大量时间研究风险防控,以应对智能体时代的安全挑战。