告别“只会说”!大模型之后的下一个AI引爆点,究竟是谁?
过去两年,大语言模型(LLM)彻底点燃了AI界的狂热。从ChatGPT的惊艳亮相,到“百模大战”的喧嚣,大模型似乎无所不能。但如果你仔细观察就会发现,现在的大模型更像是一个“懂很多道理却依然过不好这一生”的书呆子——它们能写诗作画、写代码,却无法帮你订一张机票,更别提去厨房倒杯水。
大模型将AI的“智商”推到了全新高度,但AI的下一步,必然是从“思考”走向“行动”。大模型之后的下一个引爆点已经浮出水面:AI智能体与具身智能的深度融合。
首先是AI智能体。如果说大模型是那个超级大脑,那么Agent就是长出了“数字手脚”的行动派。传统的AI交互是你问一句它答一句,而Agent则能理解你的终极目标,自主拆解任务,调用外部工具并执行。比如你输入“帮我策划一场三亚五日游并控制在一万元内”,它不仅会给你攻略,还会自动打开浏览器查机票、对比酒店价格,甚至直接帮你完成支付。当AI不再只是“副驾驶”,而是成为能独立完成任务的“自动驾驶”系统时,整个软件生态和人类的工作流将被彻底颠覆。
其次,当智能体跨越数字世界的边界,进入物理世界,就迎来了具身智能。这是把大模型装进机器人里,让AI拥有“眼睛”和“触觉”。以前的机器人只能在工厂里按固定程序焊接,而具身智能机器人能听懂“把桌上的苹果扔进垃圾桶”,并自主规划路径完成动作。当AI不再被困在屏幕和服务器里,而是能走进千家万户打扫卫生、走进工厂完成复杂组装、甚至在危险场景中替代人类时,一个百万亿级别的实体产业市场将被瞬间激活。
从“生成内容”到“自主执行”,从数字世界到物理世界,AI正在经历一场从“知”到“行”的质变。大模型打下了坚实的认知地基,而智能体和具身智能将在这地基上建起真正的摩天大楼。别眨眼,AI真正接管现实世界的好戏,才刚刚开始。


