明湖财经
财经 深度 热点

Ilya携SSI或本周发布新模型,黄仁勋重金押注,AI新时代要来了?

2026-08-26来源:快讯编辑:瑞雪

近日,人工智能领域迎来一则爆炸性消息:由Ilya Sutskever创立的“安全超级智能”(Safe Superintelligence,简称SSI)实验室,或将在近期发布一款具有颠覆性意义的大模型。这一消息在硅谷科技圈引发轩然大波,多位知名投资人、科技观察者纷纷暗示,这款模型将彻底改变AI行业的游戏规则。

硅谷知名投资人、a16z合伙人Martin Casado在社交平台透露,他近期接触到了“今年最重磅的新模型”,而a16z正是SSI的核心投资方之一。这一言论立即引发连锁反应,业界目光迅速聚焦于Ilya的SSI实验室。尽管也有猜测认为Casado所指可能是OpenAI的下一代Astra模型,但“非主流大厂突破”的传闻仍持续发酵。科技观察者Andrew Curran指出,此次突破来自独立实验室而非主流大厂,这一事实本身就极具冲击力。AI观察家Dan McAteer更是直言:“Ilya真正创造了超级智能,游戏规则已被改写。”

支撑这一猜测的,是英伟达的异常举动。今年7月,这家芯片巨头突然宣布与SSI达成长期战略合作,并承诺在未来12个月内将其算力规模提升10倍。更引人注目的是,英伟达被曝向SSI投资高达50亿美元,并开放了下一代Vera Rubin系统的独家访问权限。英伟达在新闻稿中坦言,这一决策源于“获得了对其严密保护的研究成果的罕见访问权”。黄仁勋究竟看到了什么?答案或许与SSI正在研发的基于“测试时训练”(Test-Time Training,简称TTT)的新架构有关。

与传统AI模型不同,SSI的新模型被描述为能够“边想边学”。当前主流模型(如ChatGPT、Claude)均采用“预训练”模式,将知识固化在权重中,训练完成后即“冻结大脑”。为处理新信息,厂商只能不断扩展上下文窗口,但这相当于允许模型携带更厚的“小抄”进考场。即便如OpenAI的o1模型强调“测试时计算”,也仅是在草稿纸上多花时间思考,其神经网络结构仍保持静止。而SSI的TTT架构则允许模型在阅读文档时产生梯度更新,真正改变自身结构。这意味着,模型不再需要庞大的上下文窗口,而是将新信息内化为长期知识,实现“用进废退”式的持续进化。

这一理念与Ilya长期倡导的“持续学习”不谋而合。早在2024年NeurIPS大会上,他就预言预训练时代即将终结。2025年11月,他进一步指出,行业正从“规模化”(Scaling)转向“研究驱动”(Research)时代。Ilya认为,真正的超级智能不应是“出厂即全能”的机器,而应像人类一样,通过试错和反馈不断进化。他比喻道:“我们需要的是一个极其聪明、充满好奇心的15岁天才,而非背下全网数据的百科全书。”这一愿景直接决定了SSI的战略:跳过中间模型,直奔“安全超级智能”,并将研究重心放在高效持续学习与对齐上。

SSI的低调作风曾引发外界质疑,但线索早已浮现。2024年7月,学者Yu Sun等人发表了原始TTT论文,而SSI投资人Jed McCaleb合著的另一篇论文更直言:“长上下文语言建模的本质是连续学习问题。”研究方向与投资人行动的高度一致,暗示SSI已将TTT从学术概念转化为商业武器。若这一模型真的具备“测试时训练”能力,现有AI行业的逻辑将被彻底颠覆——数据中心的算力护城河、按Token计费的商业模式,甚至开源权重的争论,都可能面临降维打击。

如今,所有目光都聚焦于SSI的8月发布计划。无论首款模型是面向极客的测试版还是公开震撼发布,其“实时更新权重”的特性都足以证明:AI竞赛远未进入“拼财力算力”的收官阶段,真正的技术飞跃仍藏在敢于打破常规的顶级大脑中。这一次,Ilya Sutskever能否再次改写历史?当AI真的具备“边用边进化”的能力,人类距离彻底失控又有多远?