这种做法本身并不罕见,通过蒸馏学习从强大的模型中提取知识是 AI 领域的常见技术。但对于曾经高调宣扬开源、试图建立自己 AI 生态的 Meta 来说,如今转而借鉴竞争对手的模型,多少有点打脸的意味。
Meta 发言人对此的回应相当官方,称模型训练工作按计划进行,目前没有重大时间变动。
但业内人士心里都明白,这个项目关系到 Meta 能否在 AI 竞赛中追上 OpenAI、Google 和 Anthropic。如果 Avocado 扑街,Meta 在 AI 领域可能就真的要被甩出第一梯队了。
实际上,在 Avocado 尚未面世之前,Meta 在产品端已经遭遇了一次惨败。
今年 9 月匆忙上线的 AI 短视频平台 Vibes,被寄予厚望要对标 OpenAI 的 Sora 2,结果却惨遭市场打脸。Appfigures 数据显示,Meta AI 在 iOS 免费应用排行榜上仅位列第 97 名,而 Sora 2 则高居第 3,并逐步攀升。
虽然 Sora 最近也被传出用户黏度下降的情况,但当两款产品几乎同时发布,Vibes 非但没能成为话题爆款,反而被 Sora 2 压着打。很多人甚至不知道 Meta 新发布了这个产品。
多位前员工和内容创作者告诉 CNBC,Vibes 仓促上线,缺乏如逼真对口音频等关键功能。
前 GitHub CEO Nat Friedman 主导了这个项目,现在他正面临巨大压力,被要求尽快推出真正的爆款 AI 产品。知情人士称,Meta 多个 AI 团队都在承压,70 小时工作周成为常态,同时全年进行了多轮裁员与重组。
这种节奏,像极了一家被逼到墙角的初创公司,而不是市值万亿的科技巨头。
从 AI 赢家到被质疑,不过一年时间
今年是 Meta AI 的坎儿年。
去年九月,意气风发的扎克伯格还站在 Meta Connect 的舞台上,信心满满地宣称 Llama 将成为业内最先进的 AI 模型,让所有人都能受益于人工智能。
那时的他,像极了一个布道者,向世界传递着开源 AI 的福音。
然而仅仅一年后,风向就变了。到了两个月前的财报电话会议上,扎克伯格对 Llama 的提及只剩下了一次。那个曾经被当作 Meta AI 战略核心的开源模型,正在悄悄让位给 Avocado 这个神秘项目。
这个转变背后,是 Meta 在 AI 竞赛中越来越明显的焦虑。
当 OpenAI 的 GPT 系列、Google 的 Gemini、Anthropic 的 Claude 接连发布重磅更新时,Meta 发现自己似乎被甩在了身后。尤其是,Google 在 AI 领域的投入正逐渐显现成效,而 Meta 却陷入了方向不明的泥潭。
为此,扎克伯格的应对方式简单粗暴,砸钱挖人。
今年 7月份,Meta 宣布成立超级智能实验室 MSL,将公司所有 AI 业务重组到这个新部门之下。紧接着,一场硅谷 AI 人才的扫货大战拉开帷幕。
最引人注目的一笔交易发生在同月,Meta 以 143 亿美元的天价引入了 Scale AI 的 28 岁创始人 Alexandr Wang 及其团队。
虽然 Wang 不是工程师,但被认为是业内最具人脉的AI创业者之一。
随后,扎克伯格和 Wang 展开疯狂招人,争抢顶级 AI 研究员,开出高达数亿美元的薪酬。据 OpenAI 首席研究官 Mark Chen 称,扎克伯格甚至亲自送自制的汤到 OpenAI 员工家门口,劝他们跳槽到 Meta。
Wang 被任命为 Meta 首席 AI 官,领导一个叫 TBD Lab 的精英小组。这个名字本身就很有意思,TBD 是「to be determined」的缩写,意思是待定。最初只是个临时代号,但因为太贴切了反而保留了下来,某种程度上也反映出 Meta AI 战略的探索性质。
除了 Wang,Meta 还挖来了前 GitHub CEO Nat Friedman,让他负责 MSL 的产品与应用研究,以及 ChatGPT 联合创始人赵晟佳。
这些重金引入的大佬带来了硅谷前沿 AI 研发的标准流程,彻底改变了 Meta 传统的软件开发文化。然而改变的代价是巨大的。
「它能做你让它做的任何事。可以当老师,帮你看小孩;可以遛狗、修剪草坪、买杂货;还能做你的朋友,给你端茶送水。无论你能想到什么,它都能去做。」
在上个月的股东大会上,他更是兴奋地表示:「一旦 AI 和机器人成熟,我们甚至可以把全球经济扩大十倍甚至百倍。Optimus 大规模应用就是那个无限增益的秘诀。也许到了那时候,『金钱』这种东西都变得多余。」
Google 这一次王者归来,震感甚至直接传导到了竞争对手的神经中枢。据 The Information 报道,面对 Google 步步紧逼的攻势,OpenAI CEO Sam Altman 本周一紧急在内部备忘录中宣布公司进入「红色警戒(code red)」状态,准备调动一切战略资源对 ChatGPT 的能力进行大幅升级。
据 The Verge 援引知情人士消息称,OpenAI 计划最早于下周初发布 GPT-5.2 模型, 这一时间表较原定的 12 月下旬计划大幅提前。
Logan Kilpatrick: 太赞了!这简直是 AI Studio 的完美宣传点,我们会把这段剪辑出来发布到网上。你刚才提到的一个重要话题是,在 Gemini 3 发布之际,我们同步推出了 Google Anti-gravity 平台。从模型角度来看,你认为这种产品架构对提升模型质量的重要性有多大?显然,这和工具调用、编码能力息息相关。
就像 Gemini、AI Studio 一样,Anti-gravity 平台也是如此。这些产品能让我们与用户紧密相连,获取真实的反馈信号,这是巨大的财富。Anti-gravity 平台作为我们的关键发布合作伙伴,虽然加入时间不长,但在过去两三周的发布筹备中,它的反馈起到了决定性作用。
搜索 AI 模式(AI Mode)也是如此,我们从那里获得了大量反馈。基准测试能帮助我们推动科学、数学等领域的智能提升,但了解现实世界的使用场景同样重要,模型必须能解决实际问题。
Gemini 3,一款全 Google 团队协作的模型
Logan Kilpatrick: 在你担任新任首席 AI 架构师后,你的职责不仅是确保我们拥有优秀的模型,还要推动产品团队将模型落地,在 Google 的所有产品中打造出色的用户体验。 Gemini 3 在发布当天就同步登陆 Google 所有产品端,这对用户来说是巨大的惊喜,也希望未来能覆盖更多产品。从DeepMind 的角度来看,这种跨团队协作是否增加了额外的复杂性?毕竟一年半前,事情可能还简单得多。
Koray Kavukcuoglu: 但我们的目标是构建智能,对吧?很多人问我,身兼 CTO 和首席 AI 架构师两个职位,会不会有冲突,但对我来说,这两个角色本质上是一致的。
要构建智能,就必须通过产品与用户的联动来实现。我的核心目标是确保 Google 的所有产品都能用上最先进的技术。我们不是产品团队,而是技术开发者,我们负责研发模型和技术,当然,我们也会对产品有自己的看法,但最重要的是,以最佳方式提供技术支持,与产品团队合作,在 AI 时代打造最优秀的产品。
这是一个全新的时代,新技术正在重新定义用户期望、产品行为和信息传递方式。因此,我希望能在 Google 内部推动这种技术赋能,与所有产品团队合作。这不仅对产品和用户有益,对我们自身也至关重要。
团队基于 Gemini 3.0 Pro 的架构,结合第一代模型的经验,通过扩大模型规模、优化调优方式,打造出了更强大的图像生成模型,这很合理。它的核心优势在于处理复杂场景:比如输入大量复杂文档,模型不仅能回答相关问题,还能生成对应的信息图表,而且效果很好。这就是输入多模态与输出多模态自然融合的体现,非常棒。
我们有幸生活在这个时代,很多人曾为 AI 或自己热爱的领域奋斗一生,希望能见证技术爆发,但这一切现在真的发生了。AI 的崛起不仅得益于机器学习和深度学习的进步,还离不开硬件、互联网和数据的发展,这些因素共同促成了今天的局面。所以,我既为自己选择了 AI 领域而自豪,也为能身处这个时代而感到幸运。这真的太令人兴奋了。
我可以肯定地说,20 年后,我们现在使用的大语言模型(LLM)架构肯定会被淘汰。所以,持续探索新方向是正确的选择。 Google DeepMind、 Google 研究院,以及整个学术研究社区,都需要共同推进多个领域的探索。
我认为,不必纠结于「什么是对的、什么是错的」,真正重要的是技术在现实世界中的能力和表现。
Logan Kilpatrick: 最后一个问题:我个人在 Google 的第一年多时间里,感受到了一种「 Google 逆袭」的氛围。尽管 Google 拥有强大的基础设施优势,但在 AI 领域,我们似乎一直在追赶。比如在 AI Studio 的早期阶段,我们没有用户(后来增长到3万人),没有收入,Gemini 模型也处于早期阶段。
而现在,随着 Gemini 3 的发布,我最近收到了很多来自生态系统各方的反馈,人们似乎终于意识到「 Google 的AI时代已经到来」。你是否也有过这种「逆袭」的感受?你相信我们能走到今天吗?对于团队来说,这种角色的转变会带来什么影响?
Koray Kavukcuoglu: 在大语言模型(LLM)的潜力逐渐显现时,我坦诚地说,我既认为 DeepMind 是前沿 AI 实验室,也意识到我们作为研究人员,在某些领域的投入还不够,这对我来说是一个重要的教训:我们必须拓宽探索范围,创新至关重要,而不是局限于某一种架构。
Google 选择 XREAL 这家初创公司的原因,大概率是看中了 XREAL 做 AR 眼镜硬件的强大实力:Aura 实现了 70° FOV,为消费级 AR 的最大实用视场,能够让 Gemini 助手更好地与真实世界进行互动,也能获得沉浸式的观影体验;性能方面则采用了 Galaxy XR 同款高通骁龙 XR2 Plus Gen 2 芯片组。