“美国版豆包手机”,弱爆了

Wait 5 sec.

文  | AIX财经,作者 | 王璐,编辑 | 魏佳北京时间13日上午,谷歌硬件产品发布会Made by Google 2026如期而至。这场秀端出Pixel 11系列手机、Pixel Watch 5、首款防丢器Pixel Tag一系列硬件,并预告年底前推智能眼镜。但近两个小时的发布会看下来,很多人的感觉是“平淡”。先是硬件端变化不大,最能概括这场发布会的新品,是Pixel 11pro系列背面新增的那一小圈LED灯,谷歌称之为Hilight,最大的功能是支持特定联系人来电时的颜色提醒,不支持短信,不支持第三方通知。软件相对提升较多,Gemini可自主完成手机内信息、地图等APP的搜索操作,并提升了输入、拍照等细节功能,因此外界也称,Pixel 11不是一台想靠配置赢得用户的手机,它是Gemini的“身体”。这听起来很像国内的“豆包手机”,即一切皆为AI服务。这也引发了外界的重新思考,当谷歌把所有硬件都变成Gemini的容器时,它到底在卖手机,还是一个随时能召唤的AI?这款“美国版豆包手机”,有多少功能是谷歌首创,又有多少是跟随竞品?01.谷歌的硬件矩阵:补齐拼图,但每块都不惊艳今年的Made by Google发布会,谷歌的产品种类比往年更为丰富,主角是Pixel 11全系四款手机,此外还有Pixel Watch 5、防丢器Pixel Tag,以及一个关于年内智能眼镜的预告。类型虽多,但每一块都很难称得上惊艳。先来看最重磅的Pixel 11系列手机。价格上,四款产品较上代提高100美元,但由于Pixel 11和Pixel 11 Pro取消了128GB版本,其256GB版本价格与上代持平,Pixel 11 Pro XL和Pixel 11 Pro Fold则分别涨价100美元。整体配置来看,Pixel 11系列的硬件多是年度小改,全系搭载谷歌新一代Tensor G6处理器,是为Gemini的端侧运行专门设计;Pro系列升级新一代长焦镜头,最高120倍变焦,但标准版则依旧沿用上代相同配置;续航表现上,标准版、Pro、Fold为30W,Pro XL为45W,整体中规中矩。最大的硬件亮点是Pro系列背面新增的LED指示灯,官方称其功能为Hilight,它的核心作用是一方面显示Gemini的使用状态,比如交流时,它会稳定亮起。另一方面是,特定联系人来电时,会显示用户指定的颜色。除此以外,暂无其他功能,既不支持短信和其他第三方提示,也没有给开发者留接口。提前拿到真机的评测博主Marques Brownlee用“it is what it is(就这样吧)”评价这一系列,并把这句话当成了其视频标题。可见外界对这一功能并不完全满意。再来看Pixel Watch 5,售价为399美元起。沿用高通W5 Gen 2的加速版本,CPU快了12%。但真正的重点不是CPU,是端侧内存从2GB提到3GB,加了整整50%。带来的效果也很直接,手表端的Gemini能力大幅提升,比如可创建个性化时钟界面,用户抬起手腕时,就能与Gemini对话。最后看Pixel Tag与智能眼镜。Pixel Tag是谷歌首次进入追踪器赛道的产品,单只定价29美元,四只装99美元,贴着AirTag的价格打,于11月发售。产品本身没有太多可说的,但它的存在补齐了谷歌硬件生态的一个缺口,从手机到手表到耳机到防丢器,谷歌有了一个能跟苹果生态对标的完整硬件阵容。“智能眼镜”则是谷歌在本次发布会抛出的钩子,没有露出具体产品,仅预告了将年内推出。可以看出,谷歌本次发布会亮出了一套AI容器矩阵,但单个产品没有太大惊喜。Pixel 11的涨价虽有存储翻倍做支撑,但功能上还不够让人眼前一亮;Watch 5的内存增加是务实的,但功能层面没有跳出其他智能手表的框架;Tag是标准的市场跟随者产品,眼镜更是还没露出。02.谷歌的AI手机,咋样?整场发布会真正的主角是Gemini。它已经从一个独立助手,集成到了Pixel的系统服务层,从查信息到跨应用办事都由它接管。被它“接管”之后,谷歌的AI手机,能力到了哪一步?本次发布会给出了答案。在“代办”能力上,Gemini已超越聊天。官方演示中,它可以跨应用读短信、日历等应用信息,并根据要求自动搜索谷歌地图,找到合适餐厅下单、订位,甚至直接打电话给商家。它还会主动建议航班信息、餐厅列表、提醒日历日程。图源 / 谷歌官网不过,这些丝滑体验目前仍局限于谷歌自家服务,以及为了确保用户使用的安全性,关键步骤仍需用户确认。这一功能与市面上其他的AI手机相差不大。语音听写是本次的一大亮点。Gboard新增的Rambler功能落地,基于Gemini驱动,官方展示了三大功能:自动清洗文本、意图修正和一键重来。它能自动过滤“嗯、啊”等语气词,即便用户中途改变了主意,也能自动消除前后矛盾的地方,当用户告诉它撤销刚才说的话,它也能照做,这对商务人士和学生群体具有一定的吸引力。此外还有手语识别、实时翻译与影像AI等功能。发布会上,聋人演员Daniel Durant现场演示了手语实时转文字,手机前置摄像头捕捉他的手语动作,再由大模型把手语翻译成文字,结果直接显示在实时转录里;实时翻译功能则进入到YouTube和播客,用户在看视频或听播客时,能实时把声音、配音成另一种语言。影像方面,用户按下录制键后,Magic Capture会分析前后约上百帧画面,再从中挑出最好的几张。相机里新增的Creator Suite创作者套件,还自带提词器,用户提前把讲稿输进去,点录制后文字会跟着用户的说话速度和自然停顿自动滚动。这些功能背后,是Gemini多模态模型与Tensor G6端侧算力的结合。虽然发布会上谷歌没有展开讲底层技术栈,但可以确定的是,手语识别、实时翻译和视频理解等功能都依赖端侧AI能力。但这些功能有一个共同点,它们大多是“追赶”而非“引领”。比如手语识别方面,苹果在FaceTime中已支持手语检测,实时翻译方面,苹果和微软主要覆盖文本和语音场景,谷歌更多是把实时配音伸进了YouTube视频和播客等具体形态里。03.是美国版豆包手机吗?发布会过后,“Pixel 11是美国豆包手机”的说法也流传开来。这个比喻抓住了一些东西,也漏掉了一些东西。从策略层面看,Pixel 11和豆包手机确实在走同一条路。面对OpenAI等对手在模型跑分上的压力,谷歌在I/O大会上表示将重心转向了智能体。Gemini深度绑定谷歌全家桶,豆包则绑定字节系,两者都不执着于单点技术的巅峰,拼的是谁能在更多场景里“刷存在感”。但两家的技术路线并不一样。一位大模型从业者介绍,让AI替你操作手机,可以分成两个层次。一种是“操作层”,这里又分两条路:一类是AI“自己上手”,盯着屏幕,照着你平时的动作一步步点击,例如打开App、找按钮、点确认,这叫GUI模拟点按;另一类是AI不碰屏幕,直接走App留好的“内部通道”下指令,这叫接口调用。另一种是“协同层”,也就是A2A,让手机里的Agent跟系统Agent“谈”,把要办的事交给对方去完成。这属于更高层级,但行业暂时没有成熟落地。具体到这两台手机上,Pixel和豆包手机都属于操作层,Pixel以第一方接口调用为主,遇到没开接口的App,再退回GUI模拟点按兜底,豆包手机一代是纯GUI路线,但因遭到了头部APP的风控,以及用户对安全的讨论,豆包手机二代转向A2A。两家路线差异背后不是谁更先进,在于垂直整合的深浅不同。Pixel 11是谷歌自研机身,加上定制Tensor G6芯片、跑自研Gemini,从芯片到系统到模型,全链路握在自己手里。这意味着谷歌可以在底层做优化,比如给手表加内存跑模型、让端侧AI在断网时依然流畅,这种“为了AI重做硬件”的垂直整合,是依赖第三方硬件的豆包手机难以复制的。豆包手机目前主要与努比亚等厂商合作,硬件层面的话语权有限。它的优势在于软件迭代快、场景适配深,但端侧优化的天花板受限于合作厂商的硬件能力。不过,在工程落地上,豆包确实是GUI自动化领域的先行者。总之,“美国版豆包手机”这个比喻在策略层面成立,在产品层面却不够准确。更准确的说法是,它们是同一趋势下的两种解法,目标一致,在实现方式上各有取舍。回到开头的问题,谷歌卖的到底是手机还是AI?答案是,谷歌或许已经不打算区分了。Pixel逐渐成为Gemini的“身体”,硬件只是一次性入口,AI能力的持续订阅与服务,才是更长线的生意。更多精彩内容,关注钛媒体微信号(ID:taimeiti),或者下载钛媒体App