新闻正文
《CNBC》报导,Google(GOOGL-US)可能已重返人工智能的前线,但投资人与消费者愈来愈关注的是,人们究竟能利用这项技术打造什么。随着个人AI代理日益受到欢迎,市场焦点也逐渐转向这个领域。
Google周三发布期待已久的Gemini 4 Argon模型,承诺在编程、网络安全与复杂任务等方面取得重大进展。根据业界基准测试,Argon在一项关键网络安全测试中与OpenAI并列第一,并在软件工程测试中取得领先。
Argon的初始定价为每100万个输入token 2美元、每100万个输出token 10美元,与OpenAI最新降价的GPT-6.1 Sol模型价格相同。一个token约相当于四分之三个英文单字。
Google在AI模型竞争中加大攻势之际,竞争对手Meta(META-US)的Muse应用程序下载量也突破数百万。Muse上月推出后迅速登上苹果App Store排行榜首位,超越ChatGPT。
OpenAI本周稍早推出个人AI代理产品Dots,搭上企业与消费者对于能够代替用户运行任务的工具需求,例如搜索电子邮件、预订旅程以及整理支出等。
与此同时,在先进AI模型层面,市场关注焦点已转向安全问题。Anthropic首席执行官Dario Amodei三周前引发热烈讨论,呼吁顶尖AI实验室放慢开发速度,因市场对AI潜在危险的担忧日益升高。
过去3个月,Alphabet股价下跌约6%,同期Meta则上涨19%。Meta涨势受到9月股价大涨带动,9月也是该公司自2022年以来表现最强劲的一个月。
摩根大通分析师周四在报告中表示,Google需要大幅提升个人AI代理产品,才能激发消费者的热情。美国银行则指出,Gemini 4有潜力强化Google的云端事业与既有产品,同时为未来的个人AI代理奠定基础。
在消费市场方面,Google拥有巨大的主场优势。全球有数十亿人使用Google产品,包括Gmail、Google日历、Chrome与搜索服务。用户的消息与行程本来就已保存在Google生态系,这可能让Google在打造一款能够跨服务运作的助理时,拥有相当大的优势。
然而,Google的个人AI代理Spark目前仍仅限付费订阅者使用。Muse则免费提供,但设有使用量限制。根据Sensor Tower,截至9月30日,Muse下载量已超过500万次。
Google代理产品团队成员在接受CNBC背景演示文稿时,说明了Spark目前具备的功能,以及Google扩大使用权限的方式,同时也承认Muse免费开放,确实帮助消费者认识并尝试这项产品。
Spark于5月Google I/O开发者大会上推出,可在Gmail与Google 日历之间运行任务,通过Chrome浏览网站,并完成填写在线表格等工作。它也能通过Google的手机与桌面应用程序使用。
但与Muse不同,Spark无法代表用户拨打外部电话,也不能代替用户完成购买。相反地,Spark会引导用户完成购买流程,最后再将控制权交还给用户,由用户进行最终确认。
Argon 能帮助 Spark 吗?
Meta的做法也带来一些复杂问题。《路透社》9月报导,Meta曾测试一套人工客服系统,当Muse无法自主完成部分电话任务时,由承包商代为处理。由于内部对隐私问题有所疑虑,Meta已暂停这项实验,Muse的自动拨打电话功能仍处于测试阶段。
这起事件也引发外界关注,AI助理取得大量敏感个人信息后可能产生的隐私问题。
Google如今正在评估,最新的先进模型是否能进一步强化Spark。
Gemini产品负责人Tulsee Doshi强调,Argon能够处理需要多个步骤、且可能长时间运行的复杂任务。她表示,Google仍在评估Argon最适合部署在哪些场景。
个人代理并不需要最强大的先进模型才能完成日常任务。在Argon推出之前,Google今年夏季大部分时间都在推出成本更低、更轻量的模型,专用于大规模处理日常需求。
Doshi表示,这些模型对日常代理而言仍不可或缺,而功能更强大的模型,则能提供处理复杂任务所需的额外推理能力。
成本也是一大问题。运行强大的AI模型相当昂贵,尤其是代理需要持续运作并运行多项任务时。Google Argon的初始定价具竞争力,但公司表示,未来公布的价格最终将翻倍至每100万个输入token 4美元、每100万个输出token 20美元。
Google面临的其中一项挑战,是如何将旗下不同模型结合成一个AI代理,使其能够处理愈来愈复杂的任务,同时又不让服务的营运成本高到难以负担。
此外,Argon目前也尚未广泛开放使用。Google正参与美国政府一项自愿性AI安全测试计划,初期仅向特定网络安全防御人员与企业云端客户开放。公司计划进一步向开发者、企业客户与一般消费者开放,但尚未公布公开发布日期。
这也限制了外部人士对Argon能力进行独立测试。《彭博社》周三报导,尽管Argon在基准测试中表现强劲,一些Google员工仍质疑该模型在实际环境中的编程能力。
Google反驳了这项说法,称公司内部员工已测试Gemini 4的不同版本数周,其中部分员工获得不限量的使用权限。
但目前更迫切焦点仍在代理领域,因为其他科技公司正竞相将AI带给大众。如摩根大通分析师所言,「Google一直难以将持续的产品发展速度转化为能引起消费者共鸣、持续抓住市场注意力,并真正改善市场对其AI领导地位的看法。」