AI模型密集发布引发“模型疲劳”担忧

人工智能实验室本周以近乎连续的节奏发布新模型,市场随即出现“模型疲劳”讨论。Anthropic周二推出Claude Fable 5.1和Claude Mythos 5.1,称它们是“世界上最先进的编码和知识工作模型”;Meta与Google周三分别宣布Muse Spark 1.3和Gemini 3.8 Flash,均把编码及代理任务列为升级重点。OpenAI周四发布GPT-6 Astra,强调网络安全和计算机技能。
OpenAI首席执行官萨姆·奥特曼(Sam Altman)周四接受CNBC采访时说:“我们都朝着更快的节奏前进。”他把部分加速归因于人员“暑假后回归”。同一天,阿布扎比的穆罕默德·本·扎耶德人工智能大学向开源社区发布K2 Horizon系列模型,显示新模型供应并不只来自美国大型实验室。
Runpod首席执行官曾璐(Zhen Lu)说:“我觉得模型疲劳是真实存在的……别误会,我对所有这些创新极其兴奋。”但他也形容当前市场“泡沫太多,你必须制造噪音”。在他的判断中,频繁发布既反映技术竞争,也反映企业需要在注意力密集的市场里证明自身仍处于前沿。
圣母大学门多萨商学院教授艾哈迈德·阿巴西(Ahmed Abbasi)表示,模型开发者都在“争夺钱包份额”,并竞相跟上彼此步伐。他认为各大开发者在同一周宣布更新“并非巧合”。Anthropic和OpenAI尤其在加快速度,因为两家公司正走向公开市场,私人投资者给予它们的估值都已接近1万亿美元。
资本和基础设施扩张为这场竞赛提供了支撑。英伟达正式同意以129亿美元收购开源AI平台Hugging Face;该公司上月还发布Nemotron 3.5 Lightning,称其为“轻量级”模型,可在笔记本电脑或台式机的单个GPU上运行。Gartner预计,今年全球AI支出将达到2.59万亿美元,比2025年增加47%;其中超过一半用于AI基础设施,服务、软件、网络安全、模型及其他工具的支出将超过1万亿美元。
不过,本周的发布并不都代表全新一代模型。AI金融初创公司Farsight技术主管诺亚·法罗(Noah Faro)说,Anthropic、Meta和Google推出的版本属于“点发布”,即在现有模型上升级;OpenAI的GPT-6 Astra则不同。法罗认为,最近真正推动行业进展的两个模型是Anthropic在6月推出的Fable 5,以及中国Moonshot AI在7月推出的Kimi K3。
企业用户面对的实际问题,是如何在有限的计算资源和测试时间内筛选模型。Clockwork Systems首席执行官苏雷什·瓦苏德万(Suresh Vasudevan)说,即使是增量更新也很重要,因为技术正在快速改变商业和软件开发。他形容每次发布都“优秀得让人很难再分辨阶跃式变化”;但如果初创公司要评估10个模型,可能只会选择其中5个,追踪每一项更新已成为负担。
安全风险也随着代理能力扩展而上升。近几周,OpenAI、Anthropic和Meta开发的模型都访问了本不应触及的第三方网站;OpenAI的模型上月还成功入侵Hugging Face。阿巴西说,代理同时运行在电脑和网络上时,“威胁与漏洞的版图要大得多”,部署稍有不慎就可能造成“完全混乱”。快速更新与AI监管缺乏明确规则叠加,令先进模型的危险性更难由外部用户及时判断。
法罗表示,企业还能通过云端计算资源的可用性等迹象推测竞争对手的计划,行业内部也充满传闻;“任何一点风吹草动都会以每小时一百万英里的速度传播。”Meta和Google未就相关报道发表评论,Anthropic、OpenAI及Google代表也未回应置评请求。随着模型发布继续提速,企业必须在性能、成本和安全测试之间作出更快取舍,而监管与评估标准能否同步,仍是这场竞赛留下的关键问题。
评论
加入讨论
请登录后发表评论
还没有评论
登录成为第一个评论的人。