简介
- 谷歌周四推出了Gemini 3.7 Flash,这是一款低成本编码和智能体模型,现已全面可用。
- OpenAI预览了GPT-5.6 Sol Ultrafast,这是一个由Cerebras驱动的层级,其最强大的模型运行速度最高可提升14倍。
- 速度竞赛已从原始智能转向实时智能体,但只有谷歌的模型今天能触达每一位开发者。
谷歌和OpenAI今天都传达了同样的信息:对于使用AI智能体的人来说,AI现在足够快,足以令人印象深刻,两家公司都宣布了超快模型。
这两个发布构建方式不同,而且只有其中一个今天真正掌握在你手中。
Myriad:OpenAI 何时发布 GPT-6?点击做出你的预测。谷歌发布了Gemini 3.7 Flash,这是其针对软件编码和自主业务流程调优的最新模型。OpenAI 开放了GPT-5.6 Sol Ultrafast的有限预览,这是一个新的服务层级,以每秒高达 750 个输出令牌的速度运行其最强大的模型。
Gemini 3.7 Flash 是一个通用可用模型。它最多可处理一百万个输入令牌(约 75 万个单词),并返回 64,000 个,支持文本、图像、视频、音频和 PDF,并且可以调用工具和控制计算机。谷歌将其定位为自主系统的廉价大脑,这些系统可以规划任务并在较少人工帮助下完成多步骤工作。
该模型并未为了速度而牺牲质量。它既更强大又更高效,能在2分13秒内完成我们的测试编码任务,而最新的Flash模型则需要5分多钟。两者之间的质量差距也很明显。
OpenAI的Ultrafast并不是一个新模型。它是GPT-5.6 Sol——与OpenAI在发布前使用AI红队强化以抵御提示注入攻击的同一模型——运行在更快的轨道上,由芯片制造商Cerebras提供支持。它的速度大约是GPT-5.6 Sol标准速度的14倍。
Cerebras的晶圆级芯片每秒可生成多达750个令牌,约560个单词,速度快到语音代理可以在通话中思考。
关键数据
谷歌自己的基准表显示,Gemini 3.7 Flash 在18个测试类别中的11个上领先于 Claude Sonnet 5、GPT-5.6 Terra 等,包括在 Code Arena 网页开发中取得最高分1588 Elo,在企业工作流的 AutomationBench 上取得30.4%的成绩。这完全基于谷歌的方法论,因此应将这一领先视为该公司的声明。
作为 Gemini Flash 系列,该模型也很便宜。到年底前,每百万输入令牌75美分,每百万输出令牌3.75美元,是 Gemini 3.6 Flash 原始价格的一半。该优惠价格将于12月31日到期,之后翻倍至1.50美元和7.50美元,对于谷歌模型来说仍然便宜。
OpenAI 尚未发布 Ultrafast 的正面交锋分数,只有客户引用。Jane Street 的 AI 工程师 John Crepezzi 在 OpenAI 的公告中表示,Cerebras 的速度“启用了使用模型的不同方式”。Podium 的产品负责人 Courtland Lykins 称其“在我们的语音栈中无价”,并表示速度“完全改变了通话体验”。该层级目前仅限邀请。
速度竞赛正值实验室从“谁最聪明”转向“谁对智能体来说足够快”。谷歌的时机很有针对性。其旗舰产品Gemini 3.5 Pro 仍然缺失,在3.6 Flash发布三周后,以及 DeepMind 领导层改组将 Demis Hassabis 调离、由副手 Koray Kavukcuoglu 接任几天后,仍未给出发布日期。与此同时,OpenAI 正在租用 Cerebras 的速度,而不是等待自己的技术栈。
Gemini 3.7 Flash 现已上线,覆盖160多个国家;GPT-5.6 Sol Ultrafast 仍仅限邀请。