簡介
- Google 於週四推出了 Gemini 3.7 Flash,這是一款低成本的編碼與代理模型,現已全面開放。
- OpenAI 預覽了 GPT-5.6 Sol Ultrafast,這是一個由 Cerebras 驅動的層級,其最強大的模型運行速度快達 14 倍。
- 速度競賽已從原始智慧轉向即時代理,但只有 Google 的模型今天能觸及所有開發者。
Google 和 OpenAI 今天都傳達了相同的訊息:人工智慧現在已經快到足以讓使用 AI 代理的人感到驚豔,兩家公司都宣布了超快模型。
這兩個產品的建構方式不同,而且今天實際上只有一個掌握在你手中。
Myriad:OpenAI 何時發布 GPT-6?點擊做出你的預測。Google 推出了Gemini 3.7 Flash,這是其最新針對軟體編碼和自主商業工作流程調整的模型。OpenAI 開放了GPT-5.6 Sol Ultrafast的有限預覽,這是一個新的服務層級,能以每秒高達 750 個輸出 token 的速度運行其最強大的模型。
Gemini 3.7 Flash 是一個普遍可用的模型。它最多可接受一百萬個輸入 token(約 75 萬字),並返回 64,000 個,處理文字、圖像、影片、音訊和 PDF,並且可以呼叫工具和控制電腦。Google 將其定位為自主系統的廉價大腦,這些系統可以規劃任務並在較少人工協助下完成多步驟工作。
該模型並未為了速度而犧牲品質。它既更強大又更高效,能在2分13秒內完成我們的測試編碼任務,而最新的Flash模型則需要超過5分鐘。兩者之間的品質差距也很明顯。
OpenAI的Ultrafast並非新模型。它是GPT-5.6 Sol——也就是OpenAI在發布前使用AI紅隊強化以對抗提示注入攻擊的同一模型——運行在更快的軌道上,由晶片製造商Cerebras提供支援。它的速度大約是GPT-5.6 Sol自身標準速度的14倍。
Cerebras的晶圓級晶片每秒可生成多達750個token,約560個單詞,速度快到語音代理可以在通話中即時思考。
關鍵數字
Google 自家的基準測試表顯示,Gemini 3.7 Flash 在 18 個測試類別中有 11 個領先 Claude Sonnet 5、GPT-5.6 Terra 等模型,其中包括 Code Arena 網頁開發得分 1,588 Elo,以及企業工作流程的 AutomationBench 得分 30.4%。這完全基於 Google 的方法論,因此請將此領先視為該公司的說法。
作為 Gemini Flash 系列,該模型也很便宜。年底前每百萬輸入代幣 75 美分,每百萬輸出代幣 3.75 美元,是 Gemini 3.6 Flash 原始費率的一半。該促銷價格將於 12 月 31 日到期,之後翻倍至 1.50 美元和 7.50 美元,但對於 Google 模型來說仍然便宜。
OpenAI 尚未公佈 Ultrafast 的正面交鋒分數,僅有客戶引用。Jane Street 的 AI 工程師 John Crepezzi 在 OpenAI 的公告中表示,Cerebras 的速度「開啟了使用模型的不同方式」。Podium 產品負責人 Courtland Lykins 稱其「在我們的語音技術棧中無價」,表示速度「徹底改變了通話體驗」。目前該層級僅限邀請。
速度競賽之際,實驗室正從「誰最聰明」轉向「誰夠快以支援代理」。Google 的時機點具有針對性。其旗艦Gemini 3.5 Pro 仍然缺席,未公佈發佈日期,距離 3.6 Flash 發佈已三週,且 DeepMind 領導層改組將 Demis Hassabis 調離,由副手 Koray Kavukcuoglu 接任。與此同時,OpenAI 選擇租用 Cerebras 的速度,而非等待自家技術棧。
Gemini 3.7 Flash 現已在超過 160 個國家上線;GPT-5.6 Sol Ultrafast 仍僅限邀請。