Google в четверг запустила Gemini 3.7 Flash — недорогую модель для кодинга и агентов, теперь она общедоступна.
OpenAI представила GPT-5.6 Sol Ultrafast — уровень на базе Cerebras, который запускает свою самую мощную модель до 14 раз быстрее.
Гонка за скоростью сместилась с сырого интеллекта на агентов реального времени, но только модель Google доступна каждому разработчику сегодня.
Google и OpenAI сегодня продвигали одно и то же сообщение: ИИ теперь достаточно быстр, чтобы впечатлять тех, кто использует ИИ-агентов, и каждая компания анонсировала сверхбыстрые модели.
Эти два запуска построены по-разному, и только один из них действительно доступен вам сегодня.
Google выпустила Gemini 3.7 Flash — свою новейшую модель, оптимизированную для написания программного кода и автономных бизнес-процессов. OpenAI открыла ограниченный предварительный доступ к GPT-5.6 Sol Ultrafast — новому уровню обслуживания, который обеспечивает работу самой мощной модели со скоростью до 750 выходных токенов в секунду.
Сегодня мы представляем Gemini 3.7 Flash — нашу самую интеллектуальную рабочую модель для программирования и агентов.
Эта модель обеспечивает значительные улучшения в разработке программного обеспечения, веб-разработке и сложной интеллектуальной работе.
Gemini 3.7 Flash — это модель общего доступа. Она принимает до миллиона входных токенов (примерно 750 000 слов) и возвращает 64 000, обрабатывая текст, изображения, видео, аудио и PDF-файлы, а также может вызывать инструменты и управлять компьютером. Google позиционирует её как недорогой мозг для автономных систем, которые планируют задачи и выполняют многошаговые работы с меньшей помощью человека.
Модель не жертвует качеством ради скорости. Она одновременно более способная и более эффективная, выполняя наш тестовый задание по кодированию за 2 минуты 13 секунд, тогда как последняя модель Flash заняла более 5 минут. Разрыв в качестве между ними также заметен.
Ultrafast от OpenAI — это не новая модель. Это GPT-5.6 Sol — та же модель, которую OpenAI использовала для усиления защиты от prompt-инъекций с помощью ИИ-красной команды перед запуском — на более быстром треке, работающая на чипах Cerebras. Она примерно в 14 раз быстрее стандартной скорости самого GPT-5.6 Sol.
Предварительный просмотр режима Ultrafast: GPT-5.6 Sol на скорости до 14 раз выше.
Запуск сначала в OpenAI API для избранной группы клиентов с расширенным доступом для большего числа компаний по мере роста мощностей. pic.twitter.com/a5dleofiDJ
Чипы Cerebras с масштабом пластины генерируют до 750 токенов в секунду, около 560 слов, достаточно быстро, чтобы голосовой агент мог думать во время разговора.
Цифры, которые имеют значение
Собственный бенчмарк Google ставит Gemini 3.7 Flash впереди Claude Sonnet 5, GPT-5.6 Terra и других в 11 из 18 протестированных категорий, включая лучший результат в Code Arena для веб-разработки — 1588 Elo и 30,4% в AutomationBench для корпоративных рабочих процессов. Это основано на методологии Google, так что относитесь к этому лидерству как к заявлению компании.
Как и любая модель Gemini Flash, эта модель также дешева. При цене 75 центов за миллион входных токенов и 3,75 доллара за миллион выходных токенов до конца года, это половина первоначальной ставки Gemini 3.6 Flash. Эта вводная цена истекает 31 декабря, после чего удваивается до 1,50 и 7,50 доллара, что для модели Google все еще дешево.
OpenAI не публиковала сравнительные результаты для Ultrafast, кроме цитат клиентов. Инженер Jane Street AI Джон Крепецци сказал в анонсе OpenAI, что скорость Cerebras «открывает новые способы использования моделей». Руководитель продукта Podium Кортленд Лайкинс назвал ее «бесценной в нашем голосовом стеке», заявив, что скорость «полностью меняет опыт звонков». Пока что этот тариф доступен только по приглашениям.
Гонка за скорость происходит в то время, когда лаборатории переходят от вопроса «кто умнее» к вопросу «кто достаточно быстр для агентов». Время выбрано Google точно. Его флагманский Gemini 3.5 Pro все еще отсутствует, без указания даты выпуска, через три недели после 3.6 Flash и через несколько дней после перестановок в руководстве DeepMind, в результате которых Демис Хассабис уступил место заместителю Кораю Кавукчуоглу. OpenAI тем временем арендует скорость Cerebras, а не ждет собственного стека.
Gemini 3.7 Flash уже доступен в более чем 160 странах; GPT-5.6 Sol Ultrafast пока доступен только по приглашениям.