Новини криптоміра

14.08.2026
08:30

Гонка швидкостей у ШІ: Google та OpenAI представили нові рішення для розробників

битва роботов, AI battle

13 серпня відбувся подвійний анонс, який задав новий вектор у розвитку генеративного ШІ. Google представила модель Gemini 3.7 Flash, а OpenAI анонсувала режим Ultrafast для своєї GPT-5.6 Sol. Обидві компанії явно роблять ставку на швидкість та ефективність, що критично важливо для завдань із кодом та автономними ШІ-агентами.

Що нового в Gemini 3.7 Flash

Google позиціонує Gemini 3.7 Flash як робочу конячку для програмування та автоматизації бізнес-процесів. Розробники заявляють про суттєві покращення в багатоетапному плануванні, точності дотримання інструкцій та якості генерації коду. При цьому компанія пішла на радикальний крок: вартість використання знижено вдвічі порівняно зі стартовою ціною попередньої версії. Це робить модель надзвичайно привабливою для масштабних продакшн-навантажень.

Снимок экрана — 2026-08-14 в 08.50.29
Дані з презентації Google DeepMind.

Лінійка Flash спочатку задумувалася як рішення для сценаріїв, де швидкість отримання відповіді не менш важлива, ніж її якість. Це кодинг, робота ШІ-агентів та будь-які завдання, що передбачають безліч послідовних звернень до моделі. Нагадаю, що в липні вийшла Gemini 3.6 Flash із ціною $1,5 за 1 млн вхідних токенів та $7,5 за 1 млн вихідних. Тоді ж компанія відзвітувала, що нова модель споживає на 17% менше вихідних токенів, ніж її попередниця.

Однак у тіні цих анонсів залишається питання про флагманську Gemini 3.5 Pro. Модель досі не випущена публічно, і розробники лише тестують її з обраними партнерами. Конкретні терміни релізу залишаються туманними, що створює інтригу на ринку.

Як OpenAI прискорила GPT-5.6 Sol

OpenAI, своєю чергою, представила режим Ultrafast для GPT-5.6 Sol. Заявлені показники вражають: швидкість роботи до 14 разів вища за стандартну та генерація до 750 вихідних токенів на секунду. Секрет такого прискорення — у використанні інфраструктури Cerebras, що спеціалізується на надшвидких чипах для ШІ.

На старті Ultrafast буде доступний через API обмеженому колу клієнтів. Це логічний крок: OpenAI необхідно протестувати навантаження та масштабувати обчислювальні потужності. У міру їх зростання доступ відкриють для ширшої аудиторії. Сам показник у 750 токенів на секунду згадувався ще в червні, коли анонсували GPT-5.6. Тоді розробники попереджали, що прискорена версія на Cerebras впроваджуватиметься поетапно.

У цьому контексті варто згадати й серпневий реліз Grok 4.6 від SpaceXAI, який зробив акцент на довгострокових агентських завданнях та програмуванні. Конкуренція в сегменті "швидких" моделей розпалюється, і це чудова новина для ринку.

Мій аналіз: Обидва анонси підтверджують ключовий тренд 2026 року — зміщення фокусу з "розумних" моделей на "швидкі та дешеві". Для Web3-розробників та DeFi-протоколів це означає зниження операційних витрат і можливість створювати складніших агентів, що працюють у реальному часі. Зниження ціни Gemini 3.7 Flash удвічі — це не просто маркетинг, а пряма спроба захопити частку ринку enterprise-розробки, де ціна за токен часто є вирішальним фактором.