Новини криптоміра

14.08.2026
08:10

Перегони швидкостей: Google та OpenAI представили рішення штучного інтелекту нового покоління

битва роботов, AI battle

13 серпня відбувся подвійний удар по ринку штучного інтелекту: Google анонсувала модель Gemini 3.7 Flash, а OpenAI представила революційний режим Ultrafast для GPT-5.6 Sol. Обидві розробки націлені на критично важливий сегмент — високошвидкісне виконання завдань, пов'язаних із програмуванням та автономними ІІ-агентами.

Gemini 3.7 Flash: ставка на ефективність та економію

Нова модель від Google позиціонується як робоча конячка для корпоративного сектору та розробників. Ключові покращення стосуються багатоетапного планування, точного дотримання інструкцій та генерації коду. Однак найінтригуючішим аспектом стало радикальне зниження ціни: вартість використання впала вдвічі порівняно з прайсом попередньої версії.

Лінійка Flash традиційно закриває сценарії, де латентність критична: це кодинг, агентні пайплайни та завдання з множинними послідовними викликами моделі. Нагадаю, що в липні вийшла Gemini 3.6 Flash із цінником $1,5 за мільйон вхідних токенів та $7,5 за мільйон вихідних. Тоді ж компанія відзвітувала про 17-відсоткове скорочення споживання вихідних токенів порівняно з 3.5 Flash.

Показово, що флагманська Gemini 3.5 Pro досі перебуває на стадії закритого тестування з партнерами, і терміни її публічного релізу залишаються туманними. Це створює цікавий дисбаланс: Google явно робить ставку на масовий сегмент, а не на преміальні моделі.

OpenAI Ultrafast: 750 токенів на секунду на базі Cerebras

OpenAI відповіла власним козирем — режимом Ultrafast для GPT-5.6 Sol. Заявлені показники вражають: до 14-кратного прискорення порівняно зі стандартною версією та генерація до 750 вихідних токенів на секунду. Технологічною основою стала інфраструктура Cerebras, що спеціалізується на гігантських кремнієвих пластинах.

На старті доступ до Ultrafast через API отримає лише обмежений пул клієнтів. Це усвідомлений крок: OpenAI поетапно нарощуватиме обчислювальні потужності, поступово підключаючи нових користувачів. Примітно, що цифра в 750 токенів на секунду фігурувала ще в червневому анонсі GPT-5.6, однак тоді компанія попереджала про нерівномірний доступ до прискореної версії.

Контекст гонки посилює серпневий реліз Grok 4.6 від SpaceXAI, зосередженого на довгострокових агентних сценаріях та інтерактивних застосунках.

Мій аналіз: Ми спостерігаємо тектонічний зсув у конкурентній боротьбі — від якості відповідей до швидкості їх отримання. Здешевлення Flash-моделей Google та агресивний ультрашвидкий режим OpenAI — це прямий наслідок тиску з боку відкритих моделей. Однак 750 токенів на секунду — це не просто маркетинг: такі показники відкривають дорогу для real-time агентів, які зможуть взаємодіяти з користувачем без відчутної затримки. Питання лише в тому, чи зможе Cerebras масштабуватися достатньо швидко, щоб демократизувати цю технологію, чи ультрашвидкість залишиться привілеєм обраних корпоративних клієнтів.