Новини криптоміра

14.08.2026
07:49

Google та OpenAI прискорюють ІІ-гонку: анонсовано блискавичні моделі для коду та агентів

битва роботов, AI battle

Конкуренція на ринку штучного інтелекту вийшла на новий виток швидкості. 13 серпня одразу два технологічні гіганти оприлюднили свої надшвидкі рішення: Google представила модель Gemini 3.7 Flash, а OpenAI анонсувала режим Ultrafast для GPT-5.6 Sol. Обидві розробки націлені на сегмент, де час відповіді критично важливий — програмування та автономна робота ІІ-агентів.

Gemini 3.7 Flash: ставка на ефективність та економію

Google позиціонує новинку як інструмент для автоматизації бізнес-процесів і кодингу. Ключові покращення стосуються багатоетапного планування та дотримання інструкцій, що безпосередньо впливає на якість генерації коду. Примітно, що вартість використання знижена вдвічі відносно стартової ціни попередньої версії, що робить модель доступнішою для масової інтеграції.

Лінійка Flash традиційно закриває сценарії, що потребують не просто точних, а й миттєвих відповідей: це робота ІІ-агентів та завдання з численними послідовними викликами. Нагадаю, що в липні вийшла Gemini 3.6 Flash із цінником $1,5 за мільйон вхідних токенів і $7,5 за вихідні. Тоді заявлялося про 17% економії вихідних токенів порівняно з 3.5 Flash. Однак флагманська Gemini 3.5 Pro, яку багато хто чекав, так і не з'явилася — тестування з партнерами триває, і точні терміни релізу залишаються туманними.

OpenAI Ultrafast: 750 токенів за секунду на базі Cerebras

OpenAI пішла ще далі в радикальному прискоренні. Новий режим Ultrafast для GPT-5.6 Sol здатний видавати до 750 вихідних токенів за секунду, що, за заявою компанії, у 14 разів швидше за стандартну версію. Технологічною основою стала інфраструктура Cerebras, яка спеціалізується на надшвидкісних обчисленнях.

На старті режим доступний обмеженому колу клієнтів через API, і OpenAI підключатиме користувачів поступово в міру нарощування потужностей. Показник у 750 токенів згадувався ще в червні під час анонсу GPT-5.6, але тоді розробники чесно попереджали, що миттєвий доступ до прискореної версії отримають не всі. У цьому ж контексті варто зазначити, що в серпні команда SpaceXAI випустила Grok 4.6, зробивши ставку на довгострокові агентські завдання та інтерактивні застосунки.

Мій висновок: Ми спостерігаємо чіткий тренд: битва зміщується з площини «розумніше» у площину «швидше і дешевше». Для Web3 і криптоіндустрії це критично важливо, оскільки ІІ-агенти стають ключовим інструментом для автоматизації DeFi-операцій та аналізу ринку. Зниження ціни на Gemini Flash — це прямий сигнал для розробників: інфраструктурні витрати на ІІ падатимуть, відкриваючи нові можливості для масштабування проєктів.