Рівно за десять днів, 12 вересня, xAI представить громадськості Grok 4.7. Ілон Маск робить гучну заяву: нова модель не просто стане кроком уперед, а буквально «обжене» всі наявні на ринку ШІ-рішення.

Цей реліз стане третім великим оновленням за два місяці. Для порівняння: Grok 4.6 дебютувала 12 серпня, а публічний доступ до Grok 4.5 відкрили лише в липні. Такий темп свідчить про те, що інженери xAI перейшли в режим агресивної ітеративної розробки, намагаючись захопити лідерство в гонці озброєнь.

Секретна зброя: 2,1 трильйона параметрів і дані SpaceX

Ключова відмінність Grok 4.7 — архітектура та унікальний навчальний корпус. Маск підтвердив, що базове навчання завершено, і зараз команда інтегрує в модель внутрішні дані SpaceX. Це не просто маркетинговий хід, а реальна конкурентна перевага: доступ до інженерної телеметрії, даних запусків і симуляцій фізичних процесів дає моделі унікальну емпіричну базу, якої немає в конкурентів.

Параметрична ємність зросла до 2,1 трильйона, що на 40% більше, ніж у попередниці (1,5 трлн). При цьому Маск зазначає, що нова версія працює дещо повільніше, але значно економніше витрачає токени. Це усвідомлений компроміс: ставка робиться на глибину міркувань і якість відповіді, а не на швидкість генерації.

У своїй заяві Маск також згадав Anthropic, назвавши їх «чудовою компанією» і висловивши впевненість, що вони скоро покажуть просунуті рішення. Однак він додав, що був би вкрай здивований, якби будь-яка інша модель перевершила Grok 4.7 у реальних інженерних завданнях.

Бенчмарки: чи є підстави для амбіцій?

Ситуація з тестами неоднозначна. Попередня версія, Grok 4.6, показала змішані результати. В індексі AA Intelligence вона набрала 61 бал, зрівнявшись із GPT-5.6 Sol Max, але поступившись одним балом Claude Fable 5 Max (62). У тесті GDPVal-AA v2 результат вражає — 1753 бали, однак на Terminal-Bench v3.0 модель провалилася, показавши лише 26% проти 34,6% у конкурента від OpenAI.

Цікаво, що Grok 4.5 раніше демонструвала схожу динаміку: лідерство в спеціалізованих тестах (AutomationBench-AA — 51,4% при вартості $0,34 за завдання) супроводжувалося проблемами з дотриманням захисних обмежень (0,63 зриву на завдання проти 0,55 у Claude Opus 4.8).

Тепер Маск назвав точну дату релізу. Чи підтвердяться гучні обіцянки на практиці, залежить від того, чи опублікує xAI незалежні результати тестування. Ринок чекає не слів, а цифр.

Мій аналіз: використання пропрієтарних даних SpaceX — це справді розумний хід, який може дати моделі унікальну компетенцію у фізиці та інженерії. Однак на стандартних бенчмарках загального призначення ця перевага може не спрацювати. Реальна битва розгорнеться в нішевих тестах на практичне застосування, де «життєвий досвід» моделі буде важливішим за сиру обчислювальну потужність.