Індустрія втіленого штучного інтелекту стоїть на порозі тектонічного зсуву. Голова китайського стартапу ACE Robotics Ван Сяоган переконаний, що вже до кінця 2027 року ми станемо свідками своєрідного «моменту ChatGPT» для робототехніки. За його словами, ключовим каталізатором стане якісний стрибок у моделях керування та експоненційне зростання даних про фізичну взаємодію зі світом.
«Ми очікуємо "момент ChatGPT" для втіленого інтелекту до кінця наступного року», — заявив Ван.
Однак не варто чекати миттєвої революції на ринку. Голова компанії прогнозує, що широке комерційне впровадження таких технологій займе ще щонайменше чотири-п'ять років. Це реалістичний горизонт для подолання інфраструктурних і регуляторних бар'єрів.
Проблема не в «залізі», а в «мозках»
Сучасні гуманоїди вже демонструють вражаючу спритність: вони бігають, танцюють і виконують вузькоспеціалізовані завдання. Але їхня головна слабкість — нездатність адаптуватися до незнайомих умов і вирішувати широкий спектр нестандартних завдань. В ACE Robotics слушно зазначають, що апаратна частина давно перестала бути вузьким місцем. Основне гальмо — незрілість ІІ-моделей, які мають у реальному часі обробляти сенсорну інформацію, інтерпретувати команди та прораховувати наслідки кожного руху.
Для вирішення цього завдання компанія розробляє власну модель Kairos, що поєднує сприйняття, мультимодальне розуміння та планування поведінки. Успіхи вже є: у липні Kairos очолила чотири авторитетні тести для втіленого ІІ, включно з керуванням двома маніпуляторами та довгостроковим плануванням. Примітно, що відкрита версія Kairos-4B, маючи лише 4 млрд параметрів, обійшла в публічних бенчмарках важчі системи, зокрема Nvidia Cosmos 3 і Lingbot від Ant Group.
Дефіцит даних — головний виклик
Ван Сяоган підкреслює, що головний дефіцит індустрії — це дані про реальну фізичну взаємодію. За всі роки розвитку сектор зібрав лише близько 100 000 годин таких записів, чого катастрофічно мало для навчання фундаментальних моделей. Традиційний підхід — телеуправління в екзоскелетах — надто повільний і дорогий.
ACE Robotics пропонує інноваційний шлях: вони оснащують легкими датчиками звичайних працівників на діючих виробничих лініях, записуючи їхні природні дії. Це дозволяє збирати дані в промислових масштабах. Стартап розраховує накопичити десятки мільйонів годин протягом двох років, що стане незаперечною конкурентною перевагою.
Амбітні плани та стратегія масштабування
Компанія вже тестує свої рішення в безпілотній роздрібній торгівлі, готельному сервісі та на складах швидкої доставки. Апаратну базу забезпечують гуманоїди від Unitree, AgiBot і Fourier. Плани вражають: протягом наступного року технологію впровадять щонайменше в 1000 магазинів, а до кінця другого року — у 10 000. Для навчання моделей використовується не лише Nvidia, а й китайські чипи Rhino Tech і Digua Robotics — усвідомлений крок для зниження витрат і зменшення залежності від одного постачальника.
ACE Robotics, заснована в липні 2025 року за підтримки Ant Group і SenseTime, уже залучила понад $100 млн у першому півріччі 2026-го та готується до IPO, щойно дозволить місцеве законодавство.
Мій погляд: Прогноз Вана виглядає амбітним, але не позбавленим підстав. Ключовий фактор — саме дані, і підхід ACE Robotics до їхнього збору в реальних умовах виглядає проривним. Якщо їм вдасться досягти заявлених обсягів, це може дійсно прискорити еволюцію роботів, перетворивши їх із вузькоспеціалізованих машин на універсальних помічників. Втім, чотирирічний лаг до комерціалізації — це оптимістичний сценарій, з огляду на складність інтеграції в наявні бізнес-процеси.