Тепер черга Google тиснути на газ: витік Gemini 4, TPU в космосі, інженер звільнився через «занадто швидкий» розвиток

Gemini 4Googleкосмічний дата-центрAI-обчисленняTPU
1 годину томуДжерело: blockweeks.com
Тепер черга Google тиснути на газ: витік Gemini 4, TPU в космосі, інженер звільнився через «занадто швидкий» розвиток

Останні два дні Gemini 4 справді протікає, як решето, у соціальних мережах.

Нові чекпойнти, нові роботи, нові порівняльні зображення з'являються одне за одним.

Щойно Lumina опублікувала ще один набір досить цікавих тестів:

Той самий «пелікан, який їде на велосипеді», з двома чекпойнтами до та після Gemini 4 Pro, безпосередньо намалював два абсолютно різні стилі.

DeepMind

Чекпойнт 1 обрав яскравий мультиплікаційний стиль; Чекпойнт 2 був помітно більш стриманим, схожим на ескіз механічної структури.

Порівнюючи два чекпойнти, сліди, залишені після тренування, вже чітко видно: лінії, структура та обробка деталей змінюються. Можливості моделі помітно стрибнули на щабель вперед.

І це, вже незліченна кількість разів, як черговий підозрюваний новий чекпойнт Gemini 4 Pro, що з'явився на Arena.

Поки спільнота все ще шалено копається в деталях, сам Google більше не приховує цього.

Цього тижня новий керівник Google DeepMind Корay Kavukcuoglu вперше підтвердив медіа: Gemini 4 вже вступив у ранню фазу після тренування.

DeepMind

△

І його мета — випустити його якомога швидше.

Ми бачили результати, ми дуже схвильовані, і ми продовжимо просувати роботу вперед у спосіб швидкої ітерації.

Ну що ж. То чекпойнти, що з'являються раунд за раундом, заздалегідь розігрівають сцену для Gemini 4?

У будь-якому разі, з тону Корay головне: якщо можна випустити раніше, то точно не випустять пізніше.

І цього разу прискорюється не лише модель. Google також готується відправити чіпи TPU в космос.

Новий проєкт ось-ось розпочне тестування прототипів, і навіть інфраструктура ШІ-обчислень починає виходити за межі Землі.

Gemini 4, вступає у фазу спринту

Не дивно, що всі так уважно стежать за Gemini 4.

Адже від попередньої флагманської моделі Gemini 3 дотепер Google пройшов чимало.

Спочатку, за планом, цього червня мав спочатку з'явитися Gemini 3.5 Pro. Генеральний директор Google Сундар Пічаї навіть заздалегідь анонсував його на травневій конференції розробників I/O.

Зрештою, його не випустили.

DeepMind

Хоча тим часом послідовно оновлювалися Gemini 3.1 та кілька моделей Flash, 3.5 Pro так і не з'явився офіційно.

Корay також пояснив цього разу, що команда вирішила «трохи призупинитися» на півдорозі, і спочатку зосередити енергію на серії Flash.

А тепер ритм знову явно змінився.

Корай дав зрозуміти, що вони хочуть досягти максимальної швидкості навчання за найкоротший можливий час.

Прислухайтеся до тону. Це майже робить поточний підхід Google очевидним.

Хоча прямо не було сказано, чи Google офіційно скасував проєкт Gemini 3.5 Pro, безсумнівно те, що команда переключила всю свою увагу на Gemini 4.

Gemini 3.5 Pro можна поки що відкласти, але навчання, тестування, зворотний зв'язок і повторна ітерація Gemini 4 повинні проходити коло за колом якомога швидше.

DeepMind

З цією метою Google вже почав одночасно створювати внутрішні гарантії безпеки та процеси тестування Gemini 4. Наразі цей механізм уже працює спочатку на внутрішніх інструментах AI-кодування.

На цьому етапі, знову дивлячись на підозрілі контрольні точки Gemini 4, які нещодавно з'явилися в Arena, стає ще цікавіше.

З останнім випуском Lumina «пелікан їде на велосипеді», центр обговорення всіх змістився з «яка контрольна точка краща» на «Наскільки насправді наздогнав Gemini 4?»

DeepMind

Дехто прямо вигукнув: Gemini повернувся в гру, вважаючи, що якщо ці контрольні точки справжні, Google швидко скорочує розрив з OpenAI /Anthropic.

DeepMind

Інші вважають, що наразі він не може протистояти GPT-6 SOL, і порівняно з серією Mythos, яку Anthropic запустив цієї весни та нещодавно оновив, не можна сказати, що він має переважну перевагу.

DeepMind

Стикнувшись із сумнівами, Корай досить впевнений.

Я сповнений впевненості в цій команді. Ми обов'язково завжди будемо на передньому краї.

У серпні цього року, після того як Гассабіс залишив щоденне управління Google DeepMind, Корай офіційно взяв на себе цей напрямок, продовжуючи виконувати обов'язки головного AI-архітектора Google.

Як Gemini працюватиме далі і як швидко він працюватиме, Корай зараз є одним із найважливіших осіб, хто ухвалює рішення.

У будь-якому разі, його слова вже прозвучали, і далі залежить від того, чи сам Gemini 4 зможе їх наздогнати.

Кидаючи виклик Nvidia, TPU вперше вирушає в космос

Якщо дивитися лише на Gemini 4, легко подумати, що команда моделей Google лише починає знову прискорюватися цього раунду.

Насправді, ще більш вражаючим є те, що навіть обчислювальна потужність почала синхронно натискати на газ.

Нещодавно Корай чітко зазначив, що дослідження та розробка фронтирних моделей DeepMind тепер також безпосередньо «зворотно живлять» власний апаратний бізнес Google.

Раніше TPU переважно ховався за Google Cloud, і клієнти купували хмарні послуги. Але тепер Google почав продавати TPU-чіпи безпосередньо!

Мета досить зрозуміла: кинути виклик Nvidia.

DeepMind

Більше того, команда моделей і команда чіпів також стають дедалі тісніше пов'язаними.

Нові вимоги, що виникають, коли DeepMind створює моделі наступного покоління, заздалегідь передаються інженерам з апаратного забезпечення, дозволяючи їм планувати наступні два-три покоління TPU.

Модель: Брате, я готуюся знову споживати ✕✕ обчислювальної потужності наступного раунду. Чіп: Зрозумів, починаю будувати зараз.

Google співпрацює з американською комерційною супутниковою компанією Planet, плануючи запустити прототипи супутників через SpaceX Falcon 9, які нестимуть 4 TPU, щоб перевірити їхню здатність працювати на орбіті.

Проєкт називається «Project Suncatcher».

Ідея також дуже в стилі Google: оскільки наземні центри обробки даних для ШІ споживають електроенергію, займають землю та потребують великої кількості водяного охолодження, чому б просто не перенести частину інфраструктури машинного навчання на орбіту, де сонячної енергії більше?

Однак наразі це лише перший крок.

У космосі неможливо розсіювати тепло через конвекцію повітря, як у наземних центрах обробки даних, і чіпи, що безперервно працюють під високим навантаженням, швидко зіткнуться з проблемами терморегулювання.

Згідно з планом, чіпи можуть працювати в космосі близько 15 хвилин, після чого їх потрібно вимкнути для охолодження.

Тож цього разу це більше схоже на перевірку одного: чи зможе TPU спочатку вижити та працювати на орбіті.

Що ж до справжнього з'єднання десятків супутників у мережу за допомогою лазерів і перетворення її на «космічний центр обробки даних для ШІ», то це ще справа майбутнього.

DeepMind

Інші все ще борються за приміщення для центрів обробки даних, а Google вже почав думати про землю в небі.

Однак, якраз коли всі в Google закликали до прискорення, дехто з команди пішов.

Колишній інженер Mozilla Роберт О'Каллаган, який згодом приєднався до DeepMind, учора оголосив про свою відставку.

DeepMind

Причина виявилася не в тому, що він зневажав розвиток ШІ Google через надто повільні темпи, а навпаки — «надто швидкі»?

Роберт не навчав моделі безпосередньо, а відповідав за інструменти проєктування апаратних чіпів.

Але працюючи над цим, він виявив, що ці інструменти прискорять проєктування чіпів ШІ наступного покоління, ще більше знижуючи вартість і затримку ШІ.

На його думку, це означало, що штучний інтелект стане дешевшим, ефективнішим, а отже, поширенішим і потужнішим.

Роберт розмовляв з колегами з DeepMind про ризики ШІ, і майже всі були глибоко стурбовані цим, але багато хто не висловлював цього публічно.

Більше того, Корай не мав наміру зупинятися і навіть відчував, що «це потрібно ще швидше».

Спочатку Роберт не думав про безпосередній вихід, адже платня була досить щедрою. Він лише хотів перейти на інженерну посаду, яка зовсім не прискорювала ШІ.

Але через обмеження його регіону та варіантів роботи цей шлях зрештою не спрацював.

Ще одна річ

Контрольні точки з'являються шалено, TPU злітають, інженери звільняються. Дивлячись на ці речі цього тижня, у цьому є певний чорний гумор.

Тоді продуктивність Gemini 3 колись змусила OpenAI оголосити «червону тривогу», але сама Google потім відстала на пів кроку у своєму флагманському ритмі.

Тепер, коли Корай очолює команду, вона вирішує знову прискоритися і довести швидкість навчання до максимуму. І це не лише одна продуктова лінія прискорюється; моделі, чипи та організаційний ритм — усе починає рухатися вперед.

Google: вона справді не може дозволити собі чекати далі.

Ця стаття походить з облікового запису WeChat «Quantum Bit», автор: Focus on Frontier Technology