O Gemini 4, nos últimos dois dias, tem vazado feito uma peneira nas redes sociais.
Novos checkpoints, novos trabalhos, novas imagens comparativas, surgindo um atrás do outro.
Agora mesmo, a Lumina divulgou outro conjunto de testes bastante divertidos:
O mesmo "pelicano andando de bicicleta", com dois checkpoints antes e depois do Gemini 4 Pro, desenhou diretamente dois estilos completamente diferentes.
O Checkpoint 1 seguiu um estilo de desenho animado vibrante; o Checkpoint 2 foi visivelmente mais contido, como um esboço de estrutura mecânica.
Colocando os dois checkpoints lado a lado, os vestígios deixados pelo pós-treinamento já são claramente visíveis: linhas, estrutura e tratamento de detalhes estão todos mudando. As capacidades do modelo deram visivelmente um salto de qualidade.
E isso, já é incontável como o enésimo suposto novo checkpoint do Gemini 4 Pro a surgir na Arena.
Enquanto a comunidade ainda está vasculhando freneticamente os detalhes, o próprio Google não está mais escondendo.
Esta semana, o novo chefe do Google DeepMind, Koray Kavukcuoglu, pela primeira vez confirmou à mídia: o Gemini 4 já entrou em pós-treinamento inicial.
△
E seu objetivo é lançá-lo o mais rápido possível.
Vimos os resultados, estamos muito empolgados e continuaremos a impulsionar o trabalho de forma rápida e iterativa.
Bem, bem. Então os checkpoints que surgem rodada após rodada estão aquecendo o palco para o Gemini 4 com antecedência?
De qualquer forma, pelo tom de Koray, o ponto principal é: se puder ser lançado cedo, com certeza não será lançado tarde.
E desta vez, não é apenas o modelo que está acelerando. O Google também está se preparando para enviar chips TPU ao espaço.
O novo projeto está prestes a iniciar testes de protótipo, e até mesmo a infraestrutura de computação de IA está começando a se estender além da Terra.
Gemini 4, entrando na fase de sprint
Não é surpresa que todos estejam acompanhando o Gemini 4 tão de perto.
Afinal, desde o modelo carro-chefe da geração anterior, o Gemini 3, até agora, o Google passou por bastante coisa nesse meio-tempo.
Originalmente, conforme o plano, este junho deveria ter trazido primeiro o Gemini 3.5 Pro. O CEO do Google, Sundar Pichai, até o pré-visualizou antecipadamente na conferência de desenvolvedores I/O de maio.
No final, não foi lançado.
Embora o Gemini 3.1 e vários modelos Flash tenham sido atualizados sucessivamente nesse meio-tempo, o 3.5 Pro nunca fez uma aparição oficial.
Koray também explicou desta vez que a equipe optou por "pausar um pouco" no meio do caminho, e primeiro concentrou energia na série Flash.
E agora, o ritmo mudou claramente de novo.
Koray deixou claro que eles querem alcançar a velocidade máxima de aprendizado no menor tempo possível.
Ouça o tom. Isso quase deixa clara a abordagem atual do Google.
Embora não tenha sido dito explicitamente se o Google cancelou oficialmente o projeto Gemini 3.5 Pro, o que é certo é que a equipe voltou toda a sua atenção para o Gemini 4.
O Gemini 3.5 Pro pode ser deixado de lado por enquanto, mas o treinamento, os testes, o feedback e a reiteração do Gemini 4 devem rodar rodada após rodada o mais rápido possível.
Para isso, o Google já começou a construir simultaneamente as garantias internas de segurança e os processos de teste do Gemini 4. No momento, esse mecanismo já está em execução primeiro nas ferramentas internas de codificação por IA.
Neste ponto, olhar novamente para os supostos checkpoints do Gemini 4 que surgiram recentemente na Arena torna-se ainda mais interessante.
Com o mais recente lançamento do Lumina de "pelicano andando de bicicleta", o centro da discussão de todos mudou de "qual checkpoint é melhor" para "Até onde o Gemini 4 realmente alcançou?"
Algumas pessoas gritaram diretamente: o Gemini está de volta ao jogo, acreditando que, se esses checkpoints forem reais, o Google está rapidamente fechando a lacuna com a OpenAI /Anthropic.
Outros sentem que atualmente ele não pode enfrentar o GPT-6 SOL de igual para igual e, em comparação com a série Mythos que a Anthropic lançou nesta primavera e atualizou recentemente, não se pode dizer que tenha uma vantagem esmagadora.
Diante das dúvidas, Koray está bastante confiante.
Estou cheio de confiança nesta equipe. Com certeza estaremos sempre na vanguarda.
Em agosto deste ano, depois que Hassabis deixou a gestão diária do Google DeepMind, Koray assumiu oficialmente esse negócio, enquanto continuava a atuar como Arquiteto-Chefe de IA do Google.
Como o Gemini avança a seguir e quão rápido avança, Koray é agora um dos tomadores de decisão mais críticos.
De qualquer forma, suas palavras já foram ditas, e agora depende de o próprio Gemini 4 conseguir alcançá-las.
Desafiando a Nvidia, o TPU vai ao espaço pela primeira vez
Se você olhar apenas para o Gemini 4, é fácil pensar que a equipe de modelos do Google está apenas começando a acelerar novamente nesta rodada.
Na verdade, o que é ainda mais exagerado é que até o poder de computação começou a pisar no acelerador em sincronia.
Koray mencionou recentemente claramente que a pesquisa e o desenvolvimento de modelos de fronteira do DeepMind agora também estão diretamente "retroalimentando" o próprio negócio de hardware do Google.
Anteriormente, o TPU estava principalmente escondido atrás do Google Cloud, e os clientes compravam serviços de nuvem. Mas agora, o Google começou a vender chips TPU diretamente!
O objetivo é bastante claro, desafiar a Nvidia.
Além disso, a equipe de modelos e a equipe de chips também estão se tornando cada vez mais estreitamente vinculadas.
Novos requisitos gerados quando o DeepMind faz modelos de próxima geração serão retroalimentados aos engenheiros de hardware com antecedência, permitindo que planejem as próximas duas a três gerações de TPU.
Modelo: Cara, estou me preparando para consumir ✕✕ poder de computação novamente na próxima rodada. Chip: Entendi, começando a construir agora.
O Google está cooperando com a empresa americana de satélites comerciais Planet, planejando lançar satélites protótipos via SpaceX Falcon 9, que carregarão 4 TPUs para testar sua capacidade de operar em órbita.
O projeto é chamado de "Project Suncatcher".
A ideia também é muito Google: já que os data centers de IA baseados em terra consomem eletricidade, ocupam terra e exigem grandes quantidades de resfriamento a água, por que não simplesmente mover parte da infraestrutura de aprendizado de máquina para a órbita, onde a energia solar é mais abundante?
No entanto, atualmente é apenas o primeiro passo.
No espaço, não há maneira de dissipar calor através da convecção do ar como nos data centers terrestres, e chips executando continuamente sob alta carga rapidamente encontrarão problemas de gerenciamento térmico.
De acordo com o plano, os chips podem operar no espaço por cerca de 15 minutos, após os quais precisam ser desligados para esfriar.
Então desta vez é mais como verificar uma coisa: se o TPU pode primeiro sobreviver e funcionar em órbita.
Quanto a realmente conectar dezenas de satélites em uma rede com lasers e transformá-la em um "data center de IA espacial", isso ainda é uma questão posterior.
Outros ainda estão lutando por salas de data center, enquanto o Google já começou a pensar em terra no céu.
No entanto, assim como todos no Google estavam gritando por aceleração, alguém na equipe pediu demissão.
O ex-engenheiro da Mozilla Robert O'Callahan, que mais tarde se juntou ao DeepMind, anunciou sua renúncia ontem.
A razão acabou não sendo que ele desprezava o desenvolvimento de IA do Google por ser muito lento, mas sim "muito rápido"?
Robert não treinava modelos diretamente, mas era responsável por ferramentas de design de chips de hardware.
Mas enquanto trabalhava nisso, ele descobriu que essas ferramentas acelerariam o design de chips de IA de próxima geração, reduzindo ainda mais o custo e a latência da IA.
Em sua visão, isso significava que a inteligência artificial se tornaria mais barata, mais eficiente e, portanto, mais difundida e mais poderosa.
Robert conversou com colegas do DeepMind sobre os riscos da IA, e quase todos estavam profundamente preocupados com isso, mas muitos não expressaram isso publicamente.
Além disso, Koray não tinha intenção de parar, e até sentia que "precisa ser ainda mais rápido".
No início, Robert não pensava em sair diretamente, afinal, o salário era bastante generoso. Ele só queria mudar para uma posição de engenharia que não acelerasse a IA de forma alguma.
Mas, limitado por sua região e opções de trabalho, esse caminho acabou não dando certo.
Mais uma coisa
Checkpoints surgindo descontroladamente, TPUs disparando, engenheiros pedindo demissão. Olhar para essas coisas nesta semana tem um certo humor sombrio.
Naquela época, o desempenho do Gemini 3 havia colocado a OpenAI em "alerta vermelho", mas o próprio Google depois ficou meio passo atrás no ritmo de seus carros-chefe.
Agora, com Koray liderando a equipe, ela escolhe reacelerar e levar a velocidade de aprendizado ao máximo. E não é apenas uma linha de produtos acelerando; modelos, chips e ritmo organizacional estão todos começando a avançar.
Google: realmente não pode mais esperar.
Este artigo vem da conta pública do WeChat "Quantum Bit", autor: Foco em Tecnologia de Fronteira
















