Tecnologia

Gemini 4 Argon marca o regresso da Google, mas quase ninguém o pode usar ainda

O novo modelo da Google DeepMind escreve até 1 milhão de tokens e lidera as tabelas da Google, mas chega primeiro a ciberdefensores
Adrian Kessler
Adicione-nos no Google

Durante grande parte do último ano, a história da Google na inteligência artificial foi a daquilo que não tinha lançado. O Gemini 4 Argon é a resposta, e o que tem de mais revelador não é uma pontuação num benchmark. É a lista de convidados. O novo modelo de fronteira da Google DeepMind chega primeiro a um pequeno grupo de defensores de cibersegurança verificados, através do programa Fairwind da empresa, e a mais ninguém.

O Argon foi concebido para trabalho de longo fôlego: engenharia de software, investigação jurídica e financeira e ciberdefesa. A principal alteração mecânica está na extensão da resposta: o modelo consegue agora raciocinar e escrever centenas de milhares de tokens numa única passagem, o suficiente para levar uma grande migração de código até ao fim em vez de a remendar a partir de fragmentos.

A Google afirma que milhares dos seus engenheiros já o utilizam. No anúncio, a empresa descreve agentes do Argon que libertaram mais de 300 TiB de memória nos seus centros de dados e que estão a portar código C e C++ para Rust, uma linguagem com segurança de memória, até às mais de 800.000 linhas do núcleo Fuchsia Zircon. No libgav1, o descodificador de vídeo de código aberto da Google, o Argon reescreveu 32.000 linhas de código SIMD otimizado à mão em Rust seguro, que corre 2,7 vezes mais depressa do que a anterior versão em Rust.

Bar chart comparing Gemini 4 Argon and Gemini 3.8 Flash Cyber on vulnerability discovery and the Wiz penetration test benchmark
Image: Google

O limite de saída sobe para 1 milhão de tokens, face aos anteriores 64.000. Os números dos benchmarks são da própria Google: 77,9 % no DeepSWE v1.1, o primeiro lugar no Vals Index de trabalho intelectual ponderado pelo valor económico e 91,7 % no LVBench em compreensão de vídeo longo. Uma contagem do VentureBeat coloca o Argon na liderança isolada em 12 de 18 benchmarks divulgados, ao passo que o GPT-6 Astra, da OpenAI, ainda o supera por mais de dez pontos no FrontierSWE v2. Até que avaliadores externos possam pôr o modelo à prova, trata-se de alegações, não de veredictos.

A aposta na cibersegurança explica a restrição. A Google treinou o Argon para encontrar, validar e corrigir vulnerabilidades por si só, e vai disponibilizar a defensores de confiança uma versão sem as salvaguardas cibernéticas. Através da iniciativa Scan for Good da Wiz, o modelo assinalou uma falha crítica num software hospitalar que expunha dados pessoais e que modelos anteriores não tinham detetado. O mecanismo desconfortável é que um modelo tão bom a tapar falhas é, por definição, bom a encontrá-las.

Por isso, a verdadeira história são as salvaguardas. A Google afirma que o Argon se recusa a ajudar em ataques informáticos e em ataques químicos, biológicos, radiológicos ou nucleares, que é o seu modelo mais resistente até hoje à injeção de instruções e que funciona sob um monitor que acompanha a sua cadeia de raciocínio e interrompe a execução quando ultrapassa a intenção do utilizador. A Google participa ainda no processo voluntário do governo dos Estados Unidos de acesso a modelos antes do lançamento.

Quem pode utilizar hoje o Gemini 4 Argon? Apenas o grupo do Fairwind e as equipas da própria Google. Não há data para programadores, empresas ou consumidores; o acesso começará pelos clientes pagos da API e pelos subscritores do Google AI Ultra. O preço de lançamento é de 2 dólares por milhão de tokens de entrada e 10 dólares por milhão de tokens de saída, subindo depois para 4 e 20 dólares.

O modelo foi anunciado a 30 de setembro por Koray Kavukcuoglu, que assumiu a liderança da Google DeepMind depois de Demis Hassabis ter deixado o cargo de presidente executivo em agosto. É o primeiro novo modelo de referência da Google desde o Gemini 3, em novembro de 2025, e o seu verdadeiro teste não é uma tabela classificativa, mas saber se um modelo lançado sem salvaguardas permanece nas mãos a que se destinava.

Etiquetas: , , , , ,

Adicione-nos no Google

Discussão

Existem 0 comentários.