Google anuncia Gemini 4 Argon com saída de 1 milhão de tokens
O Google anunciou em 30 de setembro de 2026 o Gemini 4 Argon, modelo de inteligência artificial de fronteira projetado para tarefas complexas e de longa duração. A apresentação oficial foi realizada por Koray Kavukcuoglu, vice-presidente sênior do Google DeepMind e arquiteto-chefe de IA da companhia, marcando o início da quarta geração da família Gemini.
Confirmado como o modelo mais potente da empresa até o momento, o Gemini 4 Argon concentra esforços em engenharia de software em larga escala, trabalho corporativo analítico (como finanças e jurídico) e cibersegurança defensiva. A principal evolução arquitetural é a expansão da capacidade de geração para até 1 milhão de tokens de saída por requisição, removendo o gargalo de interrupções que limitava raciocínios prolongados em modelos anteriores.
Raciocínio contínuo e saída de 1 milhão de tokens
De acordo com a publicação oficial no blog do Google, a ampliação da janela de geração para 1 milhão de tokens representa um salto de 1.462,5% em comparação com o limite anterior de 64 mil tokens adotado nos modelos da empresa (cálculo próprio). Esse espaço permite que agentes autônomos executem trajetórias completas de raciocínio, elaborem relatórios extensos e programem sistemas inteiros sem fracionar a saída.
Para sustentar essa carga sem quedas de conexão, testes documentados pela avaliação comparativa da Artificial Analysis destacam a inclusão do recurso Long Decode Continuation na API do Gemini. A funcionalidade permite pausar e retomar respostas longas de forma assíncrona entre chamadas consecutivas, evitando limites de tempo de resposta em operações pesadas.
Internamente, a equipe do Google já utiliza o Gemini 4 Argon em projetos críticos de infraestrutura. Entre os resultados reportados pela companhia estão:
- Otimização de algoritmos quânticos: pesquisadores reduziram o consumo de espaço-tempo (qubits versus portas lógicas) em sub-rotinas quânticas, superando a linha de base publicada em 40% em poucos minutos.
- Economia de memória em data centers: agentes baseados no Argon analisaram a telemetria operacional dos servidores do Google, liberando mais de 300 TiB de memória RAM na primeira fase de implementação, com economia total estimada entre 500 TiB e 1 PiB.
- Migração de código C/C++ para Rust: reescrita automatizada de bases legadas com foco em segurança de memória, incluindo o kernel Zircon do Fuchsia (com mais de 800 mil linhas) e o decodificador de vídeo de código aberto libgav1, cuja versão vetorizada em Rust operou 2,7 vezes mais rápida que o porte inicial.
Desempenho em benchmarks e foco em ciberdefesa
Em avaliações externas, o Gemini 4 Argon alcançou a pontuação de 77,9% no DeepSWE v1.1, parâmetro voltado para a resolução de desafios reais de engenharia de software de longo alcance. O índice supera modelos rivais como Claude Opus 5.5 (74,2%) e GPT-6 Astra (74,1%).
No Artificial Analysis Intelligence Index, o Argon atingiu 53 pontos, igualando o GPT-6 Astra e superando o GPT-6.1 Sol (52 pontos). O levantamento apontou ainda que o modelo do Google obteve uma taxa de alucinação de 15% no teste AA-Omniscience, a menor registrada entre todos os modelos com pontuação superior a 45 pontos no índice. Essa característica indica maior propensão a apontar ausência de informação em vez de inventar dados incorretos.
Na área de segurança ofensiva e defensiva, o modelo atingiu 68% de taxa de resolução no teste CWE-bench v1, empatando na liderança do setor para remediação autônoma de vulnerabilidades. Em testes com a parceira de cibersegurança Wiz (pelo programa Scan for Good), o sistema descobriu falhas críticas de exposição de dados pessoais em softwares de gestão hospitalar. Para viabilizar defesas proativas, o Google optou por disponibilizar versões sem travas de cibersegurança estritamente para equipes defensivas autorizadas, reforçando ao mesmo tempo barreiras internas contra injeção indireta de instruções maliciosas (prompt injection) e mitigação de desvios éticos (misalignment). Essas salvaguardas dialogam com as diretrizes de segurança para evitar vazamento de dados corporativos em IA.
Disponibilidade gradual e estrutura de preços da API
O acesso ao Gemini 4 Argon segue um cronograma em fases controlado pelo Google. Na etapa inicial, iniciada em setembro de 2026, o modelo atende apenas participantes aprovados do programa Fairwind e passa por revisões voluntárias conduzidas junto ao governo dos Estados Unidos. Conforme detalhado na compilação técnica do The Rundown AI, a liberação seguinte atenderá clientes empresariais da API paga e assinantes do nível Google AI Ultra. O Google não anunciou planos para oferecer o Argon em planos gratuitos ou no aplicativo comum para consumidores.
A estratégia acompanha a reorganização recente do ecossistema de produtividade, como a mudança estrutural que substitui os Gems por Skills no ecossistema Gemini, e segue a tendência observada no movimento do mercado corporativo visto na reformulação do Microsoft Copilot.
Para a contratação via API, a empresa divulgou uma tabela de preços que conta com desconto promocional de 50% por tempo indeterminado:
| Tipo de Token | Preço Promocional (por 1M) | Preço Regular (por 1M) |
|---|---|---|
| Entrada padrão | US$ 2,00 | US$ 4,00 |
| Saída de texto | US$ 10,00 | US$ 20,00 |
| Entrada em cache (95% desconto) | US$ 0,10 | US$ 0,20 |
Considerando uma cotação referencial de R$ 5,50 por dólar (sem a incidência de tributos e encargos de remessa internacional), o milhão de tokens de saída custa cerca de R$ 55,00 durante o desconto de lançamento e subirá para aproximadamente R$ 110,00 quando a tabela integral entrar em vigor (cálculo próprio).
Perguntas frequentes sobre o Gemini 4 Argon
Quem pode utilizar o Gemini 4 Argon agora?
O acesso está limitado a defensores cibernéticos selecionados no programa Fairwind e pesquisadores sob o acordo voluntário com o governo norte-americano. A liberação para desenvolvedores via API e assinantes corporativos do Google AI Ultra ainda não tem data pública fixada.
Haverá versão gratuita no aplicativo do Gemini?
Não. Até o momento, o Google não confirmou nenhuma versão sem custos para a variante Argon, mantendo o modelo restrito a clientes corporativos e assinantes pagantes.
A janela de 1 milhão de tokens é para entrada ou saída?
O marco de 1 milhão anunciado para o Gemini 4 Argon refere-se à capacidade máxima de saída gerada pelo modelo em uma única tarefa, diferentemente de janelas de contexto convencionais que costumam medir apenas a leitura de dados de entrada.
