Skip to main content
OpenAI

Vazamento do GPT-5.6, fusão da Deepseek e acordo do Google com o Pentágono

O vazamento do GPT-5.6 nos logs do Codex, o rumor de fusão Deepseek-Moonshot e o acordo secreto do Google com o Pentágono: o que cada sinal significa.

21 min
Tempo de leitura
4,002
Palavras
Publicado
Engr Mejba Ahmed

Escrito por

Engr Mejba Ahmed

Compartilhar Artigo

Vazamento do GPT-5.6, fusão da Deepseek e acordo do Google com o Pentágono

Quase escrevi esse post três vezes diferentes.

O primeiro rascunho era apenas sobre a entrada GPT-5.6 que apareceu nos logs de sessão Codex na mesma semana em que GPT-5.5 foi ao ar – o tipo de vazamento que faz o Twitter de engenharia girar por 48 horas e depois desaparece. O segundo rascunho era sobre o boato sobre a fusão Deepseek e Moonshot, porque se for real, ele remodela o mapa AI de código aberto para o resto de 2026. O terceiro era sobre o acordo classificado Pentagon da Google - aquele que 600 de seus próprios funcionários estão pedindo publicamente à empresa para desistir de.

Então notei algo. Todas as três histórias surgiram na mesma janela de dez dias no final de abril. Eles se sentem não relacionados. Eles não são. São três ângulos da mesma mudança: a capacidade AI está agora a aumentar mais rapidamente do que as instituições à sua volta conseguem absorver. A cadência de lançamento é mensal. A capital está se consolidando além-fronteiras. O pipeline de defesa está totalmente aberto. E todos nós estamos fingindo que isso é normal porque as manchetes se movem rápido demais para serem assistidas.

Passei a última semana lendo todas as fontes primárias que pude encontrar sobre essas três histórias - os registros vazados do Codex, os registros do IPO da Bloomberg, a carta aberta do Google, os documentos do contrato Pentagon CDAO. O que quero fazer aqui é analisar o que realmente foi verificado, o que ainda é boato e o que os três querem dizer quando você os coloca na mesma mesa. Porque se você estiver construindo algo com base nesses modelos - e a maioria de nós que está lendo isso está - você precisa de uma visão clara de para onde os trilhos estão indo.

Vamos começar com o vazamento que está gerando o barulho mais alto.

O que realmente aconteceu com o vazamento do GPT-5.6

Aqui está a versão curta. Em 24 de abril de 2026, OpenAI lançou oficialmente o GPT-5.5 para usuários Plus, Pro, Business e Enterprise - o modelo que a comunidade chamava de "Spud" após meses de benchmarks vazados (fonte: OpenAI). Poucas horas após o lançamento, um desenvolvedor notou algo estranho em seus logs de sessão Codex. A maioria das chamadas foi roteada para GPT-5.5, conforme esperado. Mas uma entrada de log mostrou o nome do modelo como gpt-5.6. Não 5,5. Não é um ajuste fino. Um número de versão que não existia publicamente (fonte: TechCity Authority).

A captura de tela foi postada. O tópico explodiu. Quando alguém voltou para verificar, a entrada havia desaparecido completamente dos arquivos da sessão.

Quero ter cuidado aqui, porque esse é exatamente o tipo de história em que o ruído ultrapassa o sinal em cerca de noventa minutos.

O que sabemos com certeza: uma entrada de log Codex referenciando GPT-5.6 era real. Vários desenvolvedores viram isso. A captura de tela é consistente com o formato real do arquivo de sessão Codex. OpenAI não comentou sobre isso.

O que não sabemos: se GPT-5.6 é um modelo real, uma tag de avaliação interna, uma implantação canário, um teste de roteamento com nome incorreto ou uma string em um arquivo de configuração que foi exposta acidentalmente. Há uma diferença significativa entre "OpenAI está testando GPT-5.6 contra tráfego real" e "alguém em OpenAI digitou gpt-5.6 em um dicionário Python e uma solicitação o atingiu uma vez". Ambos produzem a mesma captura de tela.

A leitura mais honesta: OpenAI quase certamente está executando tráfego canário ou de avaliação em algo mais recente que GPT-5.5. É assim que todo laboratório modelo faz. Uma fatia controlada de solicitações é encaminhada para um experimento, os resultados são coletados e a entrada é limpa. O fato de o log ter surgido foi um deslize do lado do servidor – o mesmo tipo de deslize que expôs uma janela de 90 minutos de tráfego GPT-5.5 antes do lançamento oficial (fonte: Startup Fortune).

Então GPT-5.6 chegará este mês? Provavelmente não como um lançamento público. Alguma coisa está vindo? Quase certamente. A evidência não é o vazamento em si – é a cadência em torno dele.

A cadência é a verdadeira história

Veja esta linha do tempo. GPT-5.0 foi lançado no início de 2026. GPT-5.2 foi lançado cerca de três meses depois. GPT-5.3 foi atingido logo depois. GPT-5.4 caiu enquanto as equipes ainda estavam avaliando o 5.3. GPT-5.5 foi lançado em 24 de abril. E agora as referências GPT-5.6 estão aparecendo nos logs de produção cinco dias após o lançamento do 5.5.

Abordei a janela de lançamento do GPT-5.4 em meu detalhamento da mudança da indústria do GPT-5.4 e, na época, escrevi que a lacuna entre a versão principal e o lançamento pontual estava diminuindo. Eu não esperava que fosse compactado tão rápido. Passamos de lançamentos pontuais trimestrais para quase mensais dentro de um ano civil.

Por que isso é importante se você envia código sobre OpenAI: o aprisionamento do modelo ficou mais barato. Um fluxo de trabalho ajustado para GPT-5.5 hoje pode ser mensuravelmente superado por um modelo 5.6 em 30 dias. O padrão "testar uma vez e implantar" está inoperante. O padrão que funciona agora é mais como um equipamento de CI que executa novamente seu conjunto de avaliação sempre que uma nova variante de modelo é enviada.

Eu criei um para mim no mês passado - um pequeno script Python que faz ping em meu conjunto de prompts com o modelo API mais recente em um cron semanal e publica uma comparação no Slack. Não é glamoroso. Mas a primeira vez que o GPT-5.5 melhorou silenciosamente uma tarefa de saída estruturada que o GPT-5.4 estava falhando 30% das vezes, enviei a atualização em uma hora, em vez de descobrir três semanas depois. Se você estiver construindo algo sério com base nesses modelos, precisará desse pipeline. Se você não estiver construindo, continuará sendo pego de surpresa.

O ângulo Spud-vs-Mythos

Aqui está a parte que conecta o vazamento a uma história maior. O codinome interno “Spud” – que a comunidade inicialmente pensou ser um modelo de fronteira totalmente novo – acabou sendo GPT-5.5. O memorando OpenAI vazado do final de março descreveu explicitamente Spud como posicionado para se opor ao modelo Mythos da Anthropic (fonte: AIBase).

Mythos é aquele em quem realmente devemos prestar atenção. É o modelo da fronteira antrópica que vazou através de um bucket S3 mal configurado no final de março, com documentos internos descrevendo-o como uma "mudança radical" na capacidade e com pontuação "drasticamente superior" ao Opus 4.6 em benchmarks de codificação, raciocínio e segurança cibernética (fonte: Fortune). Eu analisei o que sabíamos na época na análise de vazamento de Claude Mythos e escrevi então que o tempo do GPT-5.5 parecia deliberado. Agora temos os recibos: OpenAI enviou GPT-5.5 especificamente como uma resposta contra-posicionada ao Mythos, e a referência GPT-5.6 nos logs Codex sugere que eles têm algo mais na fila por trás dele.

Não se trata de duas empresas competindo em um roteiro. São duas empresas executando um ciclo de lançamento de arma a arma, onde cada navio público é uma resposta tática ao vazamento do outro. Essa é uma indústria diferente daquela que tínhamos há seis meses.

Mas é aqui que as coisas ficam mais interessantes – porque enquanto OpenAI e Anthropic estão negociando vazamentos na Califórnia, a verdadeira mudança de padrão em 2026 está acontecendo em Pequim.

O boato sobre a fusão Deepseek e Moonshot: o que é real

A história que circulava no final de abril era que Deepseek e Moonshot AI – os dois laboratórios de código aberto mais agressivos da China – estavam se preparando para se fundir. O ângulo flutuando nos tópicos do Substacks e do Twitter era que a fusão os consolidaria em um único campeão nacional antes do suposto IPO de Moonshot em Hong Kong, com uma avaliação combinada ao norte de US$ 20 bilhões.

Investiguei essa história por quase dois dias porque é a história que eu mais queria que fosse verdadeira. Uma fusão Deepseek-Moonshot criaria o laboratório de pesos abertos mais capaz do planeta, com a enorme herança de janela de contexto de Kimi e a arquitetura Multi-head Latent Attention de Deepseek sob o mesmo teto. Seria o momento AI de código aberto da década.

Isso não está acontecendo. Pelo menos não da forma como o boato o enquadra.

Aqui está o que é realmente verificável. Moonshot AI está em negociações reais e documentadas de IPO. A Bloomberg confirmou no final de março que Moonshot está em discussões com a China International Capital Corp. e Goldman Sachs sobre uma listagem em Hong Kong (fonte: Bloomberg). O Wall Street Journal informou que a empresa estava levantando várias centenas de milhões de dólares com uma avaliação de aproximadamente US$ 4 bilhões, visando um IPO no segundo semestre de 2026 (fonte: Resumo do Techmeme). A avaliação do próprio Deepseek foi estimada em cerca de US$ 20 bilhões em rodadas recentes (fonte: BigGo Finance).

Mas a relação real entre os dois laboratórios não é uma fusão. É algo mais interessante e estrategicamente significativo: sinergia técnica profunda sem consolidação jurídica.

O Deepseek V4, que finalmente foi lançado em 23 de abril após meses de atrasos, adotou o otimizador Muon do Moonshot no atacado. Anteriormente, Kimi K2 integrou o mecanismo pioneiro de atenção latente multicabeças do Deepseek. Os dois laboratórios estão compartilhando pesquisas básicas e citando os artigos um do outro em cartões de modelo de produção (fonte: BigGo Finance).

Esta é a aparência real da estratégia industrial chinesa AI em 2026. Não é uma fusão de cima para baixo ordenada por Pequim. É uma interoperabilidade técnica coordenada entre empresas supostamente independentes, com otimizadores compartilhados, arquiteturas de atenção compartilhada e pipelines de computação cada vez mais compartilhados – todos caminhando para a mesma pilha de chips doméstica.

O pivô do chip Huawei é a verdadeira bomba

Aqui está a parte que a maior parte da cobertura da fusão está enterrada. A razão pela qual o Deepseek V4 foi adiado após o Ano Novo Chinês não foi o modelo em si. Foi hardware. A Bloomberg confirmou no final de abril, citando uma conta afiliada à CCTV, que o atraso do V4 foi impulsionado pela transição do Deepseek da Nvidia para os chips Ascend da Huawei (fonte: Bloomberg). A Reuters informou separadamente que o V4 foi lançado rodando no hardware Ascend mais recente.

Leia isso novamente. O laboratório de pesos abertos mais econômico do mundo acaba de migrar com sucesso o treinamento e a inferência da Nvidia. Esse fato sobreviverá a todos os rumores de fusão. Abordei o modelo em si em minha análise do Deepseek V4 Pro, mas a história da pilha de chips é aquela que deve estar no planejamento de cada equipe de infraestrutura AI pelos próximos doze meses.

A versão multimodal, aliás, não vem com a V4. A linha oficial, confirmada pelos relatórios de fonte primária do ChinaTalk, é que as restrições de computação e de capital empurraram o treinamento de geração multimodal para fora do escopo da versão V4 (fonte: ChinaTalk). V4 continua sendo um modelo de linguagem. O multimodal Deepseek está na fila, não atrasado indefinidamente – mas não foi o que foi enviado em 23 de abril.

Portanto, se você estava esperando que um megalaboratório chinês surgisse e desafiasse OpenAI, essa não é a decisão. A mudança consiste em dois laboratórios executando pesquisa e desenvolvimento coordenados em uma pilha de chips doméstica, com um deles prestes a abrir o capital para capitalizar a próxima rodada de computação. E cada decisão de infraestrutura ocidental AI deve levar em conta isso.

A terceira história é onde deixa de ser sobre a capacidade AI e começa a ser sobre a quem se destina a capacidade.

O acordo do Google com o Pentágono e os 600 engineers que disseram não

Em 28 de abril de 2026, mais de 580 funcionários do Google – incluindo pesquisadores seniores da DeepMind, mais de 20 diretores e vice-presidentes e cerca de dois terços nomeados publicamente – assinaram uma carta aberta instando o CEO Sundar Pichai a recusar um acordo classificado Pentagon AI (fonte: TheNextWeb). A carta era direta: “Acreditamos que Google não deveria estar no ramo da guerra”.

Google avançou com o acordo de qualquer maneira (fonte: Gizmodo).

Quero analisar isso com cuidado, porque a versão do título perde o que é realmente novo.

O que o acordo realmente faz

O acordo Google-Pentagon faz parte de uma aquisição mais ampla de US$ 800 milhões de fronteira-AI administrada pelo Chief Digital and Artificial Intelligence Office (CDAO) do Pentagon. Em junho de 2025, OpenAI recebeu o primeiro contrato de US$ 200 milhões. Em julho de 2025, Anthropic, Google e xAI receberam, cada um, seus próprios contratos de teto de dois anos de US$ 200 milhões (fonte: Breaking Defense). Os contratos cobrem protótipos de fluxos de trabalho AI para "missões de segurança nacional" - linguagem explícita dos documentos de aquisição do CDAO (fonte: DefenseScoop).

Em março de 2026, Google transferiu agentes Gemini AI para a força de trabalho de três milhões de funcionários do Pentagon em sistemas não confidenciais. Em abril de 2026, esse acesso estendeu-se a redes classificadas. Os termos permitem o uso do Pentagon do Gemini para "qualquer propósito legal do governo", que - e esta é a linguagem que a carta aberta clama - inclui explicitamente o planejamento da missão e o apoio ao direcionamento de armas, com restrições apenas à vigilância doméstica em massa e armas totalmente autônomas sem supervisão humana (fonte: NBC News).

O eco do Projeto Maven ninguém está falando corretamente

Todos os meios de comunicação cobriram o paralelo do Projeto Maven – em 2018, cerca de 4.000 funcionários do Google assinaram uma petição sobre a análise do AI de feeds de vídeo de drones, e o Google deixou o contrato expirar. A carta de 2026 está sendo enquadrada como “Maven 2.0”.

Não é. É algo diferente e mais significativo.

Em fevereiro de 2025, Google removeu discretamente a passagem de seus princípios públicos AI que excluíam armas e tecnologia de vigilância (fonte: Computing.co.uk). O compromisso de 2018 de que "Google não buscará AI para armas" desapareceu da política. A carta de 2026 não pede que Google honre seus princípios. Os princípios já mudaram. A carta pede a Google que recuse um contrato que sua própria política agora permite.

Essa é a verdadeira mudança. O protesto de 2018 funcionou porque a apólice e o contrato estavam desalinhados e Google escolheu a apólice. O protesto de 2026 está acontecendo depois que Google realinhou preventivamente a política com o tipo de contrato que agora deseja assinar. A resposta institucional já estava definida antes de os engenheiros serem questionados.

Não vou fingir que tenho uma visão clara da ética aqui. Tenho uma visão clara da realidade da engenharia: todos os principais modelos de fronteira dos EUA são agora adquiridos pela defesa. OpenAI, Anthropic, Google, xAI – todos os quatro laboratórios têm contratos de teto de US$ 200 milhões com o CDAO do Pentagon em execução até 2027. A saída "Não vou construir para defesa" não existe mais para engenheiros que trabalham na camada do modelo de base. A decisão subiu no organograma e saiu do documento de princípios.

O que isso significa para o que você constrói com base nesses modelos

Se você estiver enviando um produto além do Gemini, Claude, GPT ou Grok, agora você está a jusante de um relacionamento de aquisição de nível de defesa. Essa é uma realidade jurídica e de reputação, não um slogan. Algumas implicações específicas que vale a pena pensar:

A residência de dados e o isolamento do locatário são mais importantes. A implantação classificada do Google é executada em infraestrutura dedicada com regras de filtragem separadas. Seu Gemini comercial API não. Certifique-se de entender em qual nível você está e como é o fluxo de dados real.

A política de conteúdo ficará mais barulhenta. Quando os casos de uso do Pentagon exigirem filtros de segurança relaxados para implantações específicas, espere que o comportamento do filtro de nível comercial mude – às vezes afrouxando, às vezes apertando – à medida que os laboratórios equilibram vários perfis de clientes. Sua engenharia imediata precisará de fixação de versão mais do que há um ano.

A pressão sobre os preços é real. US$ 800 milhões em contratos de dois anos garantem aos quatro principais laboratórios dos EUA níveis mínimos de receita, o que altera sua estratégia de preços comerciais. Espero que a compressão de preços API em modelos de nível inferior acelere até 2026, à medida que a receita de defesa amortece os negócios voltados para o consumidor.

A questão mais profunda – se construir qualquer produto de consumo com base num modelo de base adquirido pela defesa é algo que se deseja fazer – é uma decisão pessoal. Eu tenho minha própria linha. Não vou dizer onde desenhar o seu. Mas fingir que a linha não existe é o que não farei aqui.

O que estou realmente fazendo com relação a todos esses três

Ok, três histórias, três formas diferentes de risco. Aqui está o que estou mudando em meu próprio fluxo de trabalho esta semana, concretamente:

1. Estou fixando a versão de cada chamada de modelo em produção. Cada chamada API agora especifica uma versão exata do modelo, não um alias gpt-latest ou claude-default. A cadência é muito rápida para permitir que o roteamento se desloque silenciosamente. Esta já era uma boa prática. Agora não é negociável.

2. Estou executando um conjunto de avaliação semanal contra novas variantes de modelo. O mesmo script que mencionei anteriormente. Se o GPT-5.6 for enviado na próxima semana ou em três meses, quero saber dentro de sete dias se minhas cargas de trabalho melhoram, regridem ou se mantêm estáveis. Compartilhei o padrão básico em meu guia de otimização de custos do agente AI e o estendi para incluir deltas de capacidade, não apenas custo.

3. Estou construindo infraestrutura que pode ser direcionada para modelos de base fora dos EUA. Não porque eu espere mudar a situação amanhã. Porque a capacidade de rotear Deepseek V4 ou Kimi K2.6 para cargas de trabalho específicas – especialmente cargas de trabalho de peso aberto que posso auto-hospedar – é a única proteção real contra preços ou alterações de política de qualquer laboratório único. Se Deepseek e Moonshot se consolidarem operacionalmente, mesmo sem uma fusão formal, o lado de código aberto da pilha ficará mais capaz, e não menos.

4. Estou lendo os documentos de aquisição. A linguagem do contrato CDAO pode ser pesquisada publicamente. A página do acordo Anthropic DOD é publicada (fonte: Anthropic). Se você pretende desenvolver comercialmente esses modelos, saber o que os laboratórios realmente se comprometeram a entregar aos clientes governamentais faz parte da devida diligência agora. Leia-os.

**5. Estou levando o vazamento do GPT-5.6 a sério o suficiente para planejar, não o suficiente para prever. ** A cadência me diz que o OpenAI lançará algo entre agora e meados do verão. O vazamento não me diz o quê. Construir planos em torno de uma captura de tela é como você perde duas semanas. Construir planos em torno de uma cadência acelerada é como você se mantém à frente do próximo ciclo do navio.

O padrão ao qual volto sempre: a capacidade está a aumentar, o capital está a consolidar-se e os trilhos políticos estão a inclinar-se para aquisições de nível de defesa em todos os principais laboratórios dos EUA. O trabalho de qualquer pessoa que construa produtos reais nesta pilha em 2026 não é prever o próximo lançamento do modelo. É construir um fluxo de trabalho que absorva tudo o que é enviado, de quem o envia, com o conhecimento claro de onde os trilhos estão agora.

Estarei de volta quando GPT-5.6 realmente cair - ou como eles o chamam. Até então: fixe suas versões, execute suas avaliações e leia os contratos.

Perguntas frequentes

O GPT-5.6 será realmente lançado em breve?

Provavelmente não como um lançamento público em maio de 2026, com base nas evidências disponíveis. A entrada de log Codex que faz referência a GPT-5.6 é provavelmente tráfego canário ou de avaliação, não um modelo de produção. OpenAI não confirmou a existência do modelo. A cadência sugere que algo está por vir dentro de meses – mas a entrada de log vazada por si só não é um sinal de liberação.

Deepseek e Moonshot realmente se fundiram?

Nenhuma fusão formal foi confirmada no final de abril de 2026. O que foi verificado é uma colaboração técnica profunda – Deepseek V4 adotou o otimizador Muon do Moonshot e Kimi K2 integrou anteriormente a arquitetura MLA do Deepseek. Moonshot está em negociações reais de IPO em Hong Kong, de acordo com a Bloomberg, mas os dois laboratórios permanecem legalmente independentes.

O que o acordo Google con el Pentágono permite especificamente?

O acordo permite que o Pentagon use o Gemini AI para “qualquer propósito governamental legal”, o que inclui explicitamente o planejamento da missão e o apoio ao direcionamento de armas. As restrições abrangem a vigilância doméstica em massa e armas totalmente autónomas sem supervisão humana. O acordo se estende às redes classificadas a partir de abril de 2026.

Por que o Deepseek V4 foi enviado sem capacidade multimodal?

De acordo com os relatórios de fonte primária do ChinaTalk, o treinamento em geração multimodal foi despriorizado devido a restrições de computação e de capital. V4 continua sendo um modelo de linguagem. O multimodal Deepseek está no roteiro, mas não fazia parte do lançamento de 23 de abril.

Qual a diferença entre o acordo 2026 Google Pentagon e o Project Maven em 2018?

Em 2018, os Princípios Google de AI excluíram explicitamente armas e vigilância, e o contrato Maven foi autorizado a expirar depois que 4.000 funcionários protestaram. Em fevereiro de 2025, Google removeu essa linguagem de exclusão de seus princípios. O acordo de 2026 está alinhado com as políticas do lado de Google antes do protesto dos engenheiros acontecer – uma situação estruturalmente diferente de 2018.

Vamos trabalhar juntos

Procurando construir sistemas AI, automatizar fluxos de trabalho ou dimensionar sua infraestrutura tecnológica? Eu adoraria ajudar.

Coffee cup

Gostou deste artigo?

Seu apoio me ajuda a criar mais conteúdo técnico aprofundado, ferramentas open-source e recursos gratuitos para a comunidade de desenvolvedores.

Tópicos Relacionados

Engr Mejba Ahmed

Engr Mejba Ahmed

Engr. Mejba Ahmed builds AI-powered applications and secure cloud systems for businesses worldwide. With 8+ years shipping production software in Laravel, Python, and AWS, he's helped companies automate workflows, reduce infrastructure costs, and scale without security headaches. He writes about practical AI integration, cloud architecture, and developer productivity.

Artigos Relacionados

Ver Todos

Comments

Leave a Comment

Comments are moderated before appearing.

Learning Resources

Expand Your Knowledge

Accelerate your growth with structured courses, verified certificates, interactive flashcards, and production-ready AI agent skills.

Sample Certificate of Completion

Sample certificate — complete any course to earn yours

Engr Mejba Ahmed

Engr Mejba Ahmed

AI assistant · trained on my work

👋

Hey there!

Quick Actions

WhatsApp Direct line to me

Chat on WhatsApp

+880 1723 741224 · Replies within the hour on working days

Popular Questions

Engr Mejba Ahmed is connected
Engr Mejba Ahmed is typing...
Engr Mejba Ahmed avatar

✉ Want me to follow up? Drop your email

Engr Mejba Ahmed avatar

📞 Connect Directly

Choose how you'd like to reach me

WhatsApp

+880 1723 741224

Email

mejba.13@gmail.com

✓ Details sent! I'll get back to you shortly.

Powered by OpenAI

335+

Blog Posts

25

AI Courses

63

Projects

Services & Expertise

Pricing & Process

Learning & Resources

Connect & Support