Nvidia investe no Safe Superintelligence de Ilya Sutskever, substituindo TPUs do Google por GPUs
Parceria de longo prazo dá ao SSI acesso ao ecossistema Nvidia, amplia poder de computação e sinaliza mudança estratégica em relação aos TPUs do Google nas apostas por superinteligência segura.
Danilo Gato
Autor
Introdução
Nvidia investe no Safe Superintelligence de Ilya Sutskever, e a mensagem para o mercado de IA é clara, computação de ponta continua alinhada ao ecossistema de GPUs da empresa líder do setor. O acordo, confirmado publicamente em 27 de julho de 2026, envolve investimento substancial e uma parceria de longo prazo que dá ao SSI acesso às novas plataformas de computação da Nvidia, com promessa de expandir a capacidade por uma ordem de magnitude, segundo comunicações oficiais. (nvidianews.nvidia.com)
A importância do movimento vai além do cheque. Safe Superintelligence, que apostava em TPUs do Google desde 2025, muda a direção e se aproxima do hardware Rubin da Nvidia, num contexto em que a disputa por aceleração de IA em larga escala ficou mais acirrada. Reportagens e comunicados apontam para uma reacomodação estratégica, substituindo gradualmente a dependência de TPUs por GPUs Nvidia para treinos de modelos de fronteira. (techcrunch.com)
Este artigo destrincha o que se sabe sobre o acordo, por que a mudança do SSI importa, e como essa decisão se encaixa na guerra de aceleradores, com dados recentes sobre TPUs do Google e a geração Rubin da Nvidia. Também inclui exemplos práticos de implicações para startups e laboratórios, de custos a portabilidade entre nuvens.
O que foi anunciado, quando e por quem
A confirmação pública mais concreta veio da própria Nvidia, em 27 de julho de 2026, detalhando uma parceria de longo prazo com o Safe Superintelligence Inc., liderado por Ilya Sutskever. O comunicado cita acesso ampliado a computação, com menção explícita à possibilidade de escalar pesquisa em “um grande computador Nvidia”. Embora termos financeiros completos não tenham sido divulgados no press release, a linguagem de “parceria estratégica” e “acesso de longo prazo” foi destacada. (nvidianews.nvidia.com)
Na mesma janela temporal, o Wall Street Journal noticiou que a Nvidia fez um investimento “substancial” após ter acesso a uma amostra do trabalho de pesquisa do SSI, destacando o potencial de a parceria fortalecer o pipeline de clientes de alto perfil da fabricante de chips durante o boom de IA. O WSJ reforça a leitura de posicionamento competitivo da Nvidia frente a rivais em computação de IA. (wsj.com)
Agências e veículos secundários, citando fontes, adicionaram números, com Reuters reportando que o montante seria de aproximadamente 5 bilhões de dólares. Esse valor tem sido repetido em agregadores e sites financeiros que repercutiram a exclusiva. Ainda assim, vale a ressalva, a Nvidia não detalhou a composição entre capital e créditos de computação, e diferentes relatos tratam o número como estimativa baseada em fontes. (m.investing.com)
Do TPU ao Rubin, por que a mudança do SSI é estratégica
Em abril de 2025, o SSI foi anunciado como cliente de Google Cloud para usar TPUs na pesquisa de IA, uma alternativa que vinha crescendo entre laboratórios que buscavam fugir da disputa por GPUs. Relatos técnicos recentes também lembram que o Google segue avançando nas gerações de TPU e em supercomputadores de treinamento, com ênfase em eficiência e estabilidade. (techcrunch.com)
A virada agora é significativa porque o acordo com a Nvidia dá ao SSI acesso ao ecossistema Rubin, sucessor do Blackwell, e à infraestrutura de fábrica de IA que a Nvidia promove como base padrão de treinos de modelos de fronteira em múltiplas nuvens. A leitura do mercado, refletida por sites especializados, é que o SSI, que antes se apoiava em TPUs do Google, passa a priorizar GPUs Nvidia para a próxima fase de escala. (siliconangle.com)
Há motivações técnicas e operacionais claras para essa troca. GPUs Nvidia são fungíveis, rodam em praticamente todos os grandes provedores de nuvem e contam com um ecossistema maduro de software, bibliotecas e ferramentas, o que reduz riscos de bloqueio e acelera migrações. Além disso, análises recentes indicam ganhos por chip e por plataforma nas gerações mais novas de GPUs, embora comparações diretas dependam de workloads e pilhas específicas. (theinformation.com)
O que muda em custos, portabilidade e velocidade de P&D
A principal variável de P&D em modelos de fronteira é a eficiência com que uma equipe transforma orçamento em tokens treinados, experimentos e iterações confiáveis. Três efeitos aparecem quando uma equipe migra de TPUs para GPUs Nvidia em 2026:
- Portabilidade entre nuvens. O mesmo stack CUDA, cuDNN, NCCL, PyTorch e frameworks MLOps roda praticamente igual em AWS, Google Cloud, Azure e em provedores independentes. Isso simplifica compras e permite leilão de preços em tempo quase real, algo difícil com TPUs. (theinformation.com)
- Elasticidade de capacidade. Provedores e integradores multiplicaram ofertas de clusters Rubin e Rubin Ultra, e a própria Nvidia reporta adoções em escala de sua arquitetura de fábrica de IA, com OEMs e parceiros anunciados em eventos recentes. Essa densidade de oferta ajuda a fechar janelas de suprimento. (nvidianews.nvidia.com)
- Ferramentas e pessoas. O pool de talentos, desde pesquisadores a engenheiros de desempenho e bibliotecários de modelos, está majoritariamente otimizado para GPU. A curva de aprendizagem para atingir o estado da arte em rendimento por dólar tende a ser menor.
Em custos absolutos, cada comparação séria exige medir jobs com o mesmo código, mesma precisão e target de qualidade de convergência, mas existe um vetor estratégico, GPUs competem entre si em um mercado mais aberto, o que permite ao comprador sofisticado arbitrar disponibilidade e preço. Artigos recentes também documentam a ofensiva do Google para atrair usuários de GPU para TPUs com alegações de eficiência e estabilidade de plataforma, o que confirma que há competição real nos dois lados. (theinformation.com)
Números, datas e contexto de financiamento do SSI
Safe Superintelligence ganhou atenção desde 2024, com rodadas publicamente reportadas em 2024 e 2025, chegando a avaliações bilionárias mesmo com baixo perfil de divulgação técnica. TechCrunch e outros veículos acompanharam anúncios sobre captações de 1 bilhão de dólares e depois de 2 bilhões de dólares, com avaliações que chegaram à casa de 32 bilhões, segundo reportagens baseadas em fontes e documentos de mercado. (techcrunch.com)
Em 27 de julho de 2026, a parceria com a Nvidia adicionou a peça que faltava, escala de computação ancorada por um fornecedor dominante. Relatos paralelos sugerem que o aporte seria da ordem de 5 bilhões de dólares, mas, novamente, o comunicado oficial da Nvidia não detalha o valor, o que reforça a necessidade de tratar a cifra como indicada por fontes. A leitura unânime, porém, é que o acordo dá ao SSI acesso a clusters Rubin e a ganhos imediatos de capacidade. (m.investing.com)
Esse arranjo de equity mais acesso à fábrica de computação se tornou típico da Nvidia em 2026, com dezenas de participações minoritárias e acordos para garantir que pesquisas de fronteira rodem em seu ecossistema. Observadores de mercado destacam que essa tática aumenta o moat, ao mesmo tempo em que dificulta para alternativas proprietárias ganharem massa crítica. (techfundingnews.com)
E os TPUs do Google, qual é a fotografia de 2026

Do lado do Google, a narrativa não é de retração. Pelo contrário, a empresa publicou recentemente uma síntese técnica sobre cinco gerações de supercomputadores de treinamento baseados em TPU, ressaltando estabilidade arquitetural, eficiência energética e resiliência operacional. Na linha do tempo, os sistemas evoluíram de TPU v2 e v3 para designs mais recentes, inclusive com interconexões ópticas e melhorias no perfil de carbono por operação. (arxiv.org)
Analistas seguem esperando volumes crescentes de aceleradores de IA do Google nos próximos ciclos, com estimativas de hardware multi-chiplet e ganhos de desempenho projetados para a próxima geração. O contraste com Rubin e Rubin Ultra da Nvidia, ainda que inevitável, depende de workloads e do ecossistema de software, o que torna difícil uma conclusão universal sobre custo por token sem benchmarks lado a lado. (tomshardware.com)
Em paralelo, reportagens destacam que Google tem buscado converter heavy users de GPU para TPUs com argumentos de eficiência, confiabilidade e estabilidade da plataforma. Casos como Anthropic, além de parcerias assinadas com startups e empresas, compõem a base relevante de clientes. O próprio SSI figurou como cliente de TPU em 2025, antes do acordo atual com a Nvidia. (theinformation.com)
O que o Rubin da Nvidia traz para um laboratório como o SSI
A transição para Rubin combina três camadas, hardware, rede e software.
- Hardware. A geração Rubin eleva throughput por servidor e por rack, otimiza interconexão NVLink e aposta em designs orientados a fábricas de IA com densidade energética e de memória. O objetivo é reduzir gargalos de comunicação e de movimentação de dados em treinos distribuídos de larga escala. Embora a Nvidia não detalhe todas as especificações no release do acordo, o roadmap público reforça essa direção. (nvidianews.nvidia.com)
- Rede. O stack de rede de alto desempenho se integra a bibliotecas como NCCL para all-reduce eficiente, sob drivers amadurecidos por anos de uso em produção em hyperscalers, algo que acelera job scheduling e balanceamento de carga entre milhares de GPUs. (nvidia.com)
- Software. O ecossistema de SDKs, compiladores, pacotes de otimização e integrações com frameworks mainstream reduz tempo de setup e refatorações, elemento crítico quando a equipe quer validar rapidamente hipóteses de pesquisa de frontier models. (theinformation.com)
Para um laboratório focado em superinteligência segura, a combinação de escalabilidade previsível e tooling maduro é valiosa, principalmente quando o objetivo é executar corridas longas com janelas de tempo e custo bem controladas, minimizando risco de timeouts, quedas e retrabalhos.
Como essa virada afeta o ecossistema de IA, da pesquisa ao produto
- Startups e labs. Equipes em fase de pesquisa aplicada ganham uma bitola para comprar computação de forma mais ágil, usando GPUs Nvidia em múltiplas nuvens e em colocation. Isso favorece portabilidade de cargas e negociação de preço. A migração do SSI tende a ser citada como precedente por outras empresas de fronteira que ponderam entre TPUs e GPUs.
- Provedores de nuvem. AWS, Google Cloud e Azure competem por clusters Rubin, e a presença do mesmo hardware em várias plataformas permite packs híbridos e estratégias spot mais sofisticadas. Para o Google, a resposta é reforçar diferenciais de TPU, inclusive com ofertas gerenciadas, preços agressivos e claims de eficiência, como mostram reportagens recentes sobre a disputa por workloads. (theinformation.com)
- Ferramentas e bibliotecas. A atração por GPUs mantém o investimento da comunidade em kernels, compiladores e heurísticas de paralelização que beneficiam todo o ecossistema, do PyTorch a toolchains de compressão e inferência.
- Governança e segurança. O posicionamento do SSI enfatiza “superinteligência segura”, o que implica overheads adicionais de avaliação, red teaming e alignment. Ecossistemas com tooling amplo ajudam a plugar esses processos à linha de produção de modelos, algo que GPUs consolidadas facilitam.
Reflexões e insights, o que observar nos próximos trimestres
- Sinal de produto. O mercado ainda não viu paper técnico ou release de modelo do SSI no mesmo ritmo de outros laboratórios. O anúncio com a Nvidia sugere que há resultados internos que justificam escalar. O primeiro preprint, benchmark competitivo ou sinal de produto que vazar será o gatilho para reprecificar expectativas. A leitura do WSJ, de que a Nvidia viu pesquisa promissora antes de investir, reforça essa hipótese. (wsj.com)
- Capacidade e fila de chips. Mesmo com parcerias, a disponibilidade prática de clusters Rubin em escala depende de cronogramas de fabricação e de integração de sistemas. A cada nova janela, laboratórios brigam por lotes. A portabilidade ajuda, mas a fila física de hardware continua sendo o gargalo.
- Guerra de aceleradores. O Google não ficará parado. A evolução de TPUs, com designs multi-chiplet e interconexões mais eficientes, tende a apertar a disputa por custo por token em 2027 e 2028. Benchmarks públicos em workloads comparáveis serão cruciais para separar narrativa de resultado replicável. (tomshardware.com)
- Estrutura dos cheques. Muitos relatos sobre “bilhões” misturam equity com valor econômico de créditos e de acesso a clusters. O que importa para P&D é a parcela que vira tokens treinados e experimentos rodando com estabilidade. Ler os termos finos de cada parceria continua sendo essencial. (m.investing.com)
Aplicações práticas para times de IA que decidem entre TPU e GPU
- Planejamento de sprints. Em GPUs, aproveite o ecossistema para criar templates de job reproducíveis com PyTorch, FSDP e pipelines de checkpoint robustos. Essa base reduz custo de portabilidade entre nuvens. (theinformation.com)
- Cálculo de custo por token. Rode pilotos A-B em amostras reduzidas, mantendo hiperparâmetros e target de loss equivalentes, antes de assumir que uma plataforma é mais barata. TPUs do Google publicam ganhos de eficiência em trabalhos recentes, então decisões devem ser empíricas, não dogmáticas. (arxiv.org)
- Risco de bloqueio. Ao escolher TPUs, mitigue risco desenvolvendo camadas de abstração que facilitem fallback para GPUs. Ao escolher GPUs, mantenha agnosticismo entre nuvens para capturar arbitragem de preço e disponibilidade.
- Governança. Se a ambição é frontier, trate alignment, avaliações de segurança e contenção de riscos como parte da engenharia, não como etapa separada, o que exige orquestração de ferramentas e pessoas dentro do pipeline principal de treino.
Conclusão
A decisão do SSI de se alinhar à Nvidia neste momento altera o equilíbrio da disputa entre aceleradores e confirma a força das GPUs como padrão de fato para treinar modelos de fronteira em 2026. Nvidia investe no Safe Superintelligence e injeta, além de capital, uma ponte direta com sua fábrica de IA, enquanto o Google sustenta uma trajetória robusta de TPUs, que continuam relevantes e tecnicamente competitivos em eficiência e estabilidade, segundo publicações recentes. A melhor escolha continua dependendo do workload, do estágio de P&D e da elasticidade necessária. (nvidianews.nvidia.com)
Para quem lidera times de IA, o recado é pragmático, construir vantagem em 2026 significa dominar mais de um ecossistema, manter portabilidade e medir custo por token com rigor. O exemplo do SSI, que começou com TPUs e agora prioriza GPUs Nvidia, mostra que estratégia de compute é dinâmica, ditada por resultados internos e por acesso efetivo a clusters. O próximo trimestre deve trazer sinais mais objetivos, seja em preprints, seja em produtividade de pesquisa, e isso vai dizer mais do que qualquer rótulo de tecnologia. (techcrunch.com)
Leia também
Google lança Lyria 3.5 no Flow Music, melhor voz, letras e controle
Lyria 3.5 foi lançado em 29 de julho de 2026 e já está disponível no Google Flow Music, com melhorias evidentes em musicalidade, letras, vocais e controle criativo. O modelo amplia a precisão de prompts, melhora a pronúncia e a emoção nos cantos e permite ajustar tempo e duração. Com SynthID, todo áudio sai com marca d’água inaudível para dar transparência.
9 min de leituraInteligência ArtificialIdeogram lança Object Remover e afirma topo no RemovalBench
O Ideogram Object Remover estreia com a promessa de liderar o benchmark RemovalBench, sinalizando avanços concretos na edição de imagens com IA. Além do foco na remoção fiel e na preservação de contexto, a Ideogram conecta o recurso ao seu stack 4.0, que já inclui Background Remover com API e ferramentas de inpainting. Entenda o valor prático, como medir qualidade e quando usar essa abordagem no seu fluxo.
9 min de leituraInteligência ArtificialOpenAI dá acesso grátis do ChatGPT a 100 mil pesquisadores
OpenAI lança um programa que concede acesso gratuito aos modelos mais avançados do ChatGPT para pesquisadores acadêmicos. O plano começa com 10 mil vagas no verão de 2026, meta de 100 mil até 2027, suporte a privacidade empresarial e treinamentos. Entenda como funciona, o que inclui, requisitos e impactos para a pesquisa.
10 min de leituraInteligência ArtificialOpenAI corta 80% no GPT-5.6 Luna, plano full stack da IA
OpenAI reduziu em 80% o preço do GPT-5.6 Luna e sinalizou uma estratégia full stack para tornar a inteligência mais abundante e acessível. Entenda o impacto desse corte, como ele muda a matemática de custos, o que a empresa chama de valor por token e como a visão de abundância conecta modelos, infraestrutura, parcerias e adoção corporativa.
9 min de leitura