Básico
Spot
Negocie criptomoedas livremente
Trincheiras
0 gas
Acesso inteligente a novos tokens on-chain
Margem
Amplie seu lucro com alavancagem
Convert & Auto-Invest
0 Fees
Trade any size with no fees and no slippage
ETF
Exposição para posições alavancadas de forma simples
Negociação pré-mercado
Negocie novos tokens pré-listagem
Avançado
Futuros
Acesse centenas de contratos perpétuos
CFD
Ouro
Plataforma única para ativos tradicionais globais
Contratos de Eventos
New
Preveja movimentos e aproveite oportunidades
Opções
Hot
Negocie opções vanilla no estilo europeu
Conta unificada
Maximize sua eficiência de capital
Negociação demo
Introdução à negociação de futuros
Prepare-se para sua negociação de futuros
Eventos de futuros
Participe de eventos e ganhe recompensas
Negociação demo
Use fundos virtuais para experimentar negociações sem riscos
CFD
Derivativos de CFD sobre ações
Ações dos EUA
0 Fee
Acesse ações e ETFs reais dos EUA
Ações de Hong Kong
Negocie ações de qualidade listadas em Hong Kong
Ações da Coreia
SK Hynix
Negocie ações da Coreia reais e invista em ativos populares
Ações japonesas
Principais ações japonesas, tudo em um só lugar
Futuros de ações
Alta alavancagem, negociação 24/7
Atividades de ações
Negocie ações populares e desbloqueie airdrops generosos
Ações tokenizadas
Respaldado por ativos de ações reais
IPO Access
Desbloqueie o acesso completo a IPO de ações globais
Lançamento
CandyDrop
Colete candies para ganhar airdrops
Launchpool
Staking rápido, ganhe novos tokens em potencial
HODLer Airdrop
Possua GT em hold e ganhe airdrops massivos de graça
Pre-IPOs
Desbloqueie o acesso completo a IPO de ações globais
Pontos Alpha
Negocie on-chain e receba airdrops
Pontos de futuros
Ganhe pontos de futuros e colete recompensas em airdrop
Investimento
Renda ociosa
3%
Negocie e ganhe ao mesmo tempo
Simple Earn
Ganhe juros com tokens ociosos
Apostar
Faça staking de criptomoedas para ganhar em produtos PoS
Autoinvestimento
Invista automaticamente regularmente
Investimento duplo
Lucre com a volatilidade do mercado
Soft Staking
Ganhe recompensas com stakings flexíveis
Centro de riqueza VIP
4%
4% APR em USDT por tempo limitado
Fundo Quantitativo
Estratégias quant de alto nível
GUSD
3.6%
Retornos confiáveis de RWAs do Tesouro
USD1 7% a.a.
Sem bloqueio, negocie e saque
Empréstimo de criptomoedas
0 Fees
Penhore uma criptomoeda para pegar outra emprestado
Centro de empréstimos
Centro de empréstimos integrado
Praça
Descubra o valor em criptografia
Live
Análise de mercado de criptomoedas ao vivo
Bate-papo
Converse com os traders de criptomoedas
Notícias
Novidades sobre criptomoedas
Gate Learn
Guias e recursos educacionais sobre cripto
Gate Blog
Insights sobre cripto e atualizações do setor
Gate Research
Pesquisa aprofundada e análise de mercado
Promoções
Centro de atividade
Participe de atividades e ganhe recompensas
Indicação
200 USDT
Convide amigos para recompensas de ind.
Programa de afiliados
Ganhe recomp. de comissão exclusivas
Gate Booster
Aumente a influência e ganhe airdrops
Anúncio
Atualizações na plataforma em tempo real
Serviços VIP
Grandes Descontos nas Taxas
Gerenciamento de ativos
Solução completa de gerenciamento de ativos
Institucional
Soluções de ativos digitais para empresas
Desenvolvedores (API)
Conecta-se ao ecossistema de aplicativos da Gate
Programa de corretoras
Mecanismos de grandes descontos via API
Negociação no TradingView
Eleve sua experiência de negociação
AI
Gate AI
Seu parceiro de IA conversacional para todas as horas
Gate AI Bot
Use o Gate AI diretamente no seu aplicativo social
GateClaw
Gate Blue Lobster, pronto para usar
Gate for AI Agent
Infraestrutura de IA, Gate MCP, Skills e CLI
Gate Skills Hub
10K+ habilidades
Do escritório à negociação: um hub completo de habilidades para turbinar o uso da IA
#HBMShortageBoostsAIChipPrices
Escassez de HBM e o aumento do custo dos chips de IA: por que o verdadeiro gargalo é a memória
Quando as pessoas falam sobre o custo da IA, a conversa geralmente começa pela GPU. Esse é o ponto errado para começar. Em 2026, o componente mais caro e menos elástico dentro de um acelerador de IA não é o die lógico no centro do encapsulamento — é a memória empilhada sobre ele. A High Bandwidth Memory, ou HBM, deixou de ser uma nota técnica para se tornar a maior restrição de toda a cadeia de suprimentos de hardware de IA, e os números por trás dessa mudança são realmente extraordinários.
A HBM consiste em dies de DRAM empilhados verticalmente e conectados por vias através do silício, razão pela qual consegue mover dados a velocidades que a memória convencional não alcança. A plataforma Rubin de próxima geração da Nvidia comporta até 288GB de HBM4, com largura de banda acima de 22 terabytes por segundo, e a MI450 da AMD vai além, chegando a 432GB. Nada mais no mundo da memória se aproxima dessa combinação de capacidade e largura de banda, e nada mais pode substituí-la. Se um acelerador não tem HBM, ele não é enviado.
O problema é que a HBM não pode simplesmente ser encomendada quando a demanda aumenta. Produzi-la consome aproximadamente três vezes a área de wafer da DRAM convencional para a mesma quantidade de dados armazenados, e os custos dos wafers de HBM4 ficam em torno de US$ 7 a 8 mil, três a quatro vezes os da DRAM padrão. Cada geração também carrega um prêmio sobre a anterior que a TrendForce estima em mais de 30%, porque as etapas de empilhamento e encapsulamento avançado são um verdadeiro gargalo de fabricação. Apenas três empresas importam nesse mercado e, juntas, controlam aproximadamente 64% da receita global de DRAM. Uma delas já havia vendido toda a sua capacidade de 2026 antes mesmo do início do ano.
É aí que a mecânica da escassez fica clara. Segundo a TrendForce, a HBM representava 23% da produção total de wafers de DRAM em abril de 2026, ante 19% em 2025. Cada wafer direcionado à HBM é um wafer que deixa de produzir DDR5 para laptops, celulares e servidores. A escassez de memória comum, portanto, não é um acidente de demanda; é uma realocação deliberada da capacidade escassa para o produto mais lucrativo que a indústria já fabricou. Quando você direciona as melhores linhas, os melhores engenheiros e os equipamentos mais novos para um produto, todo o resto fica mais apertado por definição.
Os dados de preços são o ponto em que isso deixa de ser abstrato. No primeiro trimestre de 2026, a TrendForce revisou os preços contratuais da DRAM convencional de um aumento já agressivo de 55% a 60% na comparação trimestral para 90% a 95%, e algumas previsões para DRAM de PC chegaram a 105% a 110% em um único trimestre, o que efetivamente significa que os preços dobraram em três meses. A DRAM para servidores e dispositivos móveis foi projetada em 88% a 93%, a memória flash NAND em 55% a 60% e os SSDs corporativos em 53% a 58%. O segundo trimestre trouxe outro aumento de 58% a 63% na comparação trimestral dos preços contratuais da DRAM convencional, e o terceiro trimestre está atualmente projetado para mais 13% a 18%. Alguns analistas esperam outros 30% a 40% no quarto trimestre, o que levaria o aumento anual para algo próximo de 90% a 100% ou mais. A Gartner projetou alta de 47% nos preços da DRAM em todo o ano de 2026 e aumento total de cerca de 130% nos custos de memória e armazenamento até o fim do ano, sem alívio real antes do fim de 2027.
A própria HBM é ainda mais extrema. Os preços de fornecimento da HBM3E foram elevados em quase 20% antes mesmo do início de 2026. Os preços à vista agora se descolaram dos preços contratuais de uma forma quase inédita nesta indústria: um módulo HBM3E de 36GB, que normalmente é negociado em contratos de longo prazo na faixa de US$ 300 a 400, foi cotado perto de US$ 2.100 no mercado à vista, um prêmio de quatro a cinco vezes. As negociações dos contratos de HBM4 para 2027, iniciadas no segundo trimestre de 2026, devem, segundo a TrendForce, produzir aumentos medidos em múltiplos, e não em percentuais, enquanto a DigiTimes informou que os preços da HBM podem mais que dobrar em relação aos níveis atuais até 2027.
O balanço entre oferta e demanda confirma o quão apertado isso realmente está. As lacunas projetadas entre oferta e demanda para 2026 estão em 4,9% para DRAM, 4,2% para NAND e 5,1% para HBM, as maiores desde 2011. Mesmo sob a suposição de que 70% da nova capacidade seja redirecionada para HBM, o déficit de HBM ainda poderia ficar entre 50% e 60%. Os estoques contam a mesma história por outro ângulo. A Samsung e a SK hynix, que juntas controlam aproximadamente 64% da receita global de DRAM, viram seus estoques de memória acabada caírem para menos de 10 dias de oferta no início de setembro de 2026. Dez dias. Em um ciclo normal, uma reserva medida em semanas de dois dígitos é considerada saudável.
Esse custo agora está chegando aos preços dos sistemas, não apenas dos componentes. A Nvidia elevou os preços dos servidores de IA em mais de 15%, citando explicitamente a pressão sobre a memória, e a Intel também aumentou os preços das CPUs em mais de 15%. Os prazos de entrega da HBM4 e da DRAM avançada passaram de oito a dez semanas para vinte a trinta semanas, com pedidos apenas mediante alocação se tornando normais. Os preços de aluguel na nuvem refletem a mesma pressão, com uma Nvidia B300 sendo alugada por aproximadamente US$ 9,16 por hora sob demanda, que é o número que realmente importa para startups e pesquisadores que nunca compram hardware diretamente.
Os consumidores também estão pagando por isso, e esta é a parte que a maioria das pessoas percebe primeiro. Um kit convencional de memória DDR5-6000 de 32GB, vendido por US$ 110 a 140 um ano atrás, estava sendo negociado por cerca de US$ 392 em agosto de 2026, e os índices apontam que os preços de memória para jogos subiram aproximadamente 89%, com aumentos muito mais acentuados em componentes específicos. O preço de tabela do módulo DDR5 de 32GB da Samsung subiu de US$ 149 para US$ 239, um salto de 60%. A IDC projeta alta de 10% a 20% nos preços de PCs, tablets e smartphones até o fim de 2026, a TrendForce estima aumento de quase 40% nos custos de fabricação de notebooks convencionais, as previsões de produção de smartphones foram reduzidas para uma queda de 7% e as remessas de laptops podem cair 10,1% na comparação anual. Os fabricantes de dispositivos estão reagindo ao congelar as especificações, com celulares topo de linha limitando a memória a 12GB simplesmente para manter os preços.
Minha própria leitura é que a escassez é estrutural, e não cíclica, e essa distinção importa enormemente. Os ciclos normais de memória se corrigem em quatro a oito trimestres porque a capacidade ociosa volta a operar e os preços caem. Este é diferente em três aspectos. Novas fábricas levam de dois a três anos para serem construídas e qualificadas, portanto a oferta não consegue responder dentro da janela em que a demanda está acelerando. A transição da HBM3E para a HBM4 consome ainda mais capacidade por bit, porque uma quantidade maior de camadas e um encapsulamento mais complexo reduzem a produção efetiva. E a estrutura de incentivos mantém ativamente a DRAM para consumidores apertada, já que as margens da HBM são muito maiores que as margens da DDR5 de commodities. Uma escassez criada pela escolha de alocação não se resolve da mesma forma que uma escassez criada por uma surpresa de demanda.
A segunda coisa que vale entender é que o gargalo mudou. O desempenho da IA está cada vez mais limitado pela memória, o que significa que uma GPU com muito poder computacional e largura de banda insuficiente simplesmente fica ociosa esperando pelos dados. Como a HBM é o fator limitante, o que realmente determina quantos aceleradores são fabricados em um determinado ano é a oferta de memória, não a oferta de transistores. É por isso que os preços dos chips de IA são, em grande medida, preços da memória disfarçados. Isso também explica por que empresas famosas por seu forte poder de precificação estão repassando os custos aos clientes: elas não podem criar capacidade que não existe.
Siga o dinheiro e o padrão fica fácil de ler. Os fabricantes de memória estão registrando margens recordes, os fornecedores de aceleradores estão repassando os custos ao longo da cadeia, os hiperescaladores absorvem parte do aumento e repassam o restante aos clientes da nuvem, e os consumidores encontram o restante em laptops, celulares e placas gráficas, já que a GDDR7 compete pelas mesmas linhas de encapsulamento avançado. As empresas que se beneficiam do outro lado disso são as que reduzem a própria intensidade de memória, por meio de melhor quantização, esparsidade, silício de inferência mais barato e eficiência de software. Cada ponto percentual de largura de banda economizado vale mais agora do que valia há dois anos.
Para quem acompanha isso como uma história de mercado, e não como uma história de tecnologia, alguns indicadores merecem atenção, e nenhum deles constitui recomendação de investimento. O avanço do rendimento da HBM4 é o que mais importa, com rendimentos supostamente subindo para perto de 80% antes do aumento de produção da Rubin da Nvidia. O nível de liquidação dos contratos de HBM para 2027 definirá o tom de toda a cadeia. Se o aumento projetado de 13% a 18% na DRAM do terceiro trimestre será o pico ou se o quarto trimestre voltará a acelerar dirá se isso está atingindo o topo. Os dias de estoque da Samsung e da SK hynix, atualmente abaixo de dez, são o sinal de alerta antecipado mais claro. O diferencial entre os preços à vista e contratuais é a medida mais honesta do estresse, porque um estreitamento desse diferencial seria o primeiro sinal genuíno de alívio. E os anúncios de gastos de capital em fábricas importam, porque a capacidade comprometida em 2026 e 2027 é o que redefine os preços em 2028.
Há um contraponto sério que merece espaço aqui, porque o argumento otimista em relação à escassez também contém a semente de sua própria reversão. A memória é a parte mais cíclica da cadeia de semicondutores, e cada dólar de margem hoje financia capacidade que chega amanhã. Se o crescimento dos gastos de capital em IA desacelerar mesmo que modestamente, uma grande quantidade de novos inícios de produção de wafers chegará ao mesmo tempo a um mercado que foi planejado durante um pânico. A visão da Gartner de que não haverá alívio real até o fim de 2027 e o alerta da SK hynix de que o aperto pode persistir além de 2030 estão em uma extremidade do espectro; o padrão histórico dos booms de memória, em que a correção é rápida e violenta, está na outra. Manter ambas as possibilidades em mente é a única posição intelectualmente honesta.
Portanto, esta é a frase que vale lembrar, reduzida aos seus elementos essenciais: a oferta de HBM é limitada, a demanda por chips de IA continua subindo, e essa combinação está elevando tanto os custos de produção quanto os preços de mercado em toda a cadeia de hardware de IA. A conclusão mais profunda é que a expansão da IA agora é limitada menos por ideias, e menos ainda pelo design de chips, do que por um componente do qual a maioria das pessoas nunca tinha ouvido falar três anos atrás. Enquanto a demanda por computação de IA crescer mais rápido do que a quantidade de wafers de memória que pode ser fisicamente adicionada, essa escassez continuará aparecendo no preço de tudo o que está a jusante, dos aceleradores de data centers aos laptops nas prateleiras das lojas. O muro da memória não é mais uma metáfora. É um item de custo.