Futuros
Acesse centenas de contratos perpétuos
CFD
Ouro
Plataforma única para ativos tradicionais globais
Opções
Hot
Negocie opções vanilla no estilo europeu
Conta unificada
Maximize sua eficiência de capital
Negociação demo
Introdução à negociação de futuros
Prepare-se para sua negociação de futuros
Eventos de futuros
Participe de eventos e ganhe recompensas
Negociação demo
Use fundos virtuais para experimentar negociações sem riscos
CFD
Derivativos de CFD sobre ações
Ações dos EUA
Acesse ações e ETFs reais dos EUA
Ações de Hong Kong
Negocie ações de qualidade listadas em Hong Kong
Ações da Coreia
SK Hynix
Negocie ações da Coreia reais e invista em ativos populares
Futuros de ações
Alta alavancagem, negociação 24/7
Ações tokenizadas
Respaldado por ativos de ações reais
IPO Access
Desbloqueie o acesso completo a IPO de ações globais
GUSD
3.8%
Cunhe GUSD para rendimentos de RWA do Tesouro
Atividades de ações
Negocie ações populares e desbloqueie airdrops generosos
Lançamento
CandyDrop
Colete candies para ganhar airdrops
Launchpool
Staking rápido, ganhe novos tokens em potencial
HODLer Airdrop
Possua GT em hold e ganhe airdrops massivos de graça
Pre-IPOs
Desbloqueie o acesso completo a IPO de ações globais
Pontos Alpha
Negocie on-chain e receba airdrops
Pontos de futuros
Ganhe pontos de futuros e colete recompensas em airdrop
Investimento
Simple Earn
Ganhe juros com tokens ociosos
Autoinvestimento
Invista automaticamente regularmente
Investimento duplo
Lucre com a volatilidade do mercado
Soft Staking
Ganhe recompensas com stakings flexíveis
Empréstimo de criptomoedas
0 Fees
Penhore uma criptomoeda para pegar outra emprestado
Centro de empréstimos
Centro de empréstimos integrado
Centro de riqueza VIP
Planos premium de crescimento de patrimônio
Gate Wealth
Assuma o controle do seu futuro financeiro
Fundo Quantitativo
Estratégias quant de alto nível
Apostar
Faça staking de criptomoedas para ganhar em produtos PoS
Alavancagem Inteligente
Alavancagem sem liquidação
GUSD
3.8%
Deposite e resgate a qualquer momento, sem taxas
Promoções
Centro de atividade
Participe de atividades e ganhe recompensas
Indicação
200 USDT
Convide amigos para recompensas de ind.
Programa de afiliados
Ganhe recomp. de comissão exclusivas
Gate Booster
Aumente a influência e ganhe airdrops
Anúncio
Atualizações na plataforma em tempo real
Blog da Gate
Artigos do setor de criptomoedas
Serviços VIP
Grandes Descontos nas Taxas
Gerenciamento de ativos
Solução completa de gerenciamento de ativos
Institucional
Soluções de ativos digitais para empresas
Desenvolvedores (API)
Conecta-se ao ecossistema de aplicativos da Gate
Transferência Bancária OTC
Deposite e retire moedas fiat
Programa de corretoras
Mecanismos de grandes descontos via API
AI
Gate AI
Seu parceiro de IA conversacional para todas as horas
Gate AI Bot
Use o Gate AI diretamente no seu aplicativo social
GateClaw
Gate Blue Lobster, pronto para usar
Gate for AI Agent
Infraestrutura de IA, Gate MCP, Skills e CLI
Gate Skills Hub
10K+ habilidades
Do escritório à negociação: um hub completo de habilidades para turbinar o uso da IA
Requisitos de hardware para rodar o Kimi K3 localmente? Começa com 64 GPUs, consome 45 kW de energia e os jogadores precisam montar sua própria solução, ou seja, fica fora de alcance
月之暗面本週 publicou o Kimi K3, com 2,8 trilhões de parâmetros totais, tornando-se o maior modelo de pesos abertos da história. Os pesos completos devem ser disponibilizados até 27 de julho. As orientações oficiais de implantação indicam que, para montar por conta própria, é necessário pelo menos 64 aceleradores; já para jogadores individuais, existem basicamente duas rotas: usar a família K2 ou chamar a API oficial.
(Recap: a Moonshot AI (Moonshot AI) vai lançar o Kimi K3! Com 2,8 trilhões de parâmetros e um contexto de texto de milhões de tokens, o desempenho fica muito perto do Anthropic Opus 4.8)
(Complemento de contexto: meu computador consegue rodar modelos de IA localmente? O CanIRun.ai ajuda você a analisar rapidamente)
Sumário
Toggle
Mais cedo nesta semana, a Moonshot AI publicou o Kimi K3, com 2,8 trilhões de parâmetros, que se tornou o maior modelo aberto de pesos da história. Só para armazenar esses 2,8 trilhões de parâmetros em disco, usando o formato nativo de 4 bits oficial (MXFP4), são necessários de 1,4 TB a 1,5 TB de espaço — e isso ainda nem começou a rodar inferência. Para a maioria das pessoas, o nível de exigência é extremamente, extremamente alto.
A Moonshot AI afirma que os pesos completos e abertos devem ser publicados até 27 de julho, com licença Modified-MIT, permitindo configurações por conta própria. No momento em que este texto foi fechado, os pesos completos e também versões quantizadas da comunidade (como GGUF) ainda não apareceram.
O que é MoE?
O Kimi K3 usa uma arquitetura MoE (mistura de especialistas). Em termos simples, o modelo mantém 896 “redes de especialistas” internas; quando processa um token, o sistema escolhe apenas 16 especialistas de roteamento, além de um cálculo de especialistas compartilhados, em vez de calcular tudo — por isso, os parâmetros realmente “ativos” ao rodar ficam entre 50 bilhões e 60 bilhões.
O modelo também adota uma nova arquitetura, Kimi Delta Attention (KDA), combinada com Attention Residuals; na autoavaliação oficial, em contexto longo de milhões de tokens, a velocidade de decodificação melhora até 6,3 vezes. A janela de contexto chega a 1 milhão de tokens e o modelo também oferece suporte nativo a entradas visuais.
Requisito oficial: começa com 64 GPUs
Nas orientações oficiais de implantação, a Moonshot AI deixa claro que montar o K3 por conta própria exige pelo menos 64 aceleradores. Os pesos nativos MXFP4 têm cerca de 1,5 TB; isso é 3,7 vezes o DeepSeek-R1 671B (quantização Q4 em torno de 407 GB). Fazendo apenas a conversão para colocar os pesos, quantas GPUs seriam necessárias:
E isso ainda não conta o KV cache, ou seja, a memória usada para o modelo guardar o histórico do diálogo (contexto). A necessidade de KV cache para contexto de 1 milhão de tokens ainda não foi divulgada oficialmente, mas só tende a aumentar, não a diminuir.
Em preços, uma H100 de 80GB custa em torno de US$ 25 mil a US$ 33 mil por placa (PCIe); na versão SXM, fica acima de US$ 35 mil a US$ 40 mil por placa. Um servidor com 8 placas H100 custa mais de US$ 300 mil. Considerando o limite oficial de 64 GPUs, isso equivale a 8 servidores com 8 placas; só a compra de hardware ultrapassa US$ 2,4 milhões, algo como acima de US$ 70 milhões em moeda local (aprox. Taiwan).
Em consumo de energia, uma H100 tem cerca de 700W; com 64 GPUs, isso dá aproximadamente 45kW. É muito acima da capacidade de energia de uma residência comum, sendo um nível típico de data center.
A geração anterior ainda cabia em um computador
Comparando com a geração anterior da família K2 (1 trilhão de parâmetros, cerca de 32 bilhões de parâmetros ativados), a diferença fica bem mais clara. A quantização extrema de 1,8 bit feita pela comunidade para o K2 permite rodar com aproximadamente 247GB; uma GPU de consumo de 24GB, junto com capacidade de descarregamento (offload) usando memória do sistema, também dá para fazer funcionar. Já o K2.5 precisa de mais de 380GB de memória unificada, e o K2.6 na versão Q2 fica em torno de 350GB.
A geração anterior, em um Mac Studio de 512GB, até dá para rodar “no limite”, mas o K3 volta o patamar diretamente para o nível de data center. Para investidores pessoa física que queiram usar, o caminho é reduzir a versão e usar a família K2, ou então chamar a API oficial diretamente.