A recente divulgação de slides durante o Investor Day da SanDisk movimentou o ecossistema tecnológico e gerou debates intensos nas redes sociais. A comunidade especializada apontou o que considera falhas técnicas, omissões importantes e o uso de métricas defasadas nas comparações entre a nova tecnologia de memória HBF (High-Bandwidth Flash) e os padrões já consolidados de mercado.
As críticas concentraram-se na forma como os dados foram estruturados na apresentação da empresa. Especialistas em hardware apontaram que a escolha das especificações e as projeções numéricas não refletem o cenário atual e futuro do desenvolvimento de inteligência artificial.
They are deliberately misrepresenting HBM performanceFor some reason, they fix the bandwidth of both HBM & HBF stacks at 1.6TB/s (12.8/8)Secondly, nobody serves models on bf16 anymoreMost models are served on fp4 or fp8So a Qwen 480B should occupy 240GB to 480GB depending on… https://t.co/I19HOYo5LJ
— Zephyr (@zephyr_z9) August 14, 2026
Especificações apontadas pela SanDisk para HBM e HBF
No material exibido ao mercado, a capacidade da memória HBM por unidade de processamento gráfico foi estipulada em 192 GB, acompanhada de uma largura de banda de 12,8 TB/s. Por outro lado, a tecnologia High-Bandwidth Flash (HBF) — desenvolvida em parceria com a SK hynix — foi projetada para entregar capacidades de armazenamento significativamente maiores, embora com taxas de transferência inferiores.
| Tecnologia | Capacidade por GPU | Largura de banda |
|---|---|---|
| HBM | 192 GB | 12,8 TB/s |
| HBF | 512 GB de armazenamento | 0,4 TB/s a 3 TB/s |
Com previsão de chegada comercial entre 2028 e 2029, a HBF baseia-se no empilhamento de matrizes NAND interconectadas por meio de vias passantes de silício (TSVs), associadas a um circuito lógico de controle. A durabilidade desse tipo de componente, contudo, tornou-se o centro da polêmica.
Para contextualizar, a resistência de gravação representa a vida útil de uma memória flash. Trata-se do limite máximo de ciclos de apago e escrita que o componente suporta antes de sofrer desgaste físico e perder a capacidade de retenção de dados.
O papel do cache KV e das redes neurais na inteligência artificial
O funcionamento dos modelos modernos de inteligência artificial depende de arquiteturas complexas baseadas em blocos transformadores. Entre eles, a camada de atenção atua mapeando as relações semânticas entre os elementos de uma frase.
Esse processo gera o chamado cache KV (Key-Value Cache), que funciona como uma memória de curto prazo do sistema, permitindo respostas fluidas e em tempo real. Paralelamente, as redes feed-forward (FFN) armazenam o volume principal de parâmetros e o conhecimento consolidado do modelo por meio de pesos fixos.
Desafios na gestão de memória para cargas de trabalho de IA
Durante a execução de tarefas computacionais pesadas, tanto os pesos estruturais quanto o cache dinâmico precisam ser mantidos próximos à unidade de processamento. Como as pastilhas de memória HBM são integradas fisicamente ao redor da GPU, o espaço disponível e a capacidade total enfrentam restrições rígidas.
A ampliação dessa infraestrutura de memória tradicionalmente exige a adição de mais aceleradores gráficos, o que eleva substancialmente os custos operacionais e de hardware.
Velocidades de leitura e o impacto do paralelismo na HBF
Enquanto a memória HBM utiliza arquitetura DRAM, a HBF emprega células NAND. As diferenças operacionais entre as tecnologias geram discrepâncias consideráveis nas velocidades de acesso.
| Tecnologia de memória | Velocidade de leitura aproximada |
|---|---|
| SRAM | 1 nanossegundo |
| DRAM | 100 nanossegundos |
| NAND | 100 microssegundos |
Como a tecnologia NAND apresenta latências consideravelmente superiores às da DRAM, a HBF busca contornar essa restrição explorando o paralelismo avançado. O circuito controlador gerencia milhares de acessos simultâneos, resultando em uma largura de banda cumulativa que varia de 0,3 TB/s a 3 TB/s.
Been sitting on my HBF notes for the past 2 weeksBut $SNDK investor day update made me realize how manipulative they are on narrative, for two reasons:> comparing HBF GPU and HBM GPU without showing write endurance (100k+ cycles, inherent NAND characteristic, vs unlimited for…
— sigma capitalist (@phithetasigma) August 13, 2026
Lacunas técnicas e a ausência de dados sobre durabilidade
Apesar do potencial para expansão de capacidade, a HBF herda as limitações físicas das memórias flash no que diz respeito à velocidade de gravação e à degradação material após ciclos intensos de uso.
Analistas do mercado financeiro e da engenharia de computação apontam que a omissão de métricas sobre a resistência de gravação compromete a avaliação da viabilidade da tecnologia, especialmente para aplicações dinâmicas como a gestão contínua de cache KV.
Comparações com padrões futuros da indústria
Outro ponto contestado refere-se à escolha dos parâmetros comparativos. Como a HBF tem lançamento previsto para o final da década, especialistas argumentam que o comparativo deveria utilizar as especificações da arquitetura HBM4E de 16Hi, padrão que deve dominar o mercado no mesmo período.
| Tecnologia | Largura de banda | Previsão de disponibilidade |
|---|---|---|
| HBM4E de 16Hi | 32 TB/s | Período de lançamento da HBF |
| HBM citada pela SanDisk | 12,8 TB/s | — |
| HBF | 0,4 TB/s a 3 TB/s | 2028 ou 2029 |
Além da divergência nas projeções de largura de banda — onde a HBM4E de 16Hi pode alcançar marcas cerca de três vezes superiores aos dados exibidos —, o uso de quantização BF16 nos exemplos teóricos também foi questionado, visto que a maioria dos modelos atuais de inteligência industrial opera com formatos mais eficientes, como FP8 ou FP4.
Até o momento, a empresa responsável pela apresentação não emitiu novos comunicados para responder aos questionamentos técnicos levantados pela comunidade de engenharia e desenvolvimento.
Fonte:: adrenaline.com.br




