Startup chinesa aposta em supernós para escalar capacidade de IAs
A startup chinesa Biren Technology, listada na Bolsa de Hong Kong, apresentou uma arquitetura de última geração capaz de interconectar até 1.024 GPUs, adotando conexões ópticas avançadas para suportar cargas de trabalho massivas de inteligência artificial.
A solução, apresentada na Conferência Mundial de Inteligência Artificial, integra motores ópticos diretamente nas placas da série BR2xx da empresa, utilizando NPO (óptica quase encapsulada). Ao separar fisicamente os nós de computação e rede, o design permite implantações de servidores padrão, eliminando a necessidade de racks personalizados e reduzindo drasticamente os ciclos de desenvolvimento de produtos.
Por que os supernós são necessários para IA?
À medida que os modelos de IA crescem para trilhões de parâmetros, as limitações físicas da fiação de cobre tradicional estão forçando os fabricantes de hardware a adotar tecnologias ópticas para suportar as demandas exponenciais de computação.
"GPUs individuais já não são suficientes para o desenvolvimento moderno de IA", disse Ding Yunfan, vice-presidente de arquitetura de frameworks de IA da Biren, a jornalistas na 6ª feira (17.jul.2026). Ele mencionou o surgimento de arquiteturas complexas com mistura de especialistas, o aumento exponencial do tamanho dos modelos e agentes inteligentes que exigem milhões de tokens de contexto.
Para lidar com essas cargas de trabalho, os desenvolvedores estão construindo "supernós" que agrupam vastas matrizes de chips. No entanto, a fiação elétrica tradicional enfrenta limites de escalabilidade rigorosos.
Os limites do cobre e a solução óptica
À medida que a demanda por largura de banda ultrapassa 1 terabyte por segundo e as velocidades das portas chegam a 224 gigabits por segundo, os sinais de cobre se degradam severamente além de apenas 3 metros, disse Ding. Isso limita os sistemas existentes baseados em cobre a 128 chips e complica a manutenção, já que um único cabo defeituoso pode derrubar um rack inteiro.
Embora alguns concorrentes nacionais usem backplanes ortogonais - conectando módulos em um ângulo de 90 graus para eliminar cabos - esses projetos atingem um máximo de 64 placas por nó. Essa capacidade está muito aquém da escala necessária para os modelos de IA de ponta, declarou Ding.
As interconexões ópticas, que transmitem sinais por centenas de metros com degradação mínima, emergiram como a principal solução do setor. A Biren optou pela tecnologia NPO, posicionando o mecanismo óptico próximo à GPU para reduzir drasticamente o consumo de energia e a perda de sinal, além de aumentar a velocidade.
NPO versus CPO: a escolha comercial
Embora as ópticas lineares plugáveis sejam utilizadas por gigantes da internet com grandes recursos financeiros e sistemas altamente otimizados, a NPO é amplamente considerada o caminho comercial mais viável para o mercado em geral. "Uma abordagem mais agressiva de CPO [óptica co-embalada] ainda é imatura demais para chips de IA", afirmou Ding.
O protocolo BLink 2.0 e a linha de supernós
Expandindo sua linha de "supernós" juntamente com o sistema de 1.024 placas, a Biren lançou seu protocolo de interconexão proprietário BLink 2.0. Esse protocolo apresenta interconexão semântica de memória, computação em rede, controle de congestionamento e correção inteligente de erros em múltiplas camadas.
Impulsionada pelo novo protocolo e seus futuros chips BR2xx, a empresa também apresentou um servidor padrão de 16 placas e um rack de alta densidade de 128 placas.
Perguntas Frequentes
O que são supernós em IA?
Supernós são agrupamentos de vastas matrizes de chips que permitem lidar com cargas de trabalho de IA que exigem milhões de tokens de contexto e trilhões de parâmetros.
Qual a vantagem das conexões ópticas sobre o cobre?
As conexões ópticas transmitem sinais por centenas de metros com degradação mínima, enquanto o cobre se degrada severamente além de 3 metros, limitando sistemas a 128 chips.
O que é a tecnologia NPO da Biren?
NPO (óptica quase encapsulada) posiciona o mecanismo óptico próximo à GPU para reduzir consumo de energia e perda de sinal, sendo considerada mais viável comercialmente que a CPO.
Quantas GPUs a arquitetura da Biren interconecta?
A arquitetura é capaz de interconectar até 1.024 GPUs, usando placas da série BR2xx e o protocolo BLink 2.0.
Quando a Biren apresentou essa solução?
A solução foi apresentada na Conferência Mundial de Inteligência Artificial, com anúncio feito na sexta-feira, 17 de julho de 2026.