DeepSeek 4.1: MoE de 256 Especialistas, MTP-4x e DualPipe 2.0
O mercado global de inteligência artificial acaba de ser sacudido por um terremoto arquitetural de proporções históricas. A DeepSeek-AI disponibilizou oficialmente em escala global os pesos abertos e o endpoint corporativo do DeepSeek 4.1 (também denominado sob a série DeepSeek-V4.1 Foundation), consolidando uma ruptura definitiva com os paradigmas convencionais de escala densa e redefinindo os…
O mercado de inteligência artificial foi sacudido por um terremoto arquitetônico com a liberação global do DeepSeek 4.1, também conhecido como DeepSeek-V4.1 Foundation. Este modelo, com 670 bilhões de parâmetros, atinge paridade com gigantes proprietários como o Claude Mythos 5.1 da Anthropic e o GPT-6 Astra da OpenAI ao ativar apenas 37 bilhões de parâmetros por token gerado.
A inovação chave reside em sua eficiência: a tecnologia de Multi-Token Prediction 4ª Geração (MTP-4x) combinada com o escalonador DualPipe 2.0 quadruplica a taxa de decodificação sequencial, entregando 240+ tokens por segundo por nó por apenas $0,55 por milhão de tokens gerados. A estrutura inclui 256 especialistas roteados e 1 especialista compartilhado isolado, eliminando perda de representação e colapso de especialistas através do Auxiliar Loss-Free Load Balancing.
Essa abordagem revoluciona a inferência em larga escala, tornando a inteligência de ponta acessível a desenvolvedores e datacenters corporativos a uma fração do custo dos modelos fechados.
Written by urgent.news from Dev.to's reporting — not their text. Machine-written — may contain errors; check the original before relying on it.