O que a Alibaba anunciou em Xangai

A 19 de julho, na Conferência Mundial de IA em Xangai, a equipa Qwen da Alibaba apresentou o Qwen3.8-Max, o próximo modelo de topo da família Qwen. A especificação em destaque são 2,4 biliões de parâmetros, e é o primeiro modelo multimodal da equipa acima do bilião, capaz de tratar texto, imagens, vídeo e documentos num único sistema.

A Alibaba posiciona-o logo atrás do Claude Fable 5 e diz que melhora o Qwen3.7-Max em programação, desenvolvimento de pilha completa, análise de dados e fluxos de trabalho de escritório. Há uma pré-visualização disponível através do Token Plan, Qoder e QoderWork da Alibaba a 10 por cento do preço padrão, e a empresa prometeu em breve uma publicação de pesos abertos sem indicar data.

O número em falta é o que dá preço à sua carga

Porque importa: 2,4 biliões é o número que é noticiado e o que menos lhe diz. Os grandes modelos de fronteira desta forma são sistemas esparsos de mistura de peritos, o que significa que apenas um subconjunto dos parâmetros é acionado em cada pedido. O total descreve quanto modelo existe. A contagem ativa descreve quanto dele corre e, por isso, quanta computação cada pedido consome.

A Alibaba não revelou a contagem ativa. Essa única omissão torna a dimensão anunciada inútil para planear: um modelo de 2,4 biliões de parâmetros com uma fração ativa pequena pode ser mais barato de servir do que um modelo denso muito menor, e um com fração ativa grande pode ser muito mais caro. Quem dimensiona um orçamento a partir do número do título trabalha com um valor escolhido para impressionar e não para informar.

Uma afirmação de posição ainda sem nada por trás

A afirmação do segundo lugar merece o mesmo escrutínio. A Alibaba nomeou um concorrente concreto, o Claude Fable 5, e colocou-se diretamente abaixo, sem publicar resultados de testes que sustentem essa posição.

É o inverso do padrão em que vale a pena confiar. Quando a Moonshot lançou o Kimi K3, o seu próprio anúncio colocou o modelo em segundo lugar no conjunto, e os testes independentes na Arena.ai colocaram-no depois em primeiro para código de interface. Um fornecedor cuja afirmação própria é mais modesta do que o resultado independente deu-lhe um sinal utilizável. Um fornecedor cuja afirmação chega sem qualquer resultado independente deu-lhe uma linha de comunicado. Até as classificações públicas pontuarem o Qwen3.8-Max, a posição é a opinião da Alibaba sobre a Alibaba.

Leia o desconto pelo que ele é

A conclusão: uma pré-visualização a 10 por cento do preço de tabela é um convite a testar, não uma oferta sobre a qual construir. O preço cumpre uma função, que é levar cargas reais para um modelo não comprovado com rapidez suficiente para gerar as provas de avaliação que o lançamento não incluiu.

Nada disso é impróprio, e para uma equipa europeia com capacidade de avaliação disponível pode ser uma forma barata de aprender algo. O erro é tomar a tarifa com desconto pela economia do modelo. Os preços de pré-visualização acabam, a tarifa padrão é dez vezes superior, e qualquer caso de negócio construído sobre o número promocional inverte-se assim que a pré-visualização fecha. Se o testar, teste-o na sua própria carga e registe o custo ao preço de tabela integral, não à tarifa de lançamento.

Em breve não é uma data, e a comparação tem uma

A promessa de pesos abertos é a parte com a consequência mais clara para quem pondera independência face a uma interface alojada. A Alibaba diz que os pesos chegam em breve e não se comprometeu com o quando. A Moonshot disse que os pesos completos do Kimi K3 chegam a 27 de julho.

Para um operador que se preocupa em poder executar um modelo em infraestrutura que controla, essas duas declarações não são comparáveis. Uma é um plano com uma data que pode inscrever num calendário e pela qual pode responsabilizar um fornecedor. A outra é uma intenção. Se a sua razão para sequer acompanhar os modelos de fronteira chineses é que os pesos abertos permitem alojar em casa, inspecionar e sair, então uma publicação sem data ainda não faz avançar esse objetivo, por maior que seja a contagem de parâmetros que a acompanha.