Qwen3.8-Max tornou-se rapidamente num dos lançamentos de modelos de IA mais discutidos de 2026.
A equipa da Qwen, da Alibaba, apresentou-o oficialmente como o “modelo mais capaz até hoje” da empresa. Com aproximadamente 2,4 biliões de parâmetros totais, o Qwen3.8-Max posiciona-se como um modelo de topo para programação autónoma, trabalho profissional, agentes de longo horizonte e inteligência multimodal.
O anúncio oficial também traz vários detalhes que tinham faltado durante o período de pré-visualização. A Qwen já publicou preços de API, resultados de benchmarks de linguagem e visão, exemplos de tarefas de agentes de longa duração e uma linha do tempo para a disponibilização dos pesos do modelo open.
O resultado vai além de mais uma atualização de chatbot. O Qwen3.8-Max reflete uma mudança mais ampla: sair de modelos de IA que geram respostas isoladas para agentes de IA que podem planear, usar ferramentas, inspecionar o próprio trabalho e completar projetos complexos.
O que é o Qwen3.8-Max?
O Qwen3.8-Max é o mais recente modelo de topo da Alibaba na família Qwen. Foi concebido para raciocínio avançado, desenvolvimento de software, análise multimodal, fluxos de trabalho profissionais e tarefas de agentes autónomos.
O modelo esteve inicialmente disponível com o identificador:
qwen3.8-max-preview
A pré-visualização deu aos desenvolvedores acesso antecipado, mas deixou várias questões sem resposta, especialmente sobre preços de API padrão, disponibilidade de pesos abertos e desempenho abrangente em benchmarks.
Esses detalhes ficaram mais claros no anúncio oficial do Qwen3.8-Max publicado a 3 de agosto.
A Qwen descreve o modelo como um novo marco de referência para “coding and cowork”, destacando quatro áreas centrais:
- Desenvolvimento de software autónomo
- Entregáveis de qualidade profissional
- Planeamento e execução de longo horizonte
- Inteligência nativa de agentes multimodais
Por isso, o Qwen3.8-Max não se posiciona apenas como um modelo conversacional maior. A ideia é funcionar como o motor de raciocínio por trás de sistemas de IA que trabalham com código, documentos, interfaces visuais, ferramentas externas e histórias de tarefas alargadas.
Principais funcionalidades do Qwen3.8-Max
Aproximadamente 2,4 biliões de parâmetros
A especificação principal do Qwen3.8-Max é a sua escala reportada de 2,4 biliões de parâmetros.
Isso faz dele um dos maiores modelos anunciados publicamente pela equipa da Qwen. Ainda assim, os parâmetros totais não devem ser confundidos com o número de parâmetros usados em cada resposta.
Se o modelo usar uma arquitetura de mixture-of-experts, apenas parte da rede completa pode ser ativada para uma solicitação individual. O desempenho no mundo real também depende de:
- Número de parâmetros ativos
- Qualidade dos dados de treino
- Métodos de aprendizagem por reforço
- Precisão no uso de ferramentas
- Gestão de contexto
- Infraestrutura de inferência
- Latência das respostas
- Confiabilidade em tarefas repetidas
A contagem de parâmetros demonstra a escala do modelo, mas não prova que o Qwen3.8-Max irá superar todos os modelos concorrentes em todos os cenários.
Programação autónoma
De acordo com a Qwen, o Qwen3.8-Max consegue sustentar mais de dez dias de desenvolvimento de software a evoluir por si mesmo.
A empresa apresenta um exemplo em que o modelo passa de uma pasta vazia para um projeto pronto para produção com intervenção humana limitada. Um registo público do projeto está disponível via o repositório GitHub ligado no anúncio oficial.
Esta é uma tarefa mais exigente do que gerar uma função curta ou corrigir um único bug. A programação autónoma de longa duração pode exigir que um modelo:
- Compreenda o objetivo do produto.
- Desenhe uma arquitetura apropriada.
- Crie e edite múltiplos ficheiros.
- Instale ou configure dependências.
- Execute testes e interprete erros.
- Revise a aplicação resultante.
- Corrija problemas de implementação.
- Continue a iterar sem perder o objetivo original.
A demonstração é um exemplo fornecido pelo fornecedor, em vez de um benchmark independente. Ainda assim, ilustra o tipo de fluxo de trabalho de desenvolvimento alargado que o Qwen3.8-Max foi concebido para suportar.
Trabalho de agentes de longo horizonte
A Qwen também destaca dois cenários de agente invulgarmente longos:
- Mais de 500 turnos de otimização de chip-design
- Uma estratégia de e-commerce simulada de 365 dias
Estes exemplos destinam-se a demonstrar aprendizagem adaptativa em circuito fechado. Neste tipo de fluxo, um agente não produz apenas um plano único. Ele observa repetidamente os resultados, atualiza a estratégia e decide o que fazer a seguir.
Um agente de longo horizonte capaz deve preservar contexto importante ao mesmo tempo que evita acumular histórico irrelevante. Também precisa de memória fiável, acompanhamento de progresso, permissões de ferramentas, regras de validação e mecanismos de recuperação.
O modelo é apenas uma parte desse sistema. O desempenho do agente também depende do software envolvente e do desenho do fluxo de trabalho.
Inteligência multimodal nativa
O Qwen3.8-Max suporta entradas de texto, imagem e vídeo.
A Qwen descreve a visão como um ciclo contínuo de feedback, em vez de um único canal de entrada. Um agente visual pode repetir várias vezes:
- Observar uma interface
- Identificar o estado atual
- Decidir a próxima ação
- Operar uma ferramenta
- Inspecionar o resultado
- Detetar um erro
- Corrigir a sua ação anterior
Isto é particularmente relevante para automação de navegadores, testes de software, processamento de documentos, revisão de interfaces e fluxos de trabalho que combinam instruções escritas com informação visual.
Contexto de um milhão de tokens
Os registos públicos de integração do Qwen Code indicaram uma janela de contexto de aproximadamente um milhão de tokens para o Qwen3.8-Max.
Uma janela de contexto deste tamanho pode suportar:
- Grandes repositórios de software
- Coleções de artigos de pesquisa
- Documentos empresariais extensos
- Históricos alargados de agentes
- Múltiplos ficheiros e fontes de dados
- Vídeos longos ou transcrições
No entanto, mais contexto não produz automaticamente uma resposta melhor. Entradas muito grandes podem aumentar a latência e tornar mais difícil ao modelo focar evidências relevantes.
Para obter melhores resultados, os utilizadores devem ainda organizar os materiais, remover informação não relacionada, resumir etapas concluídas e pedir ao modelo para citar os ficheiros ou passagens que suportam conclusões importantes.
Benchmarks de linguagem e de agentes do Qwen3.8-Max
A Qwen publicou um gráfico oficial de benchmarks comparando o Qwen3.8-Max com Opus 4.8, Fable 5, GPT-5.6 Sol e Qwen3.7-Max.

Os resultados selecionados do Qwen3.8-Max incluem:
| Benchmark | Pontuação do Qwen3.8-Max |
|---|---|
| Terminal Bench 2.1 | 89.8 |
| FrontierSWE | 73.5 |
| PaperBench | 83.0 |
| AndroidBench | 75.1 |
| QwenSWEBench | 80.7 |
| QwenCoderBench | 58.4 |
| QwenReactBench | 1,724 |
| QwenSVGBench | 1,713 |
| CoWorkBench | 74.8 |
| WorkSpaceBench | 67.7 |
| JobBench | 53.4 |
| SkillsBench | 70.2 |
| GPQA Diamond | 92.6 |
| MMLU-Pro | 92.9 |
| LongBench v2 | 68.3 |
O gráfico indica ganhos substanciais face ao Qwen3.7-Max em várias categorias.
Por exemplo, a pontuação do Terminal Bench 2.1 reportada sobe de 74,5 no Qwen3.7-Max para 89,8 no Qwen3.8-Max. O resultado do CoWorkBench aumenta de 64,8 para 74,8, enquanto o WorkSpaceBench sobe de 61,4 para 67,7.
O modelo também reporta resultados fortes de raciocínio geral, incluindo 92,6 no GPQA Diamond e 92,9 no MMLU-Pro.
O Qwen3.8-Max não lidera todos os benchmarks da tabela. Outros modelos mantêm pontuações mais altas em algumas avaliações de engenharia de software e de agentes profissionais. Por isso, os resultados sustentam descrever o Qwen3.8-Max como altamente competitivo, mas não universalmente superior.
Estes números foram publicados pela Qwen. Ainda é necessário testar de forma independente antes de tirar conclusões sobre desempenho em produção.
Benchmarks multimodais do Qwen3.8-Max
A Qwen disponibilizou um gráfico de benchmarks separado cobrindo raciocínio multimodal, agentes visuais, inteligência de documentos, compreensão espacial, grounding visual e tarefas de vídeo.

Os resultados selecionados incluem:
| Benchmark | Pontuação do Qwen3.8-Max |
|---|---|
| MMMU-Pro | 82.3 |
| MathVision | 95.2 / 97.7 |
| LogicVista | 91.9 |
| SLAKE | 90.8 |
| OSWorld-Verified | 86.1 |
| AndroidWorld | 85.3 |
| Parametric CAD Bench | 91.5 |
| OmniDocBench 1.5 | 92.1 |
| RealWorldQA | 88.0 |
| MMStar | 85.9 |
| CountQA | 82.4 |
| Dense200 | 87.0 |
| VideoMME com legendas | 90.4 |
| VideoMMMU | 88.7 |
| MLVU | 90.8 |
Os resultados sugerem que o Qwen3.8-Max não é simplesmente um modelo de linguagem com uma funcionalidade de upload de imagens. Está a ser otimizado para tarefas em que a informação visual afeta o planeamento e o uso de ferramentas.
Benchmarks como OSWorld-Verified e AndroidWorld testam partes desse fluxo de trabalho do agente. Eles exigem que o modelo compreenda uma interface e determine como interagir com ela.
O Qwen3.8-Max reporta desempenho forte em muitas destas avaliações, embora não lidere todos os benchmarks de agentes visuais. Altas pontuações em compreensão de documentos ou answering de perguntas visuais também não garantem automaticamente controlo fiável do computador.
Veja o Qwen3.8-Max em ação
Quer uma análise mais próxima do Qwen3.8-Max e de como ele se compara a outros modelos open líderes? Assista ao vídeo abaixo para uma decomposição prática das suas capacidades, do desempenho em benchmarks e de potenciais aplicações no mundo real.

Preços de API do Qwen3.8-Max
O anúncio oficial lista os seguintes preços de API:
| Tipo de utilização | Preço oficial |
|---|---|
| Entrada | $2,00 por milhão de tokens |
| Saída | $6,00 por milhão de tokens |
| Cache implícito | $0,25 por milhão de tokens |
Esta é uma atualização importante face ao período de pré-visualização, quando o preço padrão por token não estava claramente disponível.
O preço do cache implícito pode ser útil para agentes que acedem repetidamente ao mesmo repositório, instruções do sistema, documentos da empresa ou histórico de conversas.
Os custos reais do fluxo de trabalho ainda dependem de:
- Tamanho do contexto de entrada
- Duração do raciocínio
- Saída gerada
- Número de chamadas a ferramentas
- Tentativas falhadas e novas tentativas
- Comportamento de cache do contexto
- Requisitos de revisão humana
Por isso, as empresas devem calcular o custo por tarefa concluída em vez de comparar modelos apenas pelas taxas de tokens anunciadas.
Um modelo com tokens baratos ainda pode ficar caro se exigir correções repetidas. Um modelo mais caro pode entregar melhor valor se concluir a tarefa corretamente na primeira tentativa.
O Qwen3.8-Max é open source?
No anúncio de 3 de agosto, a Qwen afirmou que os pesos abertos do Qwen3.8-Max seriam disponibilizados na semana seguinte.
A equipa também anunciou um modelo Qwen3.8-27B com pesos abertos.
Até que os pesos e a licença sejam efetivamente publicados, a descrição mais precisa é:
A Qwen anunciou oficialmente a disponibilização iminente de pesos abertos para o Qwen3.8-Max e o Qwen3.8-27B. Os programadores devem verificar o repositório final, a licença, os checkpoints e os requisitos de deployment assim que o lançamento estiver disponível.
O deployment local de um modelo com 2,4 biliões de parâmetros totais exigiria infraestrutura substancial. O modelo menor de 27B pode ser mais prático para programadores individuais, equipas de investigação e empresas com capacidade de GPU limitada.
Quem deve usar o Qwen3.8-Max?
Equipas de desenvolvimento de software
O Qwen3.8-Max pode ser útil para:
- Explorar repositórios desconhecidos
- Planear mudanças de arquitetura
- Editar múltiplos ficheiros
- Depurar falhas complexas
- Executar testes
- Construir aplicações completas
- Operar agentes de coding de longa duração
Antes de permitir que o modelo altere código em produção, as equipas devem testar se ele segue as instruções do repositório, usa o diretório de trabalho correto, limita as alterações ao âmbito solicitado e valida as suas mudanças.
Equipas de investigação e de conteúdos
O contexto longo e as capacidades multimodais do modelo podem apoiar:
- Síntese de investigação
- Análise competitiva
- Revisão de documentos
- Análise de vídeo
- Extração de conhecimento
- Geração de relatórios
Uma ferramenta como o iWeaver pode ajudar os utilizadores a recolher e organizar PDFs, páginas web, vídeos e outros materiais antes de pedir a um modelo avançado para comparar fontes ou gerar uma análise estruturada.
O ponto-chave é preservar rastreabilidade. As afirmações importantes devem permanecer ligadas às suas fontes originais.
Equipas de automação empresarial
As empresas podem avaliar o Qwen3.8-Max para:
- Assistentes internos de conhecimento
- Fluxos de trabalho de apoio ao cliente
- Processamento de documentos
- Automação de escritório
- Operações de software
- Agentes de negócio que usam ferramentas
A avaliação em produção deve abranger segurança, controlos de acesso, retenção de dados, auditabilidade, estabilidade da API, concorrência, recuperação de falhas e custo total das tarefas.
Deve mudar para o Qwen3.8-Max?
Vale a pena testar o Qwen3.8-Max se o seu fluxo de trabalho envolver programação complexa, documentos longos, análise multimodal ou ferramentas que exijam múltiplas rondas de planeamento e execução.
No entanto, partir diretamente de um gráfico de benchmarks até ao deployment em produção seria prematuro.
Uma abordagem mais fiável é criar um benchmark com 20 a 50 tarefas do seu fluxo de trabalho real. Compare o Qwen3.8-Max com o Qwen3.7-Max e pelo menos um outro modelo de topo usando os mesmos prompts, ficheiros-fonte, ferramentas e critérios de avaliação.
Acompanhe:
- Taxa de conclusão de tarefas
- Taxa de sucesso na primeira tentativa
- Tempo de resposta
- Falhas no uso de ferramentas
- Tempo de correção humana
- Consumo de entrada e saída
- Consistência em execuções repetidas
- Qualidade do entregável final
O melhor modelo não é necessariamente o que tem mais parâmetros ou a maior pontuação média em benchmarks. É o modelo que conclui as suas tarefas específicas de forma fiável a um custo aceitável.
Conclusão final
O Qwen3.8-Max combina uma escala reportada de 2,4 biliões de parâmetros com programação autónoma, planeamento de longo horizonte, raciocínio multimodal, uma janela de contexto de um milhão de tokens e preços de API competitivos.
Os benchmarks oficiais sugerem progresso significativo face ao Qwen3.7-Max em agentes de coding, fluxos de trabalho profissionais, raciocínio geral, compreensão de documentos e tarefas visuais. A Qwen também anunciou lançamentos com pesos abertos para o Qwen3.8-Max e para o Qwen3.8-27B.
A questão que fica é saber não se o modelo parece impressionante num anúncio. É se avaliações independentes e utilizadores reais em produção conseguem reproduzir o desempenho reportado.
Por agora, o Qwen3.8-Max é um dos modelos mais importantes a acompanhar — e um forte candidato para testes controlados em programação, investigação e fluxos de trabalho baseados em agentes.
Perguntas frequentes
O que é o Qwen3.8-Max?
O Qwen3.8-Max é o modelo de IA de topo da Alibaba para raciocínio avançado, programação autónoma, análise multimodal e fluxos de trabalho de agentes de longa duração. Tem aproximadamente 2,4 biliões de parâmetros totais.
Qual é o preço da API do Qwen3.8-Max?
O preço oficial é $2 por milhão de tokens de entrada, $6 por milhão de tokens de saída e $0,25 por milhão de tokens para cache implícito.
O Qwen3.8-Max suporta imagens e vídeos?
Sim. O Qwen3.8-Max suporta entradas de texto, imagem e vídeo. A Qwen posiciona a visão como parte de um ciclo contínuo de planeamento e autocorreção para agentes de IA.
Qual é o tamanho da janela de contexto do Qwen3.8-Max?
As informações de integração do Qwen Code publicadas indicaram uma janela de contexto de aproximadamente um milhão de tokens. Limites reais devem ser verificados para a plataforma específica ou endpoint de API que estiver a ser usado.
O Qwen3.8-Max é open source?
A Qwen anunciou que os pesos abertos do Qwen3.8-Max seriam disponibilizados após o anúncio de 3 de agosto. Os programadores devem verificar a disponibilidade do repositório final, da licença e dos checkpoints antes de planear o deployment local.
O que é o Qwen3.8-27B?
O Qwen3.8-27B é um modelo menor anunciado em conjunto com o Qwen3.8-Max. A Qwen afirmou que ele também será lançado com pesos abertos, potencialmente tornando-o mais prático para deployment local ou privado.

