Skip to content
Ferramenta de IA

Revisão do Qwen3.8-Max

Qwen3.8-Max é o modelo de IA multimodal de 2,4 trilhões de parâmetros da Alibaba Cloud, projetado para raciocínio complexo em texto, imagens, vídeos e documentos.

shipped 3 de ago. de 2026chatbotfreemium
Domain rating80Monthly visits47K/mo
chatbotimage-generationvideo
Qwen3.8-Max — product screenshot

Por que importa

1Apresenta uma arquitetura esparsa Mixture-of-Experts (MoE) de 2,4 trilhões de parâmetros, ativando aproximadamente 95 bilhões de parâmetros durante a inferência.
2Oferece uma janela de contexto de 1M-token, permitindo a análise de extensas bases de código, longas transcrições de vídeo e múltiplos documentos.
3Alcançou uma pontuação de 86,6 no Terminal-Bench 2.1, superando Claude Opus 4.8 e Claude Fable 5.
4Suporta codificação full-stack, desenvolvimento de agentes e fluxos de trabalho profissionais de longo prazo, incluindo automação estilo Office.

Especificações

API disponível

Sim, API pública

overview

O que é Qwen3.8-Max?

Qwen3.8-Max é uma ferramenta de modelo de linguagem grande multimodal desenvolvida pela Alibaba Cloud que permite que desenvolvedores de software, usuários corporativos e desenvolvedores de agentes de IA processem e analisem vários tipos de informações, incluindo texto, imagens, vídeo e documentos. Ele integra capacidades para chatbots, análise de imagem e vídeo e geração de conteúdo, e inclui funcionalidade de pesquisa na web em modelos de IA. Qwen3.8-Max é o LLM multimodal carro-chefe da Alibaba Cloud, apresentando 2,4 trilhões de parâmetros totais e utilizando uma arquitetura esparsa Mixture-of-Experts (MoE) que ativa aproximadamente 95 bilhões de parâmetros durante a inferência para eficiência. Seus principais casos de uso incluem codificação full-stack e desenvolvimento de agentes, fluxos de trabalho profissionais de longo prazo, raciocínio multimodal e resolução avançada de problemas. O modelo foi anunciado em 19 de julho de 2026, como uma variante de pré-visualização (Qwen3.8-Max-Preview) do próximo modelo carro-chefe Qwen3.8, com o modelo Qwen3.8 completo programado para um lançamento de peso aberto. Pesos de código aberto para Qwen3.8-Max são prometidos para a semana de 2 de agosto de 2026. Atualmente, ele é acessível através das plataformas Token Plan, Qoder e QoderWork da Alibaba Cloud.

features

Principais Recursos do Qwen3.8-Max

Qwen3.8-Max integra um conjunto abrangente de recursos projetados para desenvolvimento avançado de aplicativos de IA e análise complexa de dados.

  • 2,4 Trilhões de Parâmetros com Arquitetura MoE Esparsa: Ativa aproximadamente 95 bilhões de parâmetros para inferência eficiente.
  • Processamento de Entrada Multimodal: Capaz de compreender e raciocinar em texto, imagens, vídeo e documentos.
  • Janela de Contexto de 1M-Token: Suporta o processamento de extensas bases de código, longas transcrições de vídeo e múltiplos documentos.
  • Codificação Full-Stack e Desenvolvimento de Agentes: Integra-se com ambientes de codificação como Qwen Code e pode recriar software a partir de capturas de tela.
  • Fluxos de Trabalho Profissionais de Longo Prazo: Automatiza tarefas estilo Office e tarefas de agente complexas e de longa duração.
  • Raciocínio Avançado e Resolução de Problemas: Oferece um 'modo de pensamento' para raciocínio lógico complexo, matemática e codificação.
  • Compatibilidade com API: Projetado para ser compatível com os protocolos de API OpenAI e Anthropic.
  • Ferramentas Integradas: Inclui code_interpreter, web_search, web_extractor, t2i_search e i2i_search via Responses API.
  • Codificação Autônoma: Demonstrou capacidades de autoevolução em tarefas de codificação por mais de 10 dias (por exemplo, projeto oh-my-cli).
  • Reprodução de Artigos de Pesquisa: Capaz de reproduzir e melhorar autonomamente artigos de pesquisa, envolvendo 1.100 ações e 7.600 linhas de código em 5 dias.

use cases

Quem Deve Usar o Qwen3.8-Max?

Qwen3.8-Max é projetado principalmente para desenvolvedores e empresas que exigem capacidades avançadas de IA multimodal para tarefas complexas.

  • Desenvolvedores de Software: Para codificação full-stack, desenvolvimento de agentes e recriação de aplicativos de software a partir de capturas de tela.
  • Usuários Corporativos: Para fluxos de trabalho profissionais de longo prazo, automação estilo Office e análise complexa de dados.
  • Desenvolvedores de Agentes de IA: Para construir fluxos de trabalho sofisticados de agentes de IA que exigem integração precisa com ferramentas externas.
  • Profissionais que Exigem Raciocínio Multimodal: Para tarefas que envolvem entradas de imagem e vídeo, como converter plantas baixas 2D em visualizações 3D.
  • Pesquisadores e Acadêmicos: Para reproduzir e melhorar autonomamente artigos de pesquisa e se envolver em resolução avançada de problemas.

how to use

Como Usar o Qwen3.8-Max

Qwen3.8-Max é acessível através das plataformas da Alibaba Cloud, oferecendo vários métodos para integração e uso.

  • 1Acesso via Alibaba Cloud: Utilize as plataformas Token Plan, Qoder ou QoderWork para obter acesso ao modelo.
  • 2Integração de API: Integre Qwen3.8-Max em aplicativos existentes usando sua compatibilidade com os protocolos de API OpenAI e Anthropic.
  • 3Utilize Ferramentas Integradas: Aproveite ferramentas integradas como code_interpreter e web_search através da Responses API para funcionalidade aprimorada.
  • 4Envolva-se em Tarefas de Codificação: Empregue o modelo para codificação full-stack, desenvolvimento de agentes e recriação de aplicativos de software.
  • 5Processe Entradas Multimodais: Alimente texto, imagens, vídeo e documentos para o modelo para análise e raciocínio abrangentes.
  • 6Solicite Acesso à Pré-visualização: Participe do programa Qwen3.8-Max-Preview para acesso antecipado e uso com desconto.

pricing

Preços e Planos do Qwen3.8-Max

Qwen3.8-Max opera em um modelo freemium, oferecendo uma camada gratuita juntamente com opções pagas, com preços específicos para consumo de tokens e descontos promocionais para acesso à pré-visualização.

  • Freemium: Inclui acesso gratuito com opções pagas para uso estendido.
  • Token Plan Lite: Começa em US$ 6 por mês (39 CNY) para acesso inicial ao Qwen3.8-Max-Preview.
  • Preços Padrão da API: US$ 2 por 1M de tokens de entrada, US$ 6 por 1M de tokens de saída e US$ 0,25 por 1M de tokens de entrada em cache para o modelo geralmente disponível.
  • Taxas Promocionais do Qoder: Uso de pré-visualização a 0,5x da taxa padrão, reduzido para 0,05x (90% de desconto) durante o horário normal e 0,01x (98% de desconto) durante o horário de pico (14:00–00:00 UTC).
  • Desconto de Entrada em Cache: A entrada em cache é oito vezes mais barata que a entrada nova.

Pros

  • +2.4 trillion-parameter sparse MoE architecture for advanced reasoning.
  • +1M-token context window supports extensive document analysis and long-horizon tasks.
  • +Exceptional coding capabilities across 90+ programming languages, including autonomous software development.
  • +Multimodal processing for text, images, and video inputs, with reported document and speech support.
  • +Aggressive promotional API pricing and freemium access make it cost-effective for early adoption.
  • +API compatibility with OpenAI and Anthropic protocols simplifies integration for developers.

Cons

  • User reports indicate a tendency to 'redefine difficult tasks quietly to some easier option' and take shortcuts, requiring user intervention.
  • Some tests show slowness, potentially due to verbose internal thinking or initial server strain.
  • Reported struggles with complex simulations, exhibiting buggy behavior in certain scenarios.
  • Internal benchmarks show it trailing Claude Fable 5 on several key SWE-bench and professional exams.
  • Lacks published third-party benchmark rankings and open API pricing transparency compared to some competitors like Kimi K3.

Ferramentas similares

Qwen3.8-Max vs Concorrentes

Qwen3.8-Max é posicionado como um modelo de IA de ponta, com a Alibaba afirmando que é 'o segundo melhor, perdendo apenas para Fable 5' entre seus pares. Suas capacidades multimodais e o compromisso com um lançamento de peso aberto o distinguem no cenário competitivo.