Qwen
Qwen (chinês: 通义千问; pinyin: Tōngyì Qiānwèn), conhecido internacionalmente também como Tongyi Qianwen, é uma família de grandes modelos de linguagem (LLMs) e modelos de inteligência artificial multimodais desenvolvida pela Alibaba Cloud, subsidiária de computação em nuvem do grupo tecnológico chinês Alibaba Group. Apresentada pela primeira vez em abril de 2023, a série Qwen passou a abranger modelos de escalas bastante variadas — desde versões compactas com menos de um bilhão de parâmetros até sistemas com mais de um trilhão de parâmetros — além de variantes especializadas em visão, fala, programação, matemática e raciocínio em múltiplas etapas. Além de ser oferecida por meio dos serviços comerciais de modelos da Alibaba Cloud, grande parte dos modelos Qwen foi publicada com pesos abertos, o que tornou a família uma das mais baixadas e reutilizadas no ecossistema global de modelos de código aberto em inteligência artificial.
Antecedentes
O Alibaba Group começou a investir pesadamente em pesquisa em inteligência artificial no final da década de 2010, sobretudo por meio da DAMO Academy, seu braço de pesquisa fundamental, que instituiu laboratórios dedicados a aprendizado de máquina, processamento de linguagem natural e tecnologia de fala. No início da década de 2020, esses esforços foram consolidados sob a iniciativa "Tongyi" (通义, que pode ser traduzido livremente como "significado universal"), da qual resultaram o modelo pré-treinado de grande escala M6 e outros sistemas de pesquisa.
O lançamento público do ChatGPT, no final de 2022, desencadeou uma intensa competição em torno dos grandes modelos de linguagem no mundo, com destaque para as empresas tecnológicas chinesas. Em abril de 2023, a Alibaba anunciou o Tongyi Qianwen durante a Alibaba Cloud Summit, posicionando o modelo tanto como um assistente de IA voltado ao consumidor quanto como a base de uma estratégia de "modelo como serviço" (model-as-a-service), na qual empresas poderiam construir aplicativos sobre a infraestrutura de IA da Alibaba Cloud. O nome Qianwen (千问), que significa "mil perguntas", reflete a ideia de buscar a compreensão por meio de extenso questionamento, enquanto "Tongyi" ancora o modelo no programa mais amplo de inteligência artificial da Alibaba.
Histórico
2023: lançamento e primeiras versões de código aberto. O Tongyi Qianwen foi anunciado em 11 de abril de 2023 e disponibilizado em fase beta por meio do DingTalk, plataforma corporativa de comunicação da Alibaba. Em agosto de 2023, a Alibaba Cloud publicou os pesos do Qwen-7B, um modelo bilíngue (chinês–inglês) de 7 bilhões de parâmetros, em plataformas como Hugging Face e ModelScope, sob uma licença que permitia uso comercial gratuito para organizações com menos de 100 milhões de usuários ativos mensais. Seguiram-se o Qwen-14B, em setembro, e o maior Qwen-72B, em novembro de 2023, além de modelos menores (1,8B e 0,5B) e dos primeiros modelos multimodais, como o Qwen-VL (visão–linguagem) e o Qwen-Audio. Esses lançamentos renderam ao Qwen, ainda em seu início, reputação na comunidade de código aberto por seu desempenho expressivo em relação ao tamanho do modelo.
2024: escalonamento iterativo. Em fevereiro de 2024, a Alibaba lançou a série Qwen1.5, que ampliou a cobertura para uma gama maior de tamanhos e incluiu uma variante baseada em mistura de especialistas (MoE, do inglês mixture-of-experts). A grande geração Qwen2 chegou em junho de 2024, com modelos de 0,5 bilhão a 72 bilhões de parâmetros treinados sobre corpora multilíngues substancialmente maiores, acompanhados de um relatório técnico detalhado. Ao longo do restante de 2024, a Alibaba expandiu a família com o Qwen2-Math, o Qwen2-VL, a série Qwen2.5 (setembro de 2024, pré-treinada com cerca de 18 trilhões de tokens) e o Qwen2.5-Coder. Em novembro de 2024, apresentou o QwQ-32B-Preview, um dos primeiros modelos de raciocínio abertos, projetado para "pensar" passo a passo, e, em dezembro de 2024, o modelo de raciocínio visual QVQ. O modelo proprietário de ponta Qwen2.5-Max, descrito como um grande sistema de mistura de especialistas treinado com mais de 20 trilhões de tokens, foi lançado em janeiro de 2025.
2025: raciocínio, agentes e modelos de um trilhão de parâmetros. A geração Qwen3, lançada em abril de 2025, introduziu modos híbridos de "pensamento" e "não pensamento" (thinking e non-thinking) dentro de um mesmo modelo, com modelos densos abertos de 0,6 bilhão a 32 bilhões de parâmetros e modelos MoE, entre eles o Qwen3-235B-A22B. Os lançamentos subsequentes incluíram o Qwen3-Coder (julho de 2025), um modelo MoE de grande escala especializado em programação agêntica; atualizações multimodais como o Qwen3-VL e o Qwen3-Omni; e o modelo proprietário de topo Qwen3-Max, que a Alibaba descreveu como ultrapassando um trilhão de parâmetros. No final de 2025, a Alibaba também lançou um aplicativo móvel dedicado do Qwen para usuários internacionais, indo além de sua interface de conversação baseada na web.
Arquitetura e características técnicas
Os modelos Qwen são baseados na arquitetura Transformer do tipo decoder-only (decoder-only Transformer), que fundamenta a maioria dos grandes modelos de linguagem contemporâneos. As gerações sucessivas incorporaram refinamentos modernos já consagrados, incluindo incorporações posicionais rotativas (RoPE, do inglês rotary position embeddings) para a codificação posicional, funções de ativação SwiGLU, normalização por raiz do quadrado médio (RMSNorm) e atenção com consultas agrupadas (GQA, do inglês grouped query attention), esta última destinada a reduzir memória e computação durante a inferência. As janelas de contexto se alongaram com o tempo, de alguns milhares de tokens nos primeiros modelos para 128 mil tokens e além nas gerações posteriores, com técnicas como o YaRN estendendo o contexto efetivo à casa do milhão de tokens em algumas variantes.
Diversas características definem a família:
- Multilinguismo. Embora bilíngue (chinês e inglês) em sua origem, as gerações posteriores foram treinadas com dados em dezenas a mais de uma centena de idiomas, o que torna o Qwen notavelmente forte em línguas não inglesas em comparação com muitos concorrentes ocidentais.
- Diversidade de escalas. A família abrange deliberadamente tamanhos que vão de aproximadamente 0,5 bilhão a centenas de bilhões de parâmetros, permitindo a implantação tanto em dispositivos de consumo quanto em centros de dados.
- Mistura de especialistas. As variantes MoE, iniciando com o Qwen1.5-MoE e prosseguindo pelo Qwen2, Qwen3 e sistemas de topo como o Qwen3-Coder, ativam apenas uma fração do total de parâmetros por token, o que melhora a eficiência.
- Pós-treinamento e raciocínio. Os modelos passam por ajuste fino supervisionado e aprendizado por reforço com feedback humano (RLHF) para o acompanhamento de instruções; os lançamentos voltados ao raciocínio (QwQ, QVQ e os modos de pensamento do Qwen3) aplicam aprendizado por reforço para induzir cadeias de raciocínio estendidas.
Família de modelos
O ecossistema Qwen compreende várias linhas interligadas:
- LLMs básicos e instrucionais em diversas escalas (por exemplo, Qwen, Qwen1.5, Qwen2, Qwen2.5 e Qwen3), cobrindo pontos de verificação de pré-treinamento e modelos de conversação ajustados por instruções.
- Modelos proprietários de topo (Qwen-Max, Qwen2.5-Max e Qwen3-Max), disponíveis apenas por meio dos serviços da Alibaba.
- Modelos de raciocínio: QwQ (texto) e QVQ (raciocínio visual).
- Modelos de código: CodeQwen1.5, Qwen2.5-Coder e Qwen3-Coder, com suporte a dezenas de linguagens de programação e a fluxos de trabalho agênticos.
- Modelos de matemática: Qwen2-Math e Qwen2.5-Math.
- Modelos multimodais: Qwen-VL/Qwen2-VL/Qwen2.5-VL/Qwen3-VL para compreensão de imagens e vídeos, Qwen-Audio e seus sucessores, e a linha "Omni" (Qwen2.5-Omni e Qwen3-Omni), que unifica entradas de texto, imagem, áudio e vídeo com saída de fala.
O acesso por consumidores e desenvolvedores é proporcionado por meio do Qwen Chat (chat.qwen.ai), dos aplicativos Tongyi/Qwen e das plataformas de modelos da Alibaba Cloud (DashScope, plataforma Bailian e o serviço internacional Model Studio).
Ecossistema de código aberto
Os lançamentos com pesos abertos têm sido centrais na estratégia do Qwen. Muitos modelos foram publicados sob a licença Apache 2.0, uma das mais permissivas disponíveis, que permite uso comercial irrestrito. Os modelos Qwen são distribuídos no Hugging Face, no ModelScope e no GitHub, com quantizações prontas que viabilizam sua execução em laptops e smartphones. Até 2025, a Alibaba informou que a família havia acumulado centenas de milhões de downloads e que mais de 100 mil modelos derivados haviam sido criados por terceiros — números que colocaram o Qwen entre os, senão o, ecossistema de LLMs de código aberto com maior adoção.
A família também serviu de base para trabalhos terceiros de destaque. Um exemplo notável é a série DeepSeek-R1-Distill, lançada em janeiro de 2025, na qual a DeepSeek realizou o ajuste fino de modelos Qwen (entre outros) com dados de raciocínio destilados de seu modelo R1, produzindo pequenos sistemas de raciocínio de ampla adoção. Uma fração significativa das entradas nos leaderboards comunitários de modelos ajustados e especializados também foi construída sobre pesos do Qwen.
Desempenho e recepção
Segundo as avaliações publicadas pela Alibaba, os modelos de topo sucessivos do Qwen mostraram-se competitivos com os principais modelos de fronteira. O Qwen2.5-72B teve desempenho comparável ao de outros modelos abertos líderes de escala similar; o Qwen2.5-Max foi reportado como igualando ou superando sistemas contemporâneos como DeepSeek-V3, GPT-4o e Claude 3.5 Sonnet em benchmarks selecionados; e o Qwen3-235B-A22B alcançou resultados próximos à fronteira em avaliações de raciocínio, matemática e programação. O Qwen3-Coder apresentou resultados expressivos em benchmarks de engenharia de software agêntica, como o SWE-bench Verified. Avaliações independentes corroboram, em geral, que a família Qwen lidera o campo dos modelos abertos, especialmente em tarefas multilíngues, matemáticas e de programação, embora os modelos proprietários de fronteira com frequência tenham mantido vantagem em algumas tarefas agênticas e de longo horizonte.
A análise crítica também observou aspectos comuns a modelos desenvolvidos na China: serviços de conversação baseados no Qwen foram observados recusando ou oferecendo respostas restritas a perguntas politicamente sensíveis, o que reflete exigências regulatórias aplicáveis aos serviços de IA na China. Alguns pesos iniciais do Qwen também foram modificados por terceiros em variantes "sem censura", fenômeno comum aos modelos abertos de modo geral.
Impacto e significado
O Qwen exerceu influência considerável no cenário global de inteligência artificial. Para a Alibaba, ancora uma estratégia que acopla pesquisa em IA a serviços de nuvem, ajudando a Alibaba Cloud a competir no mercado corporativo de IA e, segundo reportagens da imprensa em 2025, formando a base de uma parceria com a Apple para fornecer recursos de IA aos iPhones vendidos na China. Para a comunidade de código aberto, a licença permissiva e a ampla gama de tamanhos do Qwen fizeram dele uma fundação padrão para pesquisa, ajuste fino e aplicações em dispositivos em todo o mundo, sobretudo em idiomas asiáticos, do Oriente Médio e europeus pouco atendidos por modelos centrados no inglês. Na China, o Qwen é considerado uma das famílias de modelos mais influentes, ao lado das da DeepSeek, ByteDance, Zhipu e Moonshot, e seus lançamentos abertos têm sido citados como fator de rápida difusão da capacidade de grandes modelos pela indústria doméstica e pelo Sul Global.
Em meados da década de 2020, o Qwen segue em desenvolvimento ativo, com a Alibaba comprometendo investimentos plurianuais de grande monta em infraestrutura e pesquisa de IA, e com a família continuando a se expandir em escala, cobertura de modalidades e capacidades agênticas.
You May Be Interested In
Elon Musk
Elon Musk (nascido em 28 de junho de 1971) é um empreendedor, engenheiro e investidor nascido na África do Sul, posterio...
Galileu Galilei
Galileu di Vincenzo Bonaiuti de' Galilei (Pisa, 15 de fevereiro de 1564 — Arcetri, 8 de janeiro de 1642) foi um astrônom...
Pinheiro
Os pinheiros são árvores ou arbustos coníferos pertencentes ao gênero Pinus, o maior e mais relevante gênero do ponto de...
Gemini
Gemini é uma família de grandes modelos de linguagem multimodais desenvolvida pela Google DeepMind e apresentada em deze...
Related Articles
DeepSeek
DeepSeek (nome oficial: Hangzhou DeepSeek Artificial Intelligence Basic Technology Research Co., Ltd.; em chinês: 杭州深度求索...
Claude
Claude é uma família de modelos de linguagem de grande escala (LLMs, na sigla em inglês) desenvolvida pela Anthropic, em...
China
China, oficialmente República Popular da China, é um país soberano situado na Ásia Oriental, reconhecido como uma das ci...
Comments (0)
No comments yet. Be the first to comment!