FAQ · PERGUNTAS FREQUENTES
Desmistificando IAs chinesas.
Tudo o que você precisa saber sobre Qwen, GLM e IAs chinesas: benchmarks, qualidade, preços, segurança e por que quem entende do assunto escolhe as melhores IAs com tranquilidade.
BR / CLOUD / AI
Qwen e GLM são realmente bons ou é só marketing?
São excelentes. Qwen3.8-Max tem 2,4 trilhões de parâmetros (MoE), contexto de 1M tokens e alcançou SOTA em benchmarks públicos como MMLU, HumanEval e GSM8K. GLM-5.3 também alcançou SOTA em raciocínio, código e agentes. Não é marketing — são resultados verificáveis em benchmarks independentes.
Por que os preços são tão mais baixos que OpenAI e Anthropic?
Economia de escala, eficiência arquitetural e estratégia de mercado. Z.AI e Alibaba Cloud operam com margens menores para ganhar market share. GLM-5.3-Flash custa $0,075/1M tokens (input) vs $2,00 do gpt-4.1 — é 26× mais barato, com qualidade comparável em muitas tarefas.
Modelos chineses são seguros para dados sensíveis?
Sim, quando bem arquitetados. Modelos com pesos abertos (open-weight) como GLM-5.3 e Qwen3.8 podem ser rodados on-premise, auditados e fine-tunados. Você tem controle total dos dados. Ativo Cloud adiciona RAGJur, validação em múltiplas camadas e conformidade LGPD.
Por que não usar direto do provedor (Z.AI, Alibaba Cloud)?
Você pode. Mas Ativo Cloud oferece: suporte local em português/espanhol/inglês, conformidade LGPD, integração com sistemas brasileiros, know-how em 6 verticais (PropTech, LegalTech, FinTech, HealthTech, WineTech, AI Platforms) e SLA contratual. O custo-benefício é superior.
Qual a diferença entre Qwen e GLM?
Qwen é da Alibaba Cloud (ecossistema Alibaba), GLM é da Z.AI (Zhipu AI). Ambos são open-weight, alcançaram SOTA em benchmarks e têm variantes flash para custo otimizado. Qwen tem mais foco em multimodalidade (visão, OCR), GLM tem mais foco em agentes e coding. A escolha depende do caso de uso.
Vocês são revendedores autorizados?
Não. Ativo Cloud é uma integradora independente. Não temos relação comercial direta com Z.AI ou Alibaba Cloud — somos parceiros que traduzem, validam e dão suporte local. Isso nos dá liberdade para recomendar o melhor modelo para cada caso, sem conflito de interesse.
Como vocês garantem que a IA não alucina?
RAGJur (Protocolo Anti-Alucinação, registrado no INPI), validação em 6 camadas (input sanitization, retrieval, generation, output filtering, human-in-the-loop, audit), modelos com pesos abertos e suporte local. Nenhuma resposta crítica sai sem passar por pelo menos duas camadas de validação.
Posso rodar esses modelos on-premise?
Sim. GLM-5.3, Qwen3.8 e suas variantes são open-weight. Você pode baixar os pesos, fine-tunar e rodar na sua infraestrutura. Ativo Cloud oferece consultoria para deploy on-premise, integração com seus sistemas e suporte contínuo.
Qual o SLA de vocês?
Uptime 99,9%, tempo de primeira resposta <4h, suporte 24/7 via WhatsApp (+55 11 96650-7100) e email. SLA contratual visível no painel do cliente. Infraestrutura em São Paulo, latência <50ms.
Vocês atendem governo?
Sim. Atendemos órgãos públicos municipais, estaduais e federais. Oferecemos conformidade LGPD, deploy local, suporte em 3 idiomas e experiência com licitações. Temos cenários de economia específicos para cada esfera (veja a página /economia).
E se eu já uso OpenAI ou Anthropic?
Perfeito. Muitos clientes nossos usam OpenAI/Anthropic para algumas tarefas e GLM/Qwen para outras, otimizando custo-benefício. Ativo Cloud ajuda a orquestrar múltiplos modelos, com roteamento inteligente baseado em custo, latência e qualidade.
Como começo?
Solicite uma proposta personalizada. Analisamos seu volume de uso, mix de modelos e requisitos de conformidade, e montamos um plano sob medida. Sem compromisso, sem dados fabricados.