Apenas depois de Fable 5, um modelo grande capaz de evoluir diariamente; é assustador, provavelmente é para se preparar para o Qianwen 4.
半沐
·
--
Sobre como o Qwen 3.8 implementa uma “evolução em base diária”; com base nas informações públicas atuais, seus mecanismos principais se refletem em três aspectos: atualizações automatizadas de alta frequência, ativação dinâmica na base da arquitetura e validação noturna das habilidades de agentes (Agent). Os detalhes são os seguintes:
1. Pesos e atualizações de links automatizadas em alta frequência O Qwen 3.8 rompe com o modelo tradicional de um único grande lançamento, introduzindo um mecanismo de iteração automatizada em alta frequência. A equipe revelou que, todas as madrugadas, o modelo atualiza automaticamente os pesos; a cada 48 horas, é atualizado o encadeamento de otimização de inferência; e semanalmente são enviados recursos totalmente novos de alinhamento multimodal. Isso faz com que a evolução do modelo se torne uma espécie de “transmissão ao vivo” contínua.
2. Roteamento dinâmico de especialistas e arquitetura híbrida com cache de memória em camadas Na arquitetura de base, o Qwen 3.8 abandona os truques tradicionais de ativação esparsa e adota uma arquitetura híbrida de “roteamento dinâmico de especialistas + cache de memória em camadas”. Esse design permite que os 2,4T parâmetros operem de forma dinâmica. Em tempo de execução, o modelo “não é um monstro acumulado à força, mas sim um agente inteligente que respira, reflete e sabe escolher”. Essa otimização na camada de arquitetura fornece a base técnica para iterações de alta frequência.
3. Mecanismo de “evolução e validação noturna” das habilidades do agente (Agent) No nível de execução de tarefas específicas do Agent, a série Qwen (como o Qwen 3-Max) aplica um “processo coletivo de evolução de habilidades”. Esse mecanismo transforma as conversas reais de interação do usuário em evidências estruturadas; o Evolver analisa padrões e gera atualizações candidatas. Essas habilidades candidatas não entram diretamente em produção; elas passam pela “fase de validação noturna”: executam-se simultaneamente as habilidades antigas e as novas candidatas em ambientes reais. Só quando a nova habilidade for de fato superior à antiga, em termos de taxa geral de sucesso da tarefa e estabilidade de execução, é que ela é aceita e implantada. Isso garante que o conjunto de habilidades já implantado não se degrade com o tempo, permitindo melhorias contínuas e estáveis de desempenho.
4. Testes contínuos na versão de prévia e pós-treinamento Atualmente, o modelo em prévia Qwen 3.8-Max que já foi colocado em produção está evoluindo continuamente em base diária. Há análises indicando que, com atualizações contínuas de pequenas versões desses parâmetros de base, o modelo pode estar realizando pós-treinamento intensivo, preparando o terreno para o lançamento da versão oficial 4.0.
Aviso legal: inclui opiniões de terceiros. Não constitui aconselhamento. A Binance AI pode ser utilizada sem garantia.Consulta os Termos e Condições.
4
Junta-te a utilizadores de criptomoedas de todo o mundo na Binance Square
⚡️ Obtém informações úteis e recentes sobre criptomoedas.
💬 Com a confiança da maior exchange de criptomoedas do mundo.
👍 Descobre perspetivas reais de criadores verificados.