Qwen3.8-Flash-Next Qwen

Tipo
model
Licencia
other
Tarea
image-text-to-text
Framework
transformers
Descargas
2,551
Me gusta
3,375
Parámetros
179,999,981,459
Acceso
public
Archivos
144

Etiquetas

  • multimodal
  • modelo fundacional
  • generación de texto
  • razonamiento
  • modelo visual
  • transformers
  • inferencia en GPU
  • agente

Resumen

Qwen3.8-Flash-Next es un modelo de lenguaje causal multimodal con codificador de visión (250B parámetros, 6B activos) que admite entradas de texto e imagen. Introduce una arquitectura experimental para Qwen4 con Atención Escasa de Qwen (QSA), Gated Residual, incrustación n-gram y MoE de 512 experto…

README

--- library_name: transformers license: other license_name: qwen-community-1.0 license_link: LICENSE pipeline_tag: image-text-to-text --- # Qwen3.8-Flash-Next > [!Note] > Este repositorio contiene los pesos del modelo y los archivos de configuración del modelo post-entrenado en el formato de Huggin…

查看完整页面 · 查看原文