Qwen3.8-Flash-Next-GGUF unsloth

種別
model
ライセンス
other
タスク
image-text-to-text
ダウンロード
4,354
いいね
427
パラメータ
176,943,899,520
アクセス
public
ファイル
52

タグ

  • マルチモーダル
  • 大規模言語モデル
  • 量子化
  • GGUF
  • ローカル推論
  • 視覚言語モデル
  • MoEアーキテクチャ
  • 推論デプロイ

概要

Qwen4を支える実験的アーキテクチャ「Qwen3.8-Flash-Next」をベースにしたマルチモーダル大規模言語モデルのGGUF量子化版です。QSAスパースアテンションやGated Residual、N-gram埋め込みにより長コンテキスト処理と推論効率を向上させ、視覚エンコーダを備えて画像とテキスト入力を処理できます。125Bパラメータ(うち6B活性化)のMoE構成で、llama.cppやUnsloth Desktopでローカル実行可能です。

README

--- license: other license_name: qwen-community-1.0 license_link: LICENSE pipeline_tag: image-text-to-text base_model: - Qwen/Qwen3.8-Flash-Next tags: - unsloth --- # 私たちの [Qwen3.8-Flash-Next 実行ガイド](https://unsloth.ai/docs/models/qwen3.8-next) をお読みください! <div> <p style="margin: 0 0 0px 0; margin-top…

查看完整页面 · 查看原文