Qwen3.8-Flash-Next-GGUF unsloth
- 種別
- model
- ライセンス
- other
- タスク
- image-text-to-text
- ダウンロード
- 4,354
- いいね
- 427
- パラメータ
- 176,943,899,520
- アクセス
- public
- ファイル
- 52
タグ
- マルチモーダル
- 大規模言語モデル
- 量子化
- GGUF
- ローカル推論
- 視覚言語モデル
- MoEアーキテクチャ
- 推論デプロイ
概要
Qwen4を支える実験的アーキテクチャ「Qwen3.8-Flash-Next」をベースにしたマルチモーダル大規模言語モデルのGGUF量子化版です。QSAスパースアテンションやGated Residual、N-gram埋め込みにより長コンテキスト処理と推論効率を向上させ、視覚エンコーダを備えて画像とテキスト入力を処理できます。125Bパラメータ(うち6B活性化)のMoE構成で、llama.cppやUnsloth Desktopでローカル実行可能です。
README
--- license: other license_name: qwen-community-1.0 license_link: LICENSE pipeline_tag: image-text-to-text base_model: - Qwen/Qwen3.8-Flash-Next tags: - unsloth --- # 私たちの [Qwen3.8-Flash-Next 実行ガイド](https://unsloth.ai/docs/models/qwen3.8-next) をお読みください! <div> <p style="margin: 0 0 0px 0; margin-top…