DeepSeek-V4-Flash-Vision-Exp deepseek-ai
- Typ
- model
- Lizenz
- mit
- Aufgabe
- image-text-to-text
- Framework
- transformers
- Downloads
- 0
- Likes
- 259
- Parameter
- 304,646,824,126
- Zugriff
- public
- Dateien
- 84
Tags
- 多模态
- 视觉模型
- 大语言模型
- Agent
- 多模态生成
- transformers
- 推理部署
Zusammenfassung
Dieses experimentelle Modell erweitert die DeepSeek-V4-Flash-Architektur um visuelle Module und trainiert diese weiter, um visuelles Verständnis freizuschalten. Es verbessert die multimodalen Agentenfähigkeiten erheblich gegenüber der Basisversion, während es bei reinen Text-Agenten-Aufgaben vergle…
README
--- license: mit library_name: transformers pipeline_tag: image-text-to-text --- # DeepSeek-V4-Flash-Vision-Exp <!-- markdownlint-disable first-line-h1 --> <!-- markdownlint-disable html --> <!-- markdownlint-disable no-duplicate-header --> <div align="center"> <img src="https://github.com/deepseek…